Prévia do material em texto
25/05/2026, 14:36 estacio.saladeavaliacoes.com.br/prova/6a1485c7a0360c523d2590ec/ SM2 Tópicos De Big Data Em Python T 1 Marcar para revisão 00 : 38 : 13 Ocultar hora min seg Os componentes do Spark têm como objetivo facilitar desenvolvimento de projetos com finalidades específicas. Selecione a opção que contém o componente do ecossistema do Spark especializado em aplicações de Questão 1 de 10 aprendizado de máquina. 1 2 3 4 5 A MLlib 6 7 8 9 10 Respondidas (10) Em branco (0) Spark Learning Finalizar prova c GraphX Learning D RDDs E MLSpark 1/1025/05/2026, 14:36 estacio.saladeavaliacoes.com.br/prova/6a1485c7a0360c523d2590ec/ 2 Marcar para revisão paradigma MapReduce é uma estratégia de computação com capacidade de processar grandes conjuntos de dados de maneira distribuída em várias máquinas. Em relação à técnica MapReduce, selecione a opção que é responsável por consolidar os resultados produzidos ao longo do processamento. A Agregação Mapeamento c Separação D Redução E Processamento 3 Marcar para revisão 2/1025/05/2026, 14:36 Atualmente, Apache Spark é mais bem-sucedido framework para Big Data. Selecione a opção correta que contenha apenas funções que podem ser categorizadas como transformações no Spark. A count, collect e take. map, sample e collect. c map, filter e union. D reduce, first e map. E map, take e reduce. 4 Marcar para revisão Gabriel entrou recentemente em uma empresa de gestão de fundos de investimento. No seu primeiro dia de trabalho, lhe é conferida a tarefa de buscar os relatórios do pessoal da contabilidade para fazer suas análises exploratórias. departamento de contabilidade extrai os dados de seus relatórios de um SAP que retorna valores brutos de 3/1025/05/2026, 14:36 compras, quantidades de produtos etc. Então os contadores organizam, por agregação, informação relevante no relatório em planilhas por eles desenvolvidos. Por questões de acesso e segurança, Gabriel só pode lidar com essas planilhas. Este tipo de coleta feita por Gabriel e pelos Contadores é respectivamente dos tipos: A Secundária; Primária. Primária; Primária. c Secundária; Terciária. D Primária; Secundária. E Secundária; Secundária. 5 Marcar para revisão Sobre Pandas DataFrame, que podemos afirmar? - É o coletivo de séries temporais pandas. Series É a estrutura de dados que representa os dados em painel 4/1025/05/2026, 14:36 III É uma matriz conjunto de vetores IV É bloco fundamental da análise de dados moderna, principalmente para aprendizado de máquina. Analise as frases listadas e assinale a alternativa correta. A Apenas a opção III. B Apenas as opções I, II, IV. c Apenas as opções I, II, III. D Apenas as opções II, III. E Todas as opções I, II, III, IV. 6 Marcar para revisão Leonardo começou seu trabalho de conclusão de curso. Nesse trabalho, Leonardo quer elaborar um classificador de imagem, mas, não sabe se decidir com relação à configuração das camadas de sua rede neural. É 5/1025/05/2026, 14:36 estacio.saladeavaliacoes.com.br/prova/6a1485c7a0360c523d2590ec/ muito comum utilizarmos conjunto para fazermos benchmark de modelos de : A Pizzas; Categorias IRIS; Processamento da Linguagem Natural c MNIST; Processamento de Imagens D IRIS; Processamento de Imagens E MNIST; Processamento de Linguagem Natural 7 Marcar para revisão Como podemos checar as métricas de classificação do modelo neural da biblioteca Scikit-Learn? 6/1025/05/2026, 14:36 A Plotly Gráfico de Matriz de Dispersão c Gráfico de Histograma D Classification Report E Regressão Linear 8 Marcar para revisão Qual tipo de método nos permite visualizar a árvore de decisão na biblioteca Scikit-Learn? console.log print 7/1025/05/2026, 14:36 estacio.saladeavaliacoes.com.br/prova/6a1485c7a0360c523d2590ec/ c plot_tree D cout E printf 9 Marcar para revisão Os componentes do Spark (2.0 ou superior) têm como objetivo facilitar desenvolvimento de projetos com finalidades específicas. Nesse sentido, selecione a opção que contém componente responsável por estabelecer uma conexão com Cluster. A Spark.Catalog B SparkSession DataFrame https://estacio.saladeavaliacoes.com.br/prova/6a1485c7a0360c523d2590ec/ 8/1025/05/2026, 14:36 estacio.saladeavaliacoes.com.br/prova/6a1485c7a0360c523d2590ec/ D RDD E SparkContext 10 Marcar para revisão No contexto da ciência de dados, a temperatura registrada por sensores ambientais ao longo do dia é classificada como que tipo de dado? A Categórico Ordinal c Numérico 9/1005/2026, 14:36 estacio.saladeavaliacoes.com.br/prova/6a1485c7a0360c523d2590ec D E Nominal