Prévia do material em texto
18/06/22, 06:50 EPS
https://simulado.estacio.br/alunos/ 1/3
Herbert Gomes da Silva
202004099248
Disciplina: TÓPICOS DE BIG DATA EM PYTHON AV
Aluno: HERBERT GOMES DA SILVA 202004099248
Professor: ROBSON LORBIESKI
Turma: 9001
EEX0174_AV_202004099248 (AG) 09/06/2022 19:06:29 (F)
Avaliação:
2,0
Nota Partic.: Nota SIA:
2,0 pts
Estação de trabalho liberada pelo CPF 91284074315 com o token 201078 em 09/06/2022 19:01:16.
O aproveitamento da Avaliação Parcial será considerado apenas para as provas com nota maior ou igual a 4,0.
02260 - ANÁLISE DE DADOS EM PYTHON COM PANDAS
1. Ref.: 6076913 Pontos: 0,00 / 1,00
A coleta e preparação dos dados para análise no Python são de extrema importância. Os dados secundários são assim
definidos devido:
O fato de terem sido obtidos a partir de terceiros.
O fato de virem de uma fonte alternativa não convencional.
O fato de requererem muito mais pré-processamento.
O fato de ocuparem menos espaço de memória.
A sua baixa qualidade.
2. Ref.: 6076764 Pontos: 0,00 / 1,00
A biblioteca pandas é poderosa e de grande valia para a vida de um cientista de dados. Sobre ela podemos afirmar
que:
I - O nome Pandas se refere a dados em painel ou panel data
II - O DataFrame é o coletivo de listas (lists)
III - É possível criarmos DataFrames a partir de praticamente qualquer estrutura de dados, principalmente CSVs,
Excels, e JSONsAnalise as frases listadas e assinale a alternativa correta.
Apenas I.
Apenas I e II.
Apenas II.
Apenas II e III.
Apenas I e III.
02318 - BIG DATA ANALYTICS
Educational Performace Solution EPS ® - Alunos
javascript:voltar();
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6076913.');
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6076764.');
javascript:alert('Educational Performace Solution\n\nEPS: M%C3%B3dulo do Aluno\n\nAxiom Consultoria em Tecnologia da Informa%C3%A7%C3%A3o Ltda.')
18/06/22, 06:50 EPS
https://simulado.estacio.br/alunos/ 2/3
3. Ref.: 6075834 Pontos: 0,00 / 1,00
As redes neurais são implementadas em Python através de uma biblioteca de processamento de cálculos em paralelo
baseada em grafos. Qual o nome desta biblioteca?
Scipy
Plotly
Numpy
Tensorflow
Pandas
4. Ref.: 6076113 Pontos: 0,00 / 1,00
Qual o tipo de método nos permite visualizar a árvore de decisão na biblioteca Scikit-Learn?
console.log
printf
plot_tree
print
cout
02508 - HADOOP E ARMAZENAMENTO DE DADOS
5. Ref.: 6076138 Pontos: 0,00 / 1,00
Em relação aos RDBMS, selecione a opção que apresenta a característica que trata as transações em um banco
de dados como uma unidade indivisível.
Isolamento.
Indivisibilidade.
Durabilidade.
Consistência.
Atomicidade.
6. Ref.: 6076199 Pontos: 0,00 / 1,00
O sistema de arquivos distribuídos do Hadoop, conhecido como HDFS, foi idealizado para trabalhar com grandes
volumes de dados. Selecione a opção correta que apresenta o paradigma como o HDFS funciona.
Centralizado e centralizado.
Distribuído e centralizado.
Distribuído e distribuído.
Mestre e escravo.
Centralizado e distribuído.
02727 - PRINCÍPIOS DE BIG DATA
7. Ref.: 6067294 Pontos: 1,00 / 1,00
Selecione a opção a respeito da computação em nuvem.
trata-se da utilização de aplicações com finalidades específicasEducational Performace Solution EPS ® - Alunos
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6075834.');
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6076113.');
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6076138.');
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6076199.');
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6067294.');
javascript:alert('Educational Performace Solution\n\nEPS: M%C3%B3dulo do Aluno\n\nAxiom Consultoria em Tecnologia da Informa%C3%A7%C3%A3o Ltda.')
18/06/22, 06:50 EPS
https://simulado.estacio.br/alunos/ 3/3
é uma forma de abstrair serviços da internet das coisas em redes locais distribuídas
é uma outra forma de denominar a internet das coisas
é a definição para aplicações de Big Data que utilizam os protocolos de internet
é um conjunto de tecnologias que disponibilizam sistemas e recursos na internet
8. Ref.: 6067388 Pontos: 1,00 / 1,00
Em relação às aplicações de Internet das coisas, selecione a opção correta sobre os seus objetivos.
Obter dados que sirvam como base na tomada de decisão
Ampliar o volume de dados da aplicação
Aumentar a diversidade dos dados
Melhorar a interatividade com o usuário
Aumentar a complexidade do processo de gestão dos dados
02729 - PRINCIPIOS DE DESENVOLVIMENTO DE SPARK COM PYTHON
9. Ref.: 6076011 Pontos: 0,00 / 1,00
A escolha adequada de uma linguagem de programação é fundamental para a maximização dos resultados
almejados. Nesse sentido, selecione a opção que contém a linguagem de programação mais adequada para
desenvolver aplicações para o Spark.
R
Java
Scala
Python
Java Script
10. Ref.: 6082362 Pontos: 0,00 / 1,00
O MapReduce é uma técnica de computação distribuída considerada extremamente eficiente para o processamento de
dados, desempenhando papel fundamental no Spark. Em relação ao MapReduce, selecione a opção correta.
Só é possível utilizar o MapReduce no Spark através do PySpark.
A principal característica do MapReduce é a utilização eficiente da memória.
Pode ser aplicada para projetos que envolvam grandes volumes e variedade de dados.
Projetos de big data só podem ser tratados por MapReduce.
As fases de processamento do MapReduce podem variar de acordo com a aplicação.
Educational Performace Solution EPS ® - Alunos
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6067388.');
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6076011.');
javascript:alert('C%C3%B3digo da quest%C3%A3o: 6082362.');
javascript:alert('Educational Performace Solution\n\nEPS: M%C3%B3dulo do Aluno\n\nAxiom Consultoria em Tecnologia da Informa%C3%A7%C3%A3o Ltda.')