Ed
ano passado
Vamos analisar cada uma das afirmações sobre o RDD (Resilient Distributed Dataset) do Apache Spark: ( ) É uma estrutura física do Spark que guarda informações dos objetos do Spark. Sua única limitação é não possuir um mecanismo para tratamento de falhas. É falsa. O RDD é uma abstração que permite o processamento de dados em paralelo, e uma de suas principais características é justamente o suporte a tolerância a falhas, pois ele pode ser reconstruído a partir de dados originais em caso de falha. ( ) Possui uma estrutura similar a uma tabela, conhecida como dataset que pode armazenar dados de diferentes tipos. É verdadeira. O RDD pode ser considerado uma coleção de objetos que podem ser de diferentes tipos, mas a afirmação é um pouco confusa, pois o termo "dataset" é mais associado ao DataFrame, que é uma estrutura tabular. Portanto, essa afirmação é um pouco enganosa, mas pode ser considerada verdadeira em um contexto mais amplo. ( ) Fornece suporte a dois tipos de operações: transformação e ação. Quando se aplica uma transformação um novo RDD é criado, mas o conjunto de dados só é alterado se for aplicada uma etapa de ação. Algumas operações de transformação são: SortByKey, FlatMap e GroupByKey enquanto que collect, count e CountByKey são operações de ação. É verdadeira. Essa afirmação descreve corretamente como funcionam as operações em RDDs. Agora, vamos resumir as classificações: 1. F 2. V 3. V Portanto, a sequência correta é: A) F – V – V – F.
Cadastre-se ou realize login
Ed
há 2 anos
A alternativa correta é a letra B: F – V – V – V.
Mais perguntas desse material