Imagem de fundo

A prefeitura de uma grande cidade deseja processar dados provenientes de sensores insta...

A prefeitura de uma grande cidade deseja processar dados provenientes de sensores instalados no trânsito urbano, coletados em tempo real, para identificar padrões de congestionamento e propor soluções automatizadas. Nesse caso, o componente específico do Apache Spark que o torna adequado para realizar esta tarefa é o


A

MapReduce, que processa dados de forma distribuida, sendo ideal para o processamento em batch de grandes volumes de dados em tempo real.


B

framework Spark SOL, que é usado para configurar bancos de dados relacionais em tempo real, olimizando o armazenamento dos dados do trânsito.


C

módulo spark MLlib, que é utilizado para a coleta e processamento de dados de sensores em tempo real.


D

Hadoop Distributed File System (HDFS), que permite o processamento em tempo real de dados em fluxo, utilizando clusters locais para garantir baixa latência.


E

múdulo Spark Streaming, que permite o processamento em tempo real de dados em fluxo, utilizando micro-batches para garantir baixa latência.