Imagem de fundo

Considere um ambiente fazendário com petabytes de documentos fiscais em cluster, exigin...

Considere um ambiente fazendário com petabytes de documentos fiscais em cluster, exigindo armazenamento distribuído tolerante a falhas e também execução de análises iterativas com menor leitura repetida em disco. Nesse cenário, a combinação de sistema/framework que atende corretamente às necessidades é


A

Spark SQL para replicação de blocos e HDFS para execução de jobs em memória.


B

Sqoop para armazenamento distribuído e Flume para processamento analítico iterativo.


C

YARN para armazenamento e Hive para processamento iterativo em memória.


D

HBase para armazenamento de arquivos e MapReduce para análises iterativas com cache em memória.


E

HDFS para armazenamento distribuído e Apache Spark para processamento distribuído com uso intensivo de memória.