

Seu próximo nível começa aqui
Seu desenvolvimento não pode ter limites. Garanta sua Assinatura Ilimitada e libere uma preparação completa com os melhores professores do Brasil.
Considere um ambiente fazendário com petabytes de documentos fiscais em cluster, exigindo armazenamento distribuído tolerante a falhas e também execução de análises iterativas com menor leitura repetida em disco. Nesse cenário, a combinação de sistema/framework que atende corretamente às necessidades é
Spark SQL para replicação de blocos e HDFS para execução de jobs em memória.
Sqoop para armazenamento distribuído e Flume para processamento analítico iterativo.
YARN para armazenamento e Hive para processamento iterativo em memória.
HBase para armazenamento de arquivos e MapReduce para análises iterativas com cache em memória.
HDFS para armazenamento distribuído e Apache Spark para processamento distribuído com uso intensivo de memória.