

Seu próximo nível começa aqui
Com a Assinatura Ilimitada, você tem tudo que precisa para sua aprovação.
Com a Assinatura Ilimitada, você combina prática, teoria e método em uma única assinatura com tudo que você precisa para sua aprovação.
Um banco de dados de Big Data deve possuir pelo menos três aspectos, os chamados 3Vs do Big Data, que são:
Variedade; Volume; Valor.
Valor; Variabilidade; Velocidade.
Volume; Veracidade; Velocidade.
Veracidade; Velocidade; Variedade.
Velocidade; Volume; Variedade.
Uma big data não engloba dados não estruturados, mas inclui um imenso volume de dados estruturados suportado por tecnologias como o DataMining e o DataWarehouse para a obtenção de conhecimento a partir da manipulação desses dados.
Certo
Errado
Um dos grandes desafios atualmente na área de tecnologia da informação é a manipulação e processamento de grande quantidade de dados no contexto de Big Data. Analise as seguintes afirmações neste contexto e classifique-as como verdadeiras (V) ou falsas (F). Em seguida assinale a opção correta.
I. Além de lidar com volumes extremamente grandes de dados dos mais variados tipos, soluções de Big Data também precisam trabalhar com distribuição de processamento e elasticidade.
II. Alguns exemplos de bancos de dados NoSQL são o Cassandra, o MongoDB, o HBase, o CouchDB e o Redis.
III. As quatro propriedades de um banco de dados (atomicidade, consistência, isolamento e durabilidade) são a base para aplicações de Big Data implementadas no NoSQL.
IV. O Hadoop é uma plataforma open source desenvolvida especialmente para processamento e análise de grandes volumes de dados, sejam eles estruturados ou não estruturados.
As afirmações I, II, III e IV são, respectivamente:
V, V, V, V.
V, F, V, F.
V, V, F, V.
F, V, F, V.
F, F, F, F.
Em relação a Big Data e NoSQL, é correto afirmar que
os “3 Vs” principais do Big Data referem-se a Volume, Velocidade e Versatilidade de dados.
na era do Big Data, as únicas estratégias eficientes para garantir a privacidade são consentimento individual, opção de exclusão e anonimização.
o Hadoop, o mais conhecido e popular sistema para gestão de Big Data, foi criado pela IBM, a partir de sua ferramenta de Data Mining WEKA.
o NoSQL é um sistema relacional, distribuído, em larga escala, muito eficaz na organização e análise de grande quantidade de dados.
o Cassandra é um sistema de banco de dados baseado na abordagem NoSQL, originalmente criado pelo Facebook, no qual os dados são identificados por meio de uma chave.
A expressão Big Data é utilizada para descrever o contexto da informação contemporânea, caracterizada pelo volume, velocidade e variedade de dados disponíveis, em escala inédita. Com relação às características do Big Data, analise as afirmativas a seguir.
I. O volume da informação se refere ao fato de que certas coleções de dados atingem a faixa de gigabytes (bilhões de bytes), terabytes (trilhões), petabytes (milhares de trilhões) ou mesmo exabytes (milhões de trilhões).
II. A velocidade está relacionada à rapidez com a qual os dados são produzidos e tratados para atender á demanda, o que significa que não é possível armazená‐los todos, de modo que somos obrigados a escolher dados para guardar e outros para descartar.
III. A variedade significa que os dados de hoje aparecem em todos os tipos de formatos, como, por exemplo, arquivos de texto, e‐mail, medidores e sensores de coleta de dados, vídeo, áudio, dados de ações do mercado ou transações financeiras.
Assinale:
se somente a afirmativa I estiver correta.
se somente a afirmativa II estiver correta.
se somente a afirmativa III estiver correta.
se somente as afirmativas I e II estiverem corretas.
se todas as afirmativas estiverem corretas.
O modelo estrela (star schema) é a denominação comum para um modelo de dados multidimensional.
Nesse tipo de modelo,
Os esquemas em estrela e em flocos de neve são dois modelos multidimensionais comuns. Dadas as suas características, o modelo em flocos de neve aumenta a redundância de dados e, por isso, aumenta o espaço utilizado em disco.
O coeficiente de correlação não mede a relação causa-efeito entre duas variáveis. Os objetivos da análise de regressão são compreender a relação entre uma variável dependente e uma ou mais variáveis independentes e projetar ou estimar uma variável em função de uma ou mais variáveis independentes.