Questões de Concurso sobre Banco de dados distribuídos e paralelos

 
 
Disciplina
Assunto 1
Banca
Instituição
Cargo
Ano
Carreira
Área de formação
Escolaridade
Dificuldade
 
Comentários:
Professores
Alunos
Meus Comentários
Vídeo
 
Minhas questões:
Resolvidas
Não resolvidas
Certas
Erradas
 
Tipo de questão:
Certo e errado
Múltipla escolha
Incluir questões:
Anuladas
Desatualizadas
 
Questões:
Todas as questões
 
Filtro simplificado
 
Questões
Todas as questões
 
99 questões encontradas
Questões por página
20
Mais recentes
 

Bancos de dados distribuídos organizam informações em múltiplos locais interligados, permitindo maior escalabilidade, disponibilidade e desempenho.


Nesse contexto, assinale a opção que corretamente apresenta um conceito válido em sistemas de bancos de dados distribuídos.


A

A fragmentação horizontal derivada ocorre quando uma relação é particionada a partir de predicados definidos sobre outra relação, de modo que sua fragmentação é diretamente impactada pela fragmentação dessa relação externa.


B

A fragmentação horizontal primária é realizada com base em predicados definidos sobre outra relação, aplicando-se a relações que dependem de dados externos.


C

A fragmentação vertical divide uma relação em partes distintas, podendo dispensar a presença da chave primária nos fragmentos, caso as aplicações não exijam reconstrução direta da relação original.


D

Na alocação, um banco totalmente replicado distribui fragmentos de forma que a atualização de dados tende a ser simplificada, já que as operações de modificação não dependem da existência de cópias adicionais em outros locais.


E

O diretório de dados distribuído concentra suas funções em um diretório global, encarregado de descrever tanto a visão geral quanto os detalhes internos relacionados aos sítios locais.

Analise as assertivas abaixo sobre replicação de dados em sistemas distribuídos:


I. Na replicação síncrona, toda gravação é considerada completa apenas após confirmação de todas as réplicas, garantindo forte consistência, mas prejudicando a latência da escrita.

II. Na replicação assíncrona, a transação é confirmada assim que chega na réplica primária, sem esperar pelas demais, o que melhora o desempenho, mas pode levar a perdas de dados em caso de falhas.

III. A replicação assíncrona elimina completamente o risco de inconsistência entre réplicas, já que as atualizações são aplicadas em momentos diferentes.

IV. A replicação síncrona exige coordenação mais complexa, com estratégias como votações ou bloqueios distribuídos, tornando o protocolo de commit mais lento e custoso.


Quais estão corretas?


A

Apenas l e II.


B

Apenas Il e IV.


C

Apenas Il e IV.


D

Apenas I, Il e IV.


E

I, II, IIl e lV.

Uma das condições para que um banco de dados seja considerado distribuído é a necessidade de homogeneidade entre os nós conectados, no que diz respeito a hardware e software.


C

Certo


E

Errado

Em sistemas de banco de dados distribuídos, são utilizados os conceitos de


A

abstração e chave estrangeira.


B

método e cardinalidade.


C

nós e replicação.


D

polimorfismo e chave primária.


E

herança e relacionamento.

A regra de SGBD distribuído que define que a probabilidade de o sistema funcionar sem queda em qualquer momento dado’’, porque, por ser distribuído, pode continuar a funcionar, mesmo diante da falha de algum componente individual, tal como um site isolado, é designada:


A

confiabilidade.


B

independência de localização.


C

dependência de replicação.


D

durabilidade.

O Banco Nossa Caixa é o primeiro banco do hemisfério sul a implantar o GDPS (Processamento Paralelo em Locais Geograficamente Distantes, na sigla em inglês), sistema que processa, simultaneamente, todos os dados da instituição em dois locais fisicamente separados. A tecnologia garante o armazenamento e a continuidade do funcionamento de todos os canais de atendimento e de negócios do banco, ainda que a operação de um dos equipamentos responsáveis por essas funções seja interrompida por um blecaute ou incêndio, por exemplo. O banco investiu R$ 80 milhões no projeto, que levou quatro anos desde a concepção até a implantação.


Do Banco Nossa Caixa


Disponível em: https://www.saopaulo.sp.gov.br/ultimas-noticias/ nossa-caixa-usa-sistema-pioneiro-de-processamento-de-dados/. Acesso em: 5 jan. 2024.


No modelo de arquitetura Massively Parallel Processor, MPP, extensibilidade e escalabilidade são características comuns e vantajosas no armazenamento e no processamento de dados paralelos.


Nesse contexto, qual modelo de processamento se enquadra à arquitetura MPP?


A

disco compartilhado (shared-disk)


B

memória compartilhada (shared-memory)


C

memória distribuída (shared-nothing)


D

três esquemas (ANSI/SPARC)


E

visões materializadas (materialized view)

Bancos de dados distribuídos trabalham com escalabilidade horizontal, na qual ocorre a expansão da capacidade de armazenamento de um nó específico.


C

Certo


E

Errado

Algoritmos para assimilação de dados podem ser implementados de maneira eficiente e otimizada por meio de paralelização de processos.

O Parallel Data Assimilation Framework (PDAF) é um pacote de software que simplifica a implementação de métodos de assimilação, provendo versões totalmente paralelizadas de algoritmos, como por exemplo, diferentes versões dos Filtros de Kalman por conjunto (EnKF). Um dos requisitos de funcionamento do PDAF é o uso de um protocolo padronizado de comunicação para computação paralela.


O principal padrão de comunicação entre os processos paralelos executados em um sistema de memória distribuída, é denominado


A

Secure Shell (SSH).


B

Message Passing Interface (MPI).


C

Transmission Control Protocol (TCP).


D

Representational State Transfer (REST).


E

Lightweight Communications and Marshalling (LCM).

Cabe ao cliente do provedor de serviços em nuvem estabelecer as normas e os procedimentos que devem compor as políticas de segurança desses serviços para fins de controle de acesso ao sistema.


C

Certo


E

Errado

Bancos de dados não relacionais empregam modelos de armazenamento otimizados para os requisitos específicos do tipo de dados que está sendo armazenado em vez de esquemas de tabelas de linhas e colunas como na maioria dos sistemas de banco de dados tradicionais.

Como variam conforme os modelos de dados a serem processados, foram desenvolvidas diferentes categorias de sistemas gerenciadores de bancos de dados (SGBD) com potencialidades específicas.


Assinale a opção que apresenta a correta relação entre o SGBD e o tipo de dados para o qual foi desenvolvido.


A

Cassandra, para bancos de dados de documentos.


B

HBase, para bancos chave-valor.


C

MongoDB, para bancos de dados colunares.


D

Neo4J, para bancos de dados em grafos.


E

Redis, para bancos de dados de documentos.

Um caso típico de fragmentação em vários bancos de dados é o particionamento de registros correspondentes a diferentes usuários em uma coleção de bancos de dados.


C

Certo


E

Errado

Considere que, em um projeto de análise de dados, um analista sugeriu o uso de motores de busca do tipo Elasticsearch, o qual foi configurado para realizar uma série de transformações nos dados de entrada, em um pipeline, antes da indexação dos dados. No entanto, o analista constatou um desempenho abaixo do esperado nas transformações e concluiu ser necessária a adição de nós Elasticsearch dedicados à execução de pipelines de préprocessamento de dados. Qual tipo de nós Elasticsearch deverão ser adicionados?


A

Data.


B

Machine Learning.


C

Ingest.


D

Master.

(SGBD) são sistemas nos quais o armazenamento e o processamento de dados são distribuídos entre vários dispositivos ou nós em uma rede de computadores. A respeito das vantagens dos SGBD, assinale a afirmativa incorreta.


A

Os dados ficam localizados próximos do local de maior demanda.


B

A adaptação ao crescimento da base de dados é mais simples.


C

á maior confiabilidade por trabalharem com componentes replicados eliminando assim pontos únicos de falha.


D

A segurança dos dados é mais fácil de se garantir em um ambiente distribuído.


E

Custos operacionais reduzidos, pois é mais eficiente adicionar estações de trabalho a uma rede do que atualizar um sistema de mainframe.

Os nós de um banco de dados distribuído podem estar em uma mesma rede local ou separados geograficamente por grandes distâncias, desde que estejam conectados por uma rede remota.


C

Certo


E

Errado

Sistemas de bancos de dados apresentam benefícios e desafios potencializados quando é possível adotar uma solução de gerência distribuída, coordenada por um sistema de banco de dados distribuído.


Nesse contexto, uma importante questão de projeto refere-se à


A

autonomia, dimensão a ser considerada na arquitetura de um banco de dados distribuído, pois indica como a distribuição dos dados será processada, com a designação de fragmentos por nó.


B

confiabilidade do sistema, que pode, em função da natureza dos dados e da natureza das aplicações clientes, ser relaxada, em prol do desempenho de execução das consultas.


C

fragmentação vertical de dados, uma técnica que particiona um conjunto de dados em tuplas, ou registros, entre os nós do sistema distribuído.


D

replicação de dados seja ela total ou parcial, pois demanda a implementação de protocolos que garantam a consistência das réplicas.


E

execução de consultas, que se concentram na minimização dos custos de processador e de entrada e saída, sendo os custos de comunicação parcela de menor impacto no total.

O IBGE é responsável no Brasil pela Classificação Nacional de Atividades Econômicas (código CNAE). Considere que um órgão de atuação nacional, que possui infraestrutura de Tecnologia de Informação e Comunicação (TIC) em todos os estados brasileiros, deseja realizar um censo de pequenas e médias empresas em 10 estados do Brasil. Para guardar os dados dessas empresas, foi criado um banco de dados distribuído (BDD) relacional com particionamento horizontal, também conhecido como sharding em muitos SGBDs NoSQL, utilizando como critério de distribuição a UF onde se localiza a sede da empresa, de tal modo que as empresas do Rio de Janeiro têm seus dados guardados na infraestrutura de TIC desse órgão no Rio de Janeiro.


Com os dados distribuídos dessa forma,


A

a falha em uma das infraestruturas de TIC pode inviabilizar o uso de todo o banco de dados.


B

as características ACID não podem ser garantidas em uma transação distribuída.


C

as consultas a dados sumarizados podem ser otimizadas por meio da utilização de MapReduce.


D

os metadados do BDD devem ficar localizados apenas na infraestrutura de TIC da sede do órgão.


E

os programas que consultam esses dados precisam saber em que estado eles se encontram.

Bancos de Dados são implementados para solucionar dois problemas que se apresentam quando o objetivo é o armazenamento de dados. Um deles está associado a dados duplicados, significando que as mesmas informações existem em vários locais no banco de dados. O outro problema está relacionado à situação em que os mesmos dados existem com conteúdos diferentes em várias tabelas, sobre um determinado objeto ou pessoa, podendo causar informações não confiáveis e sem sentido.


Esses dois problemas são conhecidos, respectivamente, como:


A

Redundância e inconsistência.


B

Intercorrência e redundância.


C

Inconsistência e independência.


D

Independência e intercorrência.

Para melhorar o processamento de grandes volumes de dados através de computação paralela ou distribuída, pode-se utilizar sharding, técnica que divide os dados em partes menores, chamadas shards. Essas partes são normalmente armazenadas em diferentes nós, ou sítios, de processamento em um sistema distribuído.


O sharding é necessário para garantir a


A

privacidade dos dados


B

eficiência do processamento de dados


C

disponibilidade dos dados em caso de falha de um nó


D

escalabilidade do sistema de processamento de dados


E

consistência dos dados em caso de alteração de um shard

Um Banco de Dados Distribuído (BDD) é uma coleção de múltiplos bancos de dados logicamente interrelacionados e distribuídos por uma rede de computadores. O controle de concorrência se baseia no bloqueio, exatamente como na maioria dos sistemas não distribuídos. Todavia, requisições para testar, impor e liberar bloqueios se tornam mensagens e, por essa razão, o controle de concorrência em BDD tem como premissa o tratamento da:


A

sobrecarga.


B

atualização de regras.


C

autonomia local.


D

independência de localização.

Ao se migrar para uma arquitetura cliente/servidor multinível, a mesma aplicação pode assumir simultaneamente as funções de cliente e de servidor.


C

Certo


E

Errado

 
 
Gerar simulado