Questões de Concurso sobre Banco de dados para análise estatística

 
 
Disciplina
Assunto 1
Banca
Instituição
Cargo
Ano
Carreira
Área de formação
Escolaridade
Dificuldade
 
Comentários:
Professores
Alunos
Meus Comentários
Vídeo
 
Minhas questões:
Resolvidas
Não resolvidas
Certas
Erradas
 
Tipo de questão:
Certo e errado
Múltipla escolha
Incluir questões:
Anuladas
Desatualizadas
 
Questões:
Todas as questões
 
Filtro simplificado
 
Questões
Todas as questões
 
21 questões encontradas
Questões por página
20
Mais recentes
 

A ciência de dados utiliza métodos e técnicas com o objetivo de extrair conhecimento e insights a partir de grandes volumes de dados. A análise de dados inicia-se com uma pergunta que pode ser classificada em diversos tipos. O tipo de pergunta que busca identificar se existem padrões, tendências ou relacionamentos em um conjunto de dados, sem a necessidade de uma hipótese prévia, é classificada como:


A

Descriptive


B

Exploratory


C

Predictive


D

Inferential


E

Causal

A utilização de técnicas de análise quantitativa, como análise de séries temporais, pode revelar informações relevantes e tendências futuras acerca de determinado conjunto de dados.


C

Certo


E

Errado

Por meio de uma análise em um gráfico no Power BI, um especialista percebeu que terá de trabalhar com valores negativos. Existe um gráfico adequado para esta situação que exibe um valor total acumulado e suas alterações à medida que os valores são alterados e, nesse caso, pode-se acompanhar o resultado por meio da variação dos valores e ainda verificar a sua relevância e como ela incide sobre o total. Nessa situação o especialista escolheria o gráfico:


A

Barras


B

Funil


C

Cascata


D

Dispersão

Observe as afirmativas a seguir, em relação aos sistemas de Manipulação e Tratamento de Dados empregando o pacote dlyr, do Sistema R, que é uma linguagem e um ambiente para gráficos e computação estatística:


I.A função group_by() sumariza a base, reduzindo vários valores a um único resumo.

II.A função arrange() seleciona colunas, escolhendo variáveis com base em seus nomes.

III.A função filter() filtra linhas, escolhe casos com base em seus valores.


Estão corretas as afirmativas:


A

I apenas.


B

I e III apenas.


C

II apenas.


D

III apenas.

A linguagem Perl é extensamente utilizada para análise estatística e visualização de dados, sendo considerada superior à linguagem R no que diz respeito às funcionalidades para manipulação de grandes volumes de dados.


C

Certo


E

Errado

Um analista de dados recebeu a tarefa de estimar os consumidores de uma rede de lojas de varejo digital que têm maior probabilidade de voltar a adquirir determinado produto. A empresa disponibilizou tabelas contendo, respectivamente, a lista de consumidores com seus dados demográficos, os resultados de vendas de cada loja e os dados básicos como endereço e área ocupada por cada loja. Para alimentar sua ferramenta de mineração de dados é necessário agregar as tabelas repassadas em um único banco de dados.


Considerando o modelo de referência CRISP-DM, esse analista encontra-se na etapa de


A

avaliação.


B

modelagem.


C

entender os dados.


D

entender o negócio.


E

preparação dos dados.

Um professor de informática do ensino médio utilizou tablets em sala de aula para que os alunos aprendessem a criar gráficos simples no Excel, interpretando os dados de uma pesquisa escolar. É CORRETO afirmar que essa prática representa:


A

Apenas entretenimento digital, sem aplicação pedagógica.


B

Restrição do uso da tecnologia a conteúdos recreativos.


C

Isolamento da tecnologia do processo educativo.


D

Uso das TICs de forma pedagógica, promovendo alfabetização digital.

O termo beyond banking refere-se a


A

uma expansão internacional de uma instituição financeira brasileira.


B

um ecossistema no qual instituições financeiras oferecem produtos e serviços financeiros e não financeiros.


C

C uma permissão para clientes brasileiros adquirirem produtos de instituições estrangeiras.


D

uma expansão de uma instituição estrangeira no Brasil.


E

uma estratégia de transferir para o celular atividades conduzidas em agências físicas.

Em relação a regressão logística, analise as afirmativas a seguir.


I. É uma forma especializada de regressão que é formulada para prever e explicar uma variável categórica binária e, não uma medida dependente métrica.

II. Os modelos lineares generalizados podem ser considerados como uma abordagem de modelagem de dois estágios. Primeiro se modela a variável de resposta usando uma distribuição de probabilidade, como a distribuição binomial ou de Poisson e segundo se modela o parâmetro da distribuição usando uma coleção de preditores e uma forma especial de rede neural.

III. A regressão logística por ser usado como uma ferramenta para construir modelos quando existe uma variável de resposta categórica com três níveis. A regressão logística é um tipo de modelo linear não generalizado para variáveis de resposta onde a regressão linear múltipla não funciona muito bem.


Estão corretas as afirmativas


A

I, II e III.


B

II e III, apenas.


C

I e II, apenas.


D

III apenas.


E

I apenas.

O Analista de Sistemas foi solicitado a gerar um relatório que sumarize os dados de acesso ao portal da Assembleia no último trimestre, mostrando o número total de visitantes e as páginas mais acessadas. Este relatório visa apenas entender o que aconteceu no período.


O tipo de análise de dados é focado em sumarizar e descrever o que ocorreu historicamente nos dados é a Análise


A

Preditiva.


B

Prescritiva.


C

Descritiva.


D

Diagnóstica.


E

Evolutiva.

As ferramentas de análise de dados são usadas para coletar, manipular e interpretar dados, contribuindo para a tomada de decisões.


São ferramentas que podem ser consideradas como de análise de dados:


1. Editores de texto, como o Microsoft Word.

2. Linguagens de programação como o Python ou o R.

3. Criadores de apresentações de slides, como o Microsoft Power Point ou o Canva.

4. Planilhas de dados, como o Microsoft Excel.

5. Plataformas de Big Data (grande volume de dados).


Assinale a alternativa que indica todas as afirmativas corretas.


A

São corretas apenas as afirmativas 1, 2 e 5.


B

São corretas apenas as afirmativas 1, 3 e 4.


C

São corretas apenas as afirmativas 1, 3 e 4.


D

São corretas apenas as afirmativas 2, 3 e 5.


E

São corretas apenas as afirmativas 2, 4 e 5

Seja x uma amostra de uma variável aleatória gaussiana de média 0 e variância 1. A tabela abaixo mostra a probabilidade de x ser menor que alguns valores V entre 0,0 e 2,1.


Imagem associada para resolução da questão


Se somarmos 9 amostras independentes da mesma variável aleatória de x, o valor mais próximo da probabilidade dessa soma ser maior que 1,8, entre as opções apresentadas a seguir, é:


A

0,42.


B

0,54.


C

0,27.


D

0,18.


E

0,04.

Como gestor de tecnologia da informação em uma instituição financeira, você está focado em utilizar disciplinas matemáticas para melhorar a eficiência dos sistemas e processos de TI. Qual das seguintes alternativas é a mais relevante para ajudar a alcançar esses objetivos?


A

Análise de séries temporais, para prever variações nos preços de ações e otimizar investimentos.


B

Geometria analítica, para analisar a distribuição física de equipamentos de TI nos diferentes departamentos do banco.


C

Teoria dos números, para melhorar a segurança e a criptografia de dados sensíveis dos clientes.


D

Estatística inferencial, para analisar o desempenho de aplicativos de e-banking e sugerir melhorias.

Nas empresas é comum o uso de softwares de escritório para se trabalhar com dados estatísticos, por exemplo, com o uso do Calc do LibreOffice é possível verificar a média, a mediana ou o desvio padrão dos dados de uma população, etc. Considerando a planilha abaixo, indique a fórmula que coloca o status de “Peso normal” e “Acima do peso” na coluna status usando fórmulas para isso. Considere: Peso normal IMC: entre 18,5 e 24,9 e Acima do peso IMC: entre 25 e 29,9. IMC = Peso/(Altura)2.


Imagem associada para resolução da questão


Fonte: Próprio autor.


A

SE((C2<=18,5 E C2<=24,9); “Acima do Peso” ; “Peso normal”)


B

=SE((C2>=18,5 E C2<=24,9);”Peso normal”;”Acima do peso”)


C

=SE(B2>24,9; “Acima do Peso”; “Peso normal”)


D

=SE(E(C2>=18,5; C2<=24,9);”Peso normal”;”Acima do peso”)


E

=SE(D2>24,9; “Acima do Peso”;”Peso normal”)

Leia o caso a seguir.


Em uma empresa de desenvolvimento de software, o time de engenharia precisa escolher um banco de dados para um novo sistema de análise de vendas. O sistema deve ser capaz de processar um grande volume de transações diárias e fornece relatórios analíticos em tempo real.


Elaborado pelo(a) autor(a).


O banco de dados que atenderia a necessidade de eficiência de consumo e de consultas, além de escalabilidade nesse caso é o


A

banco de dados relacional tradicional.


B

banco de dados NoSQL.


C

sistema de arquivos simples.


D

banco de dados em memória.

Assinale a alternativa que apresenta como a estatística é aplicada no contexto da inteligência artificial e quais são os desafios enfrentados na Era do Big Data.


A

A estatística, combinada com machine learning e deep learning, ajuda a enfrentar desafios e oportunidades da Era Big Data, como a Indústria 4.0 e a Internet das Coisas (IoT)


B

A estatística é utilizada apenas para a coleta de dados em inteligência artificial, sem relação com machine learning


C

Na Era Big Data, a estatística é aplicada unicamente na análise de dados, sem uso em deep learning


D

A estatística e a inteligência artificial são independentes e não se complementam na resolução de problemas complexos

 
 
Gerar simulado