Questões de Concurso sobre Estatística Descritiva

 
 
Disciplina
Assunto 1
Banca
Instituição
Cargo
Ano
Carreira
Área de formação
Escolaridade
Dificuldade
 
Comentários:
Professores
Alunos
Meus Comentários
Vídeo
 
Minhas questões:
Resolvidas
Não resolvidas
Certas
Erradas
 
Tipo de questão:
Certo e errado
Múltipla escolha
Incluir questões:
Anuladas
Desatualizadas
 
Questões:
Todas as questões
 
Filtro simplificado
 
Questões
Todas as questões
 
161 questões encontradas
Questões por página
20
Mais recentes
 

A ciência de dados usa as análises descritiva, a diagnóstica, a preditiva e a prescritiva para estudar dados. Uma companhia aérea contratou um estudo dos dados para melhorar sua performance no mercado. Associe a metodologia de estudo ao exemplo dado.


1. Análise Descritiva

2. Análise Diagnóstica

3. Análise Preditiva


( ) O serviço de reserva de voos da companhia pode registrar dados como o número de bilhetes reservados a cada dia. A análise revelará picos de reservas, quedas nas reservas e meses de alta performance para este serviço.

( ) O serviço de voo da companhia pode fazer drill-down em um mês particularmente de alta performance para entender melhor o pico de reserva.

( ) A equipe de serviço de voo da companhia pode usar a ciência de dados para prever, no início de cada ano, padrões de reserva de voo para o próximo ano.


Assinale a opção que apresenta a sequência correta, na ordem apresentada.


A

2 – 3 – 1.


B

1 – 2 – 3.


C

3 – 1 – 2.


D

3 – 2 – 1.


E

2 – 1 – 3.

No que se refere a estatística descritiva, analise e julgue as alternativas.


I. Responsável pela coleta, organização, descrição e resumo dos dados observados.

II. A partir de um determinado conjunto de dados, a Estatística Descritiva busca organizá-los em tabelas (ou gráficos) e estabelecer um sumário por meio de medidas descritivas como a média, os valores mínimo e máximo, o desvio padrão, entre outras.

III. A estatística se divide em três grandes ramos: estatística descritiva (também chamada de indutiva), estatística probabilística, estatística inferencial (também chamada de dedutiva).


A

Somente as afirmativas I e II estão corretas.


B

Somente as afirmativas II e III estão corretas.


C

Somente as afirmativas I e III estão corretas.


D

Todas as afirmativas estão corretas.


E

Nenhuma afirmativa está correta

Em pesquisas como o Censo do IBGE, as unidades espaciais de coleta de dados (no caso do Censo, os setores censitários) são delimitadas segundo uma lógica operacional, e não ambiental ou de planejamento urbano. Por conta dessa lógica operacional, muitas vezes, essas unidades espaciais se modificam a cada pesquisa realizada. Por isso, frequentemente, não é possível, por exemplo, a comparação das unidades de área censitárias entre censos de diferentes anos, ou, em uma outra escala, uma sobreposição adequada dos dados de municípios e distritos com os de bacias hidrográficas. Configura-se assim o chamado Problema de Unidade de Área Modificável / Modifiable Areal Unit Problem (MAUP).


Para viabilizar a comparação entre períodos diversos e a compatibilização entre diferentes recortes espaciais, minimizando distorções causadas pela variação, no tempo e entre fontes de dados, do tamanho do recorte espacial, têm sido utilizadas, em Sistemas de Informações Georreferenciadas, soluções de


A

desagregação dos setores em porções coincidentes e não coincidentes, trabalhando-se, nestas últimas, com uma nova tabulação dos questionários individuais originais do Censo ou de outros levantamentos de origem dos dados utilizados.


B

mapeamento dos dados por meio de grades matriciais de células de dimensões fixas, às quais são associados os valores, em cada célula, de um certo indicador – como as “grades estatísticas” do IBGE.


C

recálculo de valores dos indicadores, empregando-se um sistema de médias baseado na associação entre os dados e os centroides dos polígonos aos quais estão associados, o que possibilita recuperar a comparabilidade entre dados de diferentes datas e fontes.


D

a individualização de dados do Censo em nível de domicílio, permitindo seu georreferenciamento e sua reagregação nas bases territoriais requeridas para a análise.


E

a vetorização dos dados georreferenciados, mediante o emprego de aprendizado de máquina e outros recursos de Inteligência Artificial.

Considere a seguinte distribuição de dados:


67 34 76 14 24 18 28 42 71


A soma dos três quartis dessa distribuição é igual a


A

186


B

125


C

124


D

114


E

102

Considere que as despesas orçamentárias de certo órgão sejam classificadas em três tipos: salários, manutenção e investimentos. Considere ainda que, ao se organizar os dados sobre a distribuição dessas despesas, tenham sido encontrados os seguintes valores percentuais: 60% referentes a salários e 30%, à manutenção. Nessa situação, o percentual referente a investimentos será igual ou superior a 15%.


C

Certo


E

Errado

Considere uma comunidade na qual o coeficiente de variação populacional (CV) da renda de seus indivíduos é de 20%.


Um conjunto de políticas públicas que elevasse a renda de todos esses indivíduos em 10% provocaria, no CV,


A

uma redução, passando a ser de 10%


B

uma redução, passando a ser de 18%


C

um aumento, passando a ser de 22%


D

um aumento, passando a ser de 30%


E

nem redução, nem aumento

Se os dados de frequência relativa dos acidentes de trabalho em 10 meses de determinado ano forem iguais a 2, 5, 6, 7, 8, 3, 9, 1, 0 e 9, respectivamente, então a soma será igual a 50, a média, igual a 5, a moda, igual a 9, e a mediana, igual a 5,5.


C

Certo


E

Errado

Assinale a alternativa que apresenta uma medida mais robusta à presença de valores extremos em um conjunto de dados.


A

Média.


B

Mediana.


C

Moda.


D

Variância.

Qual é a medida estatística que indica a dispersão dos dados em relação à média?


A

Média.


B

Moda.


C

Mediana.


D

Desvio padrão.


E

Coeficiente de correlação.

Uma população de tamanho N = 1.000 possui três estratos – X, Y e Z, cujos tamanhos e desvios-padrão de acordo com determinada variável de interesse são dados na tabela a seguir:



Estrato

X

Y

Z

Tamanho

600

300

100

Desvio-padrão

1

5

4



Deseja-se obter uma amostra aleatória estratificada de tamanho n = 15 dessa população. De acordo com o critério de alocação ótima de Neyman, qual o tamanho da amostra do estrato Y?


A

3


B

5


C

7


D

9

Suponha que determinada unidade da federação (UF) tenha 9 milhões de habitantes e seja dividida em 5 regiões (A, B, C D e E), conforme a tabela que se segue.

Região

População (x 10 mil habitantes)

A

270

B

225

C

180

D

135

E

90

Para a avaliação do desempenho da equipe de dada secretaria dessa UF, foi contratada uma consultoria especializada que adotou a técnica de amostragem estratificada proporcional e definiu uma amostra com 2500 pessoas.


Com base nessas informações e uma vez que a amostra já foi selecionada, assinale a alternativa correta.


A

Os habitantes da região E escolhidos para a composição da amostra correspondem a 10% da população dessa UF.


B

As regiões A e B conjuntamente são mais povoadas que as demais regiões agrupadas e apresentam maior densidade demográfica.


C

A amostra escolhida apresentou mais de 600 habitantes da região B.


D

A amostra coletada foi composta com uma quantidade de pessoas da região C inferior a 500.


E

Os habitantes da região D equivalem 13,5% da população dessa UF.

O técnico agropecuário da Escola de Zootecnia de uma universidade acompanhou a produção média de leite de 12 vacas Girolando, durante 20 dias, conforme apresentado na Tabela 1.

Tabela 1. Produção média de leite (litros) durante 20 dias do mês de novembro

Dias

1

2

3

4

5

6

7

8

9

10

Produção

24,0

25,5

25,5

25,0

24,0

30,0

28,0

24,0

25,0

25,5

Dias

11

12

13

14

15

16

17

18

19

20

Produção

24,0

24,5

25,5

30,0

24,0

24,0

28,0

24,0

25,0

27,0

Por meio da Tabela 1 é correto afirmar que a mediana e a moda da produção são, respectivamente,


A

25,5 e 25,5.


B

25,0 e 24,5.


C

24,0 e 25,5.


D

24,5 e 24,0.


E

26,7 e 25,0.

Referente aos elementos da estatística, relacione a Coluna 1 à Coluna 2.

Coluna 1

1. Desvio-médio.

2. Variância.

3. Distribuição Poisson.

4. Variável aleatória discreta.

5. Probabilidade.

Coluna 2

( ) É aquela que assume valores em um conjunto enumerável, não podendo assumir, portanto, valores decimais ou não inteiros.

( ) É dada pela razão entre o número de casos favoráveis ao evento e o número total de possíveis casos.

( ) É a diferença entre cada valor observado e a média da variável.

( ) Medida de dispersão que avalia o quanto os dados estão dispersos em relação à média aritmética.

( ) É utilizada para registrar a ocorrência de eventos raros, com probabilidade de sucesso muito pequena, em determinada exposição, por exemplo, em determinado intervalo de tempo ou espaço.

A ordem correta de preenchimento dos parênteses, de cima para baixo, é:


A

1 – 2 – 3 – 4 – 5.


B

2 – 3 – 4 – 5 – 1.


C

3 – 4 – 5 – 1 – 2.


D

4 – 5 – 1 – 2 – 3.


E

5 – 1 – 2 – 3 – 4.

Durante um processo licitatório, três empresas apresentaram diferentes valores para concorrer ao objeto previsto: i) R$ 240.500,00; ii) R$ 255.600,00; iii) R$ 277.900,00. Foi solicitado que se apresentasse dois parâmetros estatísticos considerando os três valores apresentados: a média aritmética e a mediana. Assinale a alternativa que apresenta tais parâmetros, respectivamente.


A

R$ 258.000,00; R$ 258.000,00.


B

R$ 255.600,00; R$ 258.000,00


C

R$ R$ 255.600,00; R$ 255.600,00;


D

R$ 258.000,00 R$ 255.600,00;

Assinale a alternativa correta quanto à estatística descritiva.


A

Uma amostra é uma característica associada a elementos de uma população. Por exemplo, em um restaurante, uma variável pode ser a temperatura em que um vinho deve ser servido ou o tipo de prato presente no cardápio.


B

A análise de correlação permite estudar a relação entre dois conjuntos de valores, no qual quantifica-se o quanto um conjunto de valores (ou uma variável) está relacionado com outro, determinando a intensidade e a direção dessa relação. A correlação indica se, e com que intensidade, os valores de uma variável aumentam (ou diminuem) enquanto os valores da outra variável aumentam (ou diminuem).


C

O diagrama de caixa (boxplot) é uma representação gráfica da distribuição de frequência, que é construído alocando as faixas no eixo horizontal, e as frequências no eixo vertical.


D

O desvio-padrão é uma medida de dispersão definida como a média dos quadrados da diferença entre cada valor do conjunto e a média desse conjunto.


E

O histograma apresenta cinco números obtidos a partir da combinação dos quartis com os valores mínimo e máximo de um conjunto de valores: os dois pontos finais da caixa são representados por linhas pontilhadas, a mediana é representada por uma linha no centro, os outliers são traços no final das linhas transversais e as duas linhas transversais fora da caixa são as chamadas barreiras.

Se você adicionar um valor extremamente grande a um conjunto de dados, a média aumentará significativamente.


C

Certo


E

Errado

De acordo com o relatório World Population Prospects 2022, a expectativa de vida global ao nascer atingiu 72,8 anos em 2019, uma melhoria de quase 9 anos desde 1990. De acordo com projeções atuais, é esperado que a expectativa de vida alcance uma média global de 77,2 anos em 2050. Sendo assim, a diferença entre a média esperada de 2050 e a de 2019 é de:


A

5,6 anos.


B

5,2 anos.


C

4,4 anos.


D

4,2 anos.

Uma distribuição de dados pode ser classificada como simétrica ou assimétrica e isso pode contribuir em uma análise mais aprofundada no comportamento dos dados analisados no estudo estatístico específico. Nesta ordem, considere avaliar quedas no sistema de informática (servidor fora do ar) como variável x em viés com o número de usuários conectados no servidor, através da rede de computadores em um determinado período de tempo. Tal levantamento objetiva compreender o comportamento das quedas do servidor e tomar as medidas tecnológicas corretivas. Dessa forma, resolveu-se aplicar o coeficiente de Pearson sobre os dados:


Número de quedas no servidor da Secretaria

Quantidade de IP´s conectados

1

2

2

10

3

6

4

4

5

2

6

1


Podemos afirmar que a distribuição indica


A

uma assimetria positiva fraca.


B

uma assimetria negativa forte.


C

ausência de assimetria estatística.


D

uma assimetria positiva moderada.


E

uma assimetria negativa moderada.

   
Gerar simulado