Questões de Concurso Sobre estatística
Foram encontradas 14.344 questões
8,0 – 7,5 – 9,0 – 8,0 – 6,5 – 9,0
As medidas de tendência central constituem importantes ferramentas estatísticas para resumir e interpretar conjuntos de dados, sendo frequentemente utilizadas em pesquisas, avaliações e relatórios administrativos.
Considerando exclusivamente os dados apresentados, assinale a alternativa CORRETA.
No âmbito da análise de produtos entregues por consultorias contratadas pela INFRA S.A. para a caracterização de solos ferroviários, o fiscal deve validar a redução de dimensionalidade de dados multivariados. Acerca de métodos estatísticos e suas análises nesse contexto, julgue o item a seguir.
Caso a consultoria apresente PCA em que os dois primeiros componentes explicam 85% da variância total, o fiscal poderá atestar a conformidade técnica com o critério de Kaiser, mesmo que o autovalor do segundo componente seja inferior a 1,0, uma vez que a variância acumulada é o parâmetro soberano nesse método.
No âmbito da análise de produtos entregues por consultorias contratadas pela INFRA S.A. para a caracterização de solos ferroviários, o fiscal deve validar a redução de dimensionalidade de dados multivariados. Acerca de métodos estatísticos e suas análises nesse contexto, julgue o item a seguir.
No âmbito de um teste de hipóteses para monitoramento do impacto de um poluente, o erro do tipo I (a) ocorre quando o pesquisador rejeita a hipótese nula (H0) de que não há impacto quando, na verdade, o impacto não existe.
Diante do exposto, assinale a alternativa correta.
11,7 – 13,9 – 12,5 — 14,2 – 15,1
Com base nesses dados, qual é a média simples da concentração de partículas nas amostras? Assinale a alternativa correta.
Uma caixa contém 4 bolas vermelhas, 3 azuis e 5 verdes, todas indistinguíveis ao tato. Duas bolas são retiradas sucessivamente, sem reposição. Analise as assertivas e classifique como verdadeira (V) ou falsa (F):
(__)A probabilidade de ambas serem vermelhas é 1/11.
(__)A probabilidade de ambas serem azuis é 1/22.
(__)A probabilidade de ambas serem verdes é 15/32.
(__)A probabilidade de as duas bolas terem cores diferentes é menor que 1/2.
A sequência CORRETA, de cima para baixo, é:
Em relação aos componentes estruturais de uma série temporal, julgue os itens a seguir:
I. Picos e vales regulares a cada 12 meses indicam a presença de um componente sazonal.
II. O aumento gradual no volume de vendas ao longo dos anos caracteriza um componente de tendência.
III. Ciclos econômicos possuem período fixo e regular, como exatamente 12 meses.
IV. O componente irregular (ruído) é o principal responsável pelos picos e vales regulares observados.
V. Uma série que apresenta tendência e sazonalidade pode ser modelada por métodos como SARIMA.
Assinale a alternativa com a sequência CORRETA (V/F):
Em relação às diferenças conceituais e aplicações da Análise de Componentes Principais (PCA) e da Análise Fatorial (AF), julgue os itens a seguir:
I. A PCA busca combinações lineares (componentes principais) que retêm a máxima variância total dos dados observados, sem postular um modelo de erros ou fatores latentes; já a Análise Fatorial assume que as variáveis observadas são funções lineares de fatores latentes comuns acrescidos de erros únicos (especificidades).
II. Na PCA, os componentes são ortogonais e ordenados por variância explicada; na Análise Fatorial, os fatores podem ser rotacionados (ex.: varimax) para facilitar a interpretação, e a comunalidade representa a proporção da variância de cada variável explicada pelos fatores comuns.
III. Uma diferença prática importante é que a PCA é frequentemente usada para redução de dimensionalidade quando o interesse é reter a maior parte da informação, enquanto a Análise Fatorial é mais adequada para identificar estruturas latentes subjacentes (ex.: traços de personalidade, construtos socioeconômicos).
IV. A PCA é invariante a rotações ortogonais dos componentes, ou seja, qualquer rotação dos eixos principais produz a mesma solução; já na Análise Fatorial, a rotação é essencial para tornar os fatores interpretáveis, e diferentes métodos de rotação podem levar a diferentes soluções fatoriais.
V. A PCA pressupõe que os dados seguem uma distribuição normal multivariada e que não há outliers, caso contrário os resultados são sempre inválidos; a Análise Fatorial, por outro lado, é robusta a qualquer tipo de distribuição e não requer normalidade.
Assinale a alternativa com a sequência CORRETA (V/F):
Em relação à técnica de Bootstrap e suas aplicações em inferência estatística, julgue os itens a seguir:
I. A principal vantagem do Bootstrap é permitir estimar a distribuição amostral de uma estatística (ex.: média, mediana, coeficiente de correlação) sem assumir uma distribuição populacional específica, utilizando reamostragem com reposição a partir dos dados observados.
II. O Bootstrap reduz a necessidade de grandes amostras: com amostras muito pequenas (ex.: n = 5), o Bootstrap produz estimativas consistentes e não viesadas, mesmo quando a distribuição original é assimétrica.
III. O Bootstrap paramétrico assume uma forma paramétrica para a distribuição populacional (ex.: Normal) e reamostra a partir da distribuição estimada, enquanto o Bootstrap não paramétrico reamostra diretamente dos dados empíricos.
IV. O Bootstrap é computacionalmente mais eficiente que os métodos analíticos (ex.: fórmulas para erro padrão), pois requer apenas alguns segundos mesmo com milhões de reamostras, enquanto fórmulas analíticas exigem cálculos complexos e lentos.
V. O Bootstrap pode ser usado para construir intervalos de confiança (ex.: percentil, BCa), estimar viés de estimadores e calcular erros padrão, sendo especialmente útil quando a estatística de interesse não tem uma expressão analítica simples para sua variância.
Assinale a alternativa com a sequência CORRETA (V/F):
Um analista de dados de um órgão público tem acesso a uma base com informações de beneficiários de programas sociais, contendo: CPF, nome completo, renda familiar, endereço, diagnóstico de saúde (opcional) e data de nascimento. Ele deseja publicar um estudo agregado por município, mantendo o sigilo dos indivíduos. Em relação à Lei Geral de Proteção de Dados (LGPD) e às boas práticas éticas em estatística pública, julgue os itens a seguir:
I. O CPF e o nome completo são considerados dados pessoais sensíveis pela LGPD, exigindo consentimento explícito do titular mesmo para uso em políticas públicas.
II. A anonimização, segundo a LGPD, é o processo de tornar os dados não associáveis a uma pessoa identificada ou identificável, usando técnicas como generalização, supressão ou ruído. Dados verdadeiramente anonimizados não são mais considerados dados pessoais.
III. O diagnóstico de saúde (ex.: HIV, câncer) é classificado como dado pessoal sensível pela LGPD (art. 5º, II), e seu tratamento requer fundamento legal específico, como a execução de políticas públicas pela administração pública (art. 7º, III).
IV. Publicar uma tabela com a renda média por município, sem qualquer identificador individual, é suficiente para garantir anonimização, independentemente do número de observações por município, pois dados agregados não violam a LGPD.
V. Em um estudo ético, o analista deve aplicar o princípio da minimização: coletar e armazenar apenas os dados estritamente necessários para a finalidade da análise, descartando identificadores diretos quando não forem mais úteis.
Assinale a alternativa com a sequência CORRETA (V/F):
Uma universidade deseja comparar três métodos de ensino (A, B, C) quanto ao desempenho dos estudantes. Inicialmente, planeja-se um delineamento inteiramente casualizado (DIC): 90 alunos são sorteados aleatoriamente e igualmente distribuídos entre os três métodos (30 por método). Um professor sugere usar delineamento em blocos casualizados (DBC), considerando o turno de estudo (manhã, tarde, noite) como bloco, pois acredita que o turno influencia o desempenho. Na universidade, há 30 alunos por turno (total 90). Em cada turno, os 30 alunos são aleatoriamente atribuídos aos três métodos (10 por método por turno). Em relação à análise e interpretação desses delineamentos, julgue os itens a seguir:
I. No DIC, a aleatorização é irrestrita: os 90 alunos são sorteados para os métodos sem considerar turno. A ANOVA correspondente particiona a variabilidade total em SQTratamentos (métodos) e SQResíduo. Se houver diferença significativa entre os métodos, o pesquisador pode concluir que o efeito é causal, desde que a alocação tenha sido aleatória.
II. No DBC com blocos de turno, a soma de quadrados total é decomposta em SQBlocos (turno), SQTratamentos (métodos) e SQResíduo. O DBC é mais eficiente que o DIC se a variabilidade entre blocos for grande, pois reduz a SQResíduo e aumenta o poder do teste F para os métodos.
III. Suponha que, no DBC, a interação entre bloco e tratamento não seja modelada (modelo aditivo – sem interação). Se houver interação real (ex.: o método A é melhor no turno da manhã, mas pior no noturno), essa interação irá para o resíduo, inflacionando o erro experimental e podendo mascarar efeitos principais ou gerar conclusões enganosas.
IV. Os graus de liberdade do resíduo no DIC são 90 − 3 = 87. No DBC com 3 blocos e 3 tratamentos e 10 repetições por combinação bloco×tratamento, os graus de liberdade do resíduo são (3 − 1) × (3 − 1) × 10 = 2 × 2 × 10 = 40.
V. Se um pesquisador aplicasse o DIC e, após verificar diferença significativa entre os métodos, incluísse o turno como covariável na análise de covariância (ANCOVA), isso equivaleria a um DBC com ajuste linear, desde que o efeito do turno fosse modelado como contínuo (ex.: hora de início). Contudo, se o turno for categórico (manhã, tarde, noite), a abordagem correta é o DBC ou a inclusão de dummies no modelo.
Assinale a alternativa com a sequência CORRETA (V/F):