Questões de Concurso Sobre estatística
Foram encontradas 14.377 questões
É correto afirmar que essa característica implica que a amostra é
O gráfico de equidade abaixo apresenta, para cada ano do Ensino Fundamental, a distribuição da proficiência ponderada em Língua Portuguesa na última ADR do município, edição 2025.3. Em cada boxplot, o traço dentro da caixa representa a mediana, e os símbolos na legenda indicam o padrão de desempenho: Defasagem, Intermediário e Adequado.
Distribuição da Proficiência em Língua Portuguesa por ano escolar (1º ao 9º EF) e Nível de Aprendizagem

Disponível em: https://sites.google.com/educacao.fortaleza.ce.gov.br/painelsme/. Acesso em: 30 dez. 2025.
Descrição do gráfico: O gráfico intitulado “Distribuição da Proficiência em Língua Portuguesa por ano escolar (1º ao 9º EF) e Nível de Aprendizagem” compara a distribuição da proficiência do 1º ao 9º ano do EF usando boxplots (caixas com mediana) e pontos individuais. A classificação dos pontos é por forma: ✕ Defasagem, ○ Intermediário e ▲ Adequado (legenda no topo). Em geral, do 1º ao 4º ano há medianas mais altas e vários ▲ acima de 7– 8 (com destaque para o 4º ano). O 5º ano cai um pouco. Os menores níveis aparecem no 6º e no 8º ano (medianas perto de 4 – 4,5), e, no 8º, há um ✕ próximo de 3. O 7º fica intermediário e o 9º volta a subir com mais pontos ▲ acima de 7.
Considerando apenas a mediana de cada boxplot, em qual ano o município apresenta o maior nível central de proficiência?
Em um ensaio clínico randomizado, um novo medicamento foi comparado ao tratamento padrão para reduzir a ocorrência de um desfecho clínico relevante em pacientes oncológicos. O risco relativo estimado para o desfecho foi de 0,82, com intervalo de confiança de 95% variando de 0,65 a 1,04. O farmacêutico clínico integra a comissão de avaliação de tecnologias do hospital e utiliza princípios da epidemiologia clínica para subsidiar a decisão sobre incorporação da intervenção.
A interpretação desses resultados, considerando o papel do intervalo de confiança na avaliação da incerteza, deve reconhecer que
Fontes: GLOBO ESPORTE — Campeonato Paraibano 2025: confira as estatísticas do estadual. João Pessoa: GE/PB, 16 jan. 2025. Disponível em: https://ge.globo.com/pb/futebol/campeonato-paraibano/noticia/2025/01/16/campeonato-paraibano-2025-confira-as-estatisticas-do-estadual.ghtml . Acesso em: 2 nov. 2025. WIKIPÉDIA. Campeonato Paraibano de Futebol de 2025. Disponível em: https://pt.wikipedia.org/wiki/Campeonato_Paraibano_de_Futebol_de_2025 . Acesso em: 2 nov. 2025.
Figura 2 - Gols marcados por cada time ao longo da competição.
Fonte: Adaptado (GE/PB, 2025)
Com base nesses dados, é CORRETO afirmar que a média aritmética da moda, mediana e média aritmética dos gols marcados pelas equipes vale aproximadamente:
Um médico de família analisa o tempo de espera (em minutos) para atendimento de urgência em duas Unidades Básicas de Saúde (UBS) do seu distrito. Para comparar a eficiência dos fluxos e identificar variações atípicas no serviço, foi construído o diagrama de caixa (boxplot) a seguir.
No diagrama referente à UBS 1, o ponto posicionado no valor de 95 minutos identifica a ocorrência de um
Em uma investigação sobre os gastos mensais com medicamentos em famílias de uma comunidade vulnerável, o pesquisador nota que a maioria gasta valores baixos, mas poucas famílias com condições raras apresentam custos extremamente elevados, o que desloca a média aritmética para valores que divergem da mediana.
Para descrever a variabilidade da massa central da distribuição, 50% centrais dos dados, evitando a influência direta desses valores atípicos na medida de dispersão, deve-se utilizar
2.800; 3.600; 4.200; 4.400; 5.600; 6.300; 8.100.
Com base nessas informações, assinalar a alternativa CORRETA.
Com base nas boas práticas de avaliação de modelos de aprendizado de máquina, inclusive em cenários com classes desbalanceadas, analise as afirmativas a seguir, considerando (V) para a(s) afirmativa(s) verdadeira(s) e (F) para a(s) falsa(s).
( ) Na validação cruzada k-fold estratificada, cada partição de treino e teste preserva aproximadamente a mesma proporção de classes do conjunto original, o que contribui para estimativas de desempenho mais estáveis em problemas com desbalanceamento de classes.
( ) Curvas ROC e a métrica AUC-ROC são tipicamente mais informativas do que curvas precision-recall em cenários com classes fortemente desbalanceadas, justamente porque destacam com maior sensibilidade o comportamento do classificador em relação à classe minoritária.
( ) A métrica F1-score corresponde ao dobro do produto entre precisão (precision) e sensibilidade (recall) dividido pela soma de ambos, de modo que valores muito discrepantes entre precisão e recall tendem a produzir um F1-score relativamente baixo.
( ) Ao diminuir o limiar de decisão de um classificador binário (por exemplo, de 0,7 para 0,3), a precisão tende a aumentar, pois mais exemplos positivos são corretamente identificados como tal, ainda que isso geralmente ocorra às custas de uma redução no recall.
A sequência correta é:
Considere o conjunto populacional: 2, 4, 8, 10. Em seguida, assinale a alternativa que contém CORRETAMENTE o valor da variância do conjunto.
O conjunto está fortemente desbalanceado: apenas 3% dos registros pertencem à classe denominada inadimplente. O time deseja aumentar a quantidade de exemplos da classe minoritária sem simplesmente duplicar registros existentes, gerando novas amostras sintéticas entre os pontos reais da classe positiva, para reduzir o risco de overfitting associado ao oversampling ingênuo.
A técnica de balanceamento de classes adequada para esse cenário é:
A avaliação dessa metodologia de validação é:
Um tribunal deseja prever o tempo de tramitação (em dias) de processos de uma determinada classe, desde a distribuição até a sentença em 1ª instância. Um cientista de dados ajustou um modelo de regressão usando variáveis como tipo de ação, vara, quantidade de partes e histórico de movimentações, e avaliou o modelo no conjunto de teste.
Como métrica principal, ele calculou a soma das diferenças absolutas dividida pelo número de observações, ou:

obtendo Erro = 18, que foi interpretado como: “em média, o modelo erra em 18 dias o tempo de tramitação dos processos”. A métrica utilizada pelo cientista de dados é:
Assinale a alternativa INCORRETА.
Tabela 2. Análise de variância do experimento sem a informação dos Graus de Liberdade, utilizando um esquema fatorial 3x 5.