Foram encontradas 2.544 questões

Resolva questões gratuitamente!

Junte-se a mais de 4 milhões de concurseiros!

Q4218187 Engenharia de Software
No contexto da IA Generativa, assinale a opção que melhor explica o conceito de embedding
Alternativas
Q4218186 Noções de Informática
Felipe estava construindo um chatbot com IA Generativa e LLM. Visando melhorar as respostas fornecidas pelo chatbot, decidiu empregar a Geração Aumentada de Recuperação (Retrieval Augmented Generation - RAG).

Assinale a opção que melhor explica a escolha de Felipe pelo emprego da técnica RAG. 
Alternativas
Q4218185 Estatística
O cerne da obra de Mark Monmonier, “Como mentir com mapas”, decorre de escolhas cartográficas, seja por omissão, simplificação ou classificação, necessárias para representar fenômenos complexos, mas que podem influenciar a interpretação do mapa. No caso dos mapas temáticos, isso inclui a classificação de valores numéricos ao longo de um intervalo contínuo.

Assinale a opção que indica o critério de classificação que divide as feições em classes que possuem a mesma frequência de registros.
Alternativas
Q4218184 Sistemas de Informação
No processamento de dados utilizando Python, a biblioteca geopandas estende as capacidades da pandas. Embora ambas compartilhem as estruturas de dados similares, certas operações são exclusivas da análise espacial por exigirem operações geométricas ou topológicas sobre objetos espaciais, normalmente suportadas por um motor de geometria.
A operação que descreve a tarefa que exige o uso de capacidades da biblioteca geopandas, indisponíveis na pandas, mesmo que os dados de coordenadas estejam presentes como colunas numéricas no DataFrame, é a operação de 
Alternativas
Q4218183 Matemática
A Decomposição em Valores Singulares (SVD) é uma ferramenta largamente usada em análise de dados, apresentando uma rica interpretação geométrica e espectral dos dados dispostos de forma matricial.
A decomposição SVD consiste em fatorar qualquer matriz A, de dimensões m×n, no produto U∑VT , de forma que 
Alternativas
Q4218182 Engenharia de Software
O treinamento de redes neurais profundas envolve o ajuste iterativo dos pesos, com base no erro observado entre a saída prevista e a saída esperada.
Esse processo é viabilizado pelo algoritmo de retropropagação, em conjunto com métodos de otimização que usam gradientes para minimizar a função de perda.
No contexto do treinamento de redes neurais, assinale a opção que indica o principal mecanismo da retropropagação. 
Alternativas
Q4218181 Engenharia de Software
Sobre o treinamento de redes neurais profundas, assinale a opção que indica a principal finalidade da técnica conhecida como dropout.
Alternativas
Q4218180 Estatística
No contexto de mineração de dados, um analista utilizou as técnicas de regras de associação (como o algoritmo Apriori) para identificar padrões de concorrência entre ilícitos em processos administrativos.
Ao analisar a regra de associação {Desvio de Verba} → {Falsidade Ideológica}, foram obtidos os seguintes valores:

• Confiança = 0,80;
Lift = 2,0.

Assinale a opção que apresenta a interpretação tecnicamente correta para o valor do Lift obtido. 
Alternativas
Q4218179 Estatística
Um cientista de dados está desenvolvendo um modelo de segmentação para classificar procedimentos com base em características quantitativas.
Para garantir a comparabilidade entre variáveis, ele aplicou a padronização por escore z (z-score) em um conjunto de dados multivariados, de modo que todas as variáveis passassem a apresentar média 0 e desvio-padrão 1.
Após a padronização, verificou-se que os dados não apresentavam forte separação entre grupos naturais. Em seguida, foi aplicado o algoritmo K-means em Python:

from sklearn.preprocessing import StandardScaler
from sklearn.cluster import KMeans

scaler = StandardScaler()
X_scaled = scaler.fit_transform(X)

kmeans = KMeans(n_clusters=3, n_init=10, random_state=0)
kmeans.fit(X_scaled)

print(kmeans.cluster_centers_)

Observou-se que os centroides obtidos apresentam valores próximos de zero em todas as dimensões.
Considerando o contexto descrito, esse resultado ocorre porque 
Alternativas
Q4218172 Estatística
No âmbito de uma investigação sobre eficiência administrativa, um analista de dados modelou a relação entre o tempo de tramitação de procedimentos (Y, em dias) e o número de apensos (X) utilizando uma técnica de Regressão Linear, cujo modelo se apresenta na forma 

Imagem associada para resolução da questão

O relatório de sumarização do modelo apresentou os seguintes parâmetros:

• Coeficiente de Intercepto: 15;
• Coeficiente Angular: 5.

Com base estritamente nos estimadores fornecidos, e assumindo que o valor de X = 8 pertence ao domínio de validade do modelo, a estimativa pontual para o valor esperado do tempo de tramitação dos procedimentos investigatórios é de 
Alternativas
Q4218171 Estatística
Para estimar um parâmetro associado a uma variável aleatória, foi adotado o seguinte procedimento:

1. Inicialmente, foi definida uma distribuição de probabilidade para o parâmetro de interesse com base em conhecimento prévio, sem considerar os dados da amostra.
2. Em seguida, foram coletadas observações da variável aleatória e especificado um modelo estatístico que descreve como esses dados se relacionam com o parâmetro de interesse.
3. Depois disso, a distribuição inicialmente atribuída ao parâmetro foi revista à luz das informações fornecidas pela amostra observada.
4. Por fim, a partir da distribuição obtida após essa revisão, foram calculadas estimativas da média e da variância do parâmetro de interesse.

O procedimento descrito corresponde ao(à) 
Alternativas
Q4218170 Estatística
Uma doença afeta uma certa porcentagem desconhecida de uma população local. Um teste rápido possui probabilidade de 90% de dar positivo, caso o paciente esteja doente (verdadeiro positivo), e 30% de dar positivo, caso o paciente esteja saudável (falso positivo).
Com base em uma amostra aleatória de tamanho relevante da população foi constatado que a probabilidade de um paciente que apresentou teste rápido positivo estar realmente doente é de 50%.

A porcentagem da população local afetada pela doença é de 
Alternativas
Q4218169 Estatística

Analise a tabela a seguir. 



Imagem associada para resolução da questão



Seja v uma amostra de uma variável aleatória gaussiana de média 0 e variância 1. A tabela mostra a probabilidade de v ser menor que alguns valores x entre 0,0 e 1,9.


Uma segunda variável aleatória w também é uma distribuição gaussiana, porém de média 1 e variância 4.


A probabilidade da soma de 16 amostras independentes de w ser maior que 24 é 

Alternativas
Q4218168 Programação
Um cientista de dados foi incumbido de analisar o desempenho de estudantes em um exame nacional, com o objetivo de investigar possíveis desigualdades educacionais. Para isso, pretende comparar as distribuições de notas considerando simultaneamente o nível socioeconômico (baixo, médio e alto) e a região geográfica (Norte, Nordeste, Sul, Sudeste e Centro-Oeste).
Sabe-se que a análise deve preservar a comparabilidade entre os grupos, permitindo identificar padrões estruturais de forma clara e consistente entre os subconjuntos de dados.

Considerando o uso da biblioteca ggplot2 na linguagem R, assinale a opção que apresenta a abordagem mais adequada para atender ao objetivo proposto.
Alternativas
Q4218167 Banco de Dados
Um analista de dados do Ministério Público do Estado do Espírito Santo está desenvolvendo um dashboard no Metabase para acompanhar a evolução mensal de demandas administrativas protocoladas, com possibilidade de análise por região de atuação (comarcas).
Para isso, foi criada uma pergunta usando SQL nativo, conforme a consulta a seguir. 

Imagem associada para resolução da questão

No painel, o analista deseja incluir um filtro de dashboard interativo de região, usando os recursos da interface (UI) do Metabase, de modo que esse filtro afete apenas esse gráfico específico, sem impactar os demais cartões do painel.
Com base no caso apresentado, considerando o funcionamento dos filtros em dashboards no Metabase, assinale a opção que apresenta a medida tecnicamente correta. 
Alternativas
Q4218165 Programação
No desenvolvimento de painéis interativos com o framework Shiny (linguagem R), a gestão eficiente do grafo de reatividade é fundamental para o desempenho da aplicação. Um profissional deve selecionar a função reativa adequada para cada necessidade de processamento no server.
Considere as seguintes funções e as definições a seguir:

1. reactive()
2. observe()
3. eventReactive()

( ) Cria uma expressão reativa que encapsula um cálculo, evitando recomputações desnecessárias e retornando um valor que pode ser utilizado por outras expressões reativas ou saídas (outputs).
( ) Cria um observador destinado a executar ações com efeitos colaterais (side effects), como gravação em banco de dados ou envio de notificações, não retornando valor reutilizável.
( ) Cria uma expressão reativa cujo valor é atualizado apenas quando ocorre um evento explícito (por exemplo, o clique de um botão), evitando atualizações desnecessárias causadas por outras entradas.

Assinale a opção que indica a relação correta, segundo a ordem apresentada. 
Alternativas
Q4218162 Banco de Dados
Sobre Data Warehouse, analise as afirmativas a seguir e assinale (V) para a verdadeira e (F) para a falsa.

( ) Data Warehouse é um tipo de banco de dados projetado para otimizar operações transacionais como inserção e atualização dos dados.
( ) Data Warehouse apresenta como característica ser variante no tempo, pois é projetado para o armazenamento de informações históricas.
( ) O modelo dimensional estrela tem a normalização como característica principal, garantindo uma maior consistência de dados.

As afirmativas são, respectivamente, 
Alternativas
Q4218161 Banco de Dados
Para subsidiar o suporte à decisão e à produção de inteligência institucional, um determinado tribunal implementou uma solução de integração de dados fundamentada no processo Extract, Transform, Load (ETL).

Sobre o ETL, assinale a afirmativa correta. 
Alternativas
Q4218160 Banco de Dados
No que se refere às funcionalidades e às características fundamentais da tecnologia OLAP (Online Analytical Processing), analise as afirmativas a seguir.

I. O modelo OLAP se concentra em dados individuais e transacionais, permitindo que transações cotidianas e comerciais do tipo CRUD sejam realizadas em tempo real.
II. O modelo OLAP permite aos usuários navegar em diferentes níveis de agregação.
III. Drill-down é uma operação OLAP que envolve a diminuição do detalhamento.

Está correto o que se afirma em 
Alternativas
Q4218158 Banco de Dados
Em cenários onde o volume de dados pode comprometer o desempenho das consultas, o comando EXPLAIN PLAN (ou similar, dependendo do SGBD) é um recurso valioso para nortear as decisões de um administrador ou desenvolvedor de banco de dados.

Assinale a opção que apresenta a situação em que o uso do plano de execução é mais indicado para resolver um problema de performance. 
Alternativas
Respostas
941: B
942: B
943: A
944: B
945: C
946: D
947: B
948: C
949: B
950: C
951: B
952: B
953: E
954: B
955: A
956: A
957: D
958: D
959: A
960: A