Questões de Concurso Público TJ-RJ 2026 para Analista Judiciário - Tecnologia da Informação - Engenheiro de Dados

Foram encontradas 7 questões

Q4181534 Banco de Dados
Considerando as demandas típicas de um tribunal por sistemas confiáveis e previsíveis, e à luz do teorema CAP, um banco de dados distribuído que prioriza consistência e tolerância a partições (CP), sacrificando temporariamente a disponibilidade durante partições de rede, é a escolha mais adequada para um:
Alternativas
Q4181535 Banco de Dados
Uma corporação multinacional do setor de varejo está unificando suas plataformas de dados. O cenário atual apresenta dois desafios distintos, indicados a seguir.

• Transacional e BI: o sistema de vendas gera registros financeiros que exigem consistência estrita (ACID). A equipe de analistas de negócios consome esses dados via painéis de BI que demandam baixa latência em consultas complexas com múltiplas junções (joins).
• Big Data e IA: o sistema de e-commerce gera petabytes de logs de navegação (clickstream) e dados de sensores IoT das lojas físicas (dados semiestruturados). A equipe de ciência de dados precisa acessar esses dados em seu formato bruto para treinar modelos preditivos, sem a perda de informações causada por agregações prematuras.

O arquiteto de dados precisa propor uma solução única que evite a duplicação de dados entre silos (um Data Warehouse para o BI e um Data Lake para a IA) e reduza o custo de armazenamento, mantendo a governança.

Considerando os requisitos apresentados e as características das arquiteturas modernas de dados, a abordagem arquitetural e de modelagem adequada é:
Alternativas
Q4181536 Banco de Dados
Um arquiteto de dados está projetando o Data Warehouse (DW) de uma grande rede de varejo. A tabela de fatos de vendas (Fato_Vendas) deverá ser conectada a uma dimensão de produtos. A hierarquia dos produtos é complexa e profunda:
Departamento → Divisão → Categoria → Subcategoria → Produto.

O administrador de banco de dados (DBA), preocupado com a integridade dos dados e o espaço de armazenamento, propôs que essa hierarquia fosse modelada seguindo os princípios da normalização. Segundo a proposta, a tabela de produtos conteria apenas o ID da subcategoria, que apontaria para uma tabela de subcategorias, que, por sua vez, apontaria para uma tabela de categorias, e assim sucessivamente, evitando a repetição de textos descritivos (como o nome do departamento) em milhões de linhas de produtos.

Considerando os conceitos de modelagem dimensional (Ralph Kimball) e o impacto dessa decisão na performance de consultas analíticas (OLAP), é correto afirmar que:
Alternativas
Q4181537 Banco de Dados
Um time está iniciando a migração de dados de um sistema transacional (OLTP) legado para um novo Data Warehouse (DW) corporativo. O sistema legado possui um modelo de dados altamente normalizado, atendendo à Terceira Forma Normal (3FN), o que garante a integridade das transações diárias. No entanto, para o novo ambiente analítico, cujo foco é a geração de relatórios gerenciais e painéis de BI (Business Intelligence) com alto volume de leitura, o arquiteto decidiu aplicar técnicas de desnormalização intencional em algumas tabelas, consolidando dados de produtos e categorias em uma única estrutura dimensional.

Considerando os impactos dessa decisão de projeto e os fundamentos da modelagem de dados, é correto afirmar que: 
Alternativas
Q4181539 Banco de Dados
A Secretaria de Saúde de um município está implementando um sistema de análise de dados para monitorar atendimentos em unidades de saúde. O cientista de dados apresentou duas abordagens para integrar dados de diferentes postos de saúde.

• Abordagem 1
− Extrair dados dos sistemas de cada posto (CSV, Excel, bancos locais)
− Transformar os dados em um servidor intermediário: padronizar formatos de data, validar CPF, limpar dados inconsistentes, calcular métricas agregadas
− Carregar apenas os dados já processados e limpos no Data Warehouse

• Abordagem 2
− Extrair dados dos sistemas de cada posto
− Carregar os dados brutos diretamente no Data Lake (Amazon S3)
− Transformar os dados, quando necessário, usando ferramentas de análise (SQL, Python, Spark)

Sobre essas abordagens, é correto afirmar que: 
Alternativas
Q4181540 Banco de Dados
Uma instituição financeira está implementando um sistema de detecção de fraudes em tempo real para processar transações de cartões de crédito originadas em dispositivos móveis globalmente. Devido à instabilidade de conectividade das redes móveis, os eventos de transação frequentemente chegam ao cluster de processamento fora de ordem e com atrasos variáveis (late arriving data). O requisito de negócio exige que as agregações de volume financeiro sejam calculadas com precisão determinística, baseando-se no momento exato em que a compra ocorreu, e não no momento em que o dado foi recebido pelo servidor, garantindo consistência mesmo em casos de reprocessamento histórico.

Considerando os conceitos de processamento de fluxo contínuo (streaming), semântica de tempo e mecanismos de tratamento de dados atrasados, é correto afirmar que: 
Alternativas
Q4181544 Banco de Dados
O aprendizado de máquina (machine learning) é frequentemente categorizado em diferentes paradigmas, dependendo da natureza dos dados disponíveis e do problema a ser resolvido. Dois dos tipos mais comuns são o aprendizado supervisionado e o aprendizado não supervisionado.

A principal diferença conceitual entre essas duas abordagens reside no fato de que, no aprendizado supervisionado:
Alternativas
Respostas
1: E
2: E
3: A
4: B
5: E
6: B
7: B