Questões de Concurso Público TJ-RJ 2026 para Analista Judiciário - Tecnologia da Informação - Engenheiro de Dados
Foram encontradas 70 questões
Dois anos após a implementação, a diretoria da XPTO constatou que, apesar do alto custo de armazenamento, a iniciativa fracassou. O repositório contém petabytes de dados, mas os analistas não conseguem localizar as informações necessárias, não confiam na veracidade dos dados devido à falta de linhagem (lineage) e qualidade, e não conseguem discernir quais arquivos são atuais ou obsoletos.
No contexto da governança e arquitetura de dados, o termo técnico utilizado para descrever o estado em que se encontra o repositório criado por Joselito, caracterizado pela ausência de organização e curadoria, tornando-o um passivo em vez de um ativo, é:
• Abordagem 1
− Extrair dados dos sistemas de cada posto (CSV, Excel, bancos locais)
− Transformar os dados em um servidor intermediário: padronizar formatos de data, validar CPF, limpar dados inconsistentes, calcular métricas agregadas
− Carregar apenas os dados já processados e limpos no Data Warehouse
• Abordagem 2
− Extrair dados dos sistemas de cada posto
− Carregar os dados brutos diretamente no Data Lake (Amazon S3)
− Transformar os dados, quando necessário, usando ferramentas de análise (SQL, Python, Spark)
Sobre essas abordagens, é correto afirmar que:
Considerando os conceitos de processamento de fluxo contínuo (streaming), semântica de tempo e mecanismos de tratamento de dados atrasados, é correto afirmar que:
No entanto, nos meses de dezembro e janeiro, a demanda por processamento aumenta significativamente devido ao 13º salário, reajustes e grande volume de retificações, causando risco de indisponibilidade e degradação de desempenho. Para lidar com esses picos, a equipe de TI decide configurar um mecanismo automático para que, sempre que a carga ultrapassar determinado limiar, sejam instanciados recursos adicionais de computação em uma nuvem pública.
Essa estratégia de extensão dinâmica da capacidade computacional para a nuvem pública em momentos de alta demanda é denominada:
Na proposta inicial, a área de TI contrapõe duas abordagens de alto nível:
• estratégia nativa (cloud-native), com serviços desenhados desde o início para consumir intensamente recursos de nuvem pública (contêineres orquestrados, funções serverless, filas e bancos gerenciados, observabilidade integrada etc.);
• estratégia híbrida, em que parte significativa da carga permanece em data center próprio ou em nuvem privada, com integração estruturada (túneis seguros, VPN, direct connect, replicação de dados) com a nuvem pública.
Considerando os trade-offs entre uma arquitetura nativa em nuvem e uma arquitetura híbrida nesse contexto, é correto afirmar que:
• o código-fonte da aplicação desenvolvido pelo tribunal seguia as práticas seguras da OWASP;
• as credenciais e o gerenciamento de identidade (IAM) estavam configurados corretamente pelo Tribunal; e
• a invasão ocorreu estritamente devido à exploração de uma vulnerabilidade conhecida (CVE) e não corrigida no kernel do sistema operacional do servidor que hospedava o ambiente de execução (runtime).
Considerando o Modelo de Responsabilidade Compartilhada aplicável a serviços PaaS, é correto afirmar que a responsabilidade pela falha de segurança que permitiu o incidente é:
A principal diferença conceitual entre essas duas abordagens reside no fato de que, no aprendizado supervisionado:
Considerando os conceitos de compensação viés-variância, sobreajuste, subajuste e técnicas de regularização, é correto afirmar que:
Diante desse cenário, é correto afirmar que o modelo:
(1) ingestão de dados em tempo real via streaming;
(2) feature engineering com agregações temporais (médias móveis de 7 e 30 dias);
(3) predição usando um modelo de gradient boosting;
(4) deployment em arquitetura de microsserviços.
Após três meses em produção, o time de MLOps observou degradação gradual no F1-score de 0.89 para 0.72, enquanto o monitoramento revelou que as distribuições das features agregadas apresentavam mudanças estatisticamente significativas (p < 0.01 no teste de Kolmogorov-Smirnov), embora as features brutas individuais permanecessem estáveis.
Considerando as melhores práticas de pipelines de ML em produção e estratégias de deployment, a equipe deve:
Como métrica principal, ele calculou a soma das diferenças absolutas dividida pelo número de observações, ou:
obtendo Erro = 18, que foi interpretado como: “em média, o modelo erra em 18 dias o tempo de tramitação dos processos”.
A métrica utilizada pelo cientista de dados é:
Sendo assim, é correto afirmar que a tabela de páginas de memória do Moderno:
A equipe ágil deve lidar com essa demanda:
Ao levar esse fato ao gerente de projetos, a equipe usou o PMBOK para justificar as alterações com base no princípio do(a):
O princípio da LGPD especificamente observado pelo módulo B é o da:
Para atender aos requisitos da LGPD e proteger a privacidade dos estudantes, a universidade deverá:
A auditoria externa, em seu relatório, informou que, para garantir a conformidade com a LGPD, a empresa pública de saneamento deverá:
Para que a equipe de DevOps consiga cumprir esse item, a ação a ser tomada, dentro das melhores práticas, deverá ser a de:
Com o passar do tempo, Ana tem notado que essa estratégia trouxe como benefício:
Considerando os desafios de governança e segurança de dados, é correto afirmar que a implementação do RBAC (controle de acesso baseado em função):