Questões de Concurso Sobre banco de dados
Foram encontradas 18.985 questões
I- Em processos de ETL, a etapa de transformação pode envolver padronização de formatos, tratamento de valores ausentes, remoção de duplicações, conversão de tipos, aplicação de regras de negócio e conformidade entre dimensões oriundas de fontes distintas.
II- A qualidade dos dados em ambientes analíticos depende exclusivamente da ferramenta de visualização utilizada, pois inconsistências de origem, duplicidades, ausência de chaves de integração e divergências semânticas são corrigidas automaticamente durante a renderização dos dashboards.
III- Técnicas de Data Mining podem ser utilizadas para identificar padrões, associações, agrupamentos, classificações ou tendências em grandes conjuntos de dados, mas seus resultados exigem interpretação crítica, validação e atenção a vieses, qualidade da amostra e pertinência do modelo.
IV- A carga incremental em um Data Warehouse elimina a necessidade de controle temporal dos dados, pois qualquer alteração em sistemas de origem deve sobrescrever integralmente os registros históricos para preservar apenas o estado atual das informações.
Analisadas as sentenças, estão CORRETAS apenas:
I- Em uma arquitetura de Business Intelligence, um Data Warehouse deve substituir integralmente os sistemas transacionais da organização ao registrar operações diárias com alto volume de inserções, atualizações e exclusões em tempo real.
PORQUE
II- Em modelagem dimensional, tabelas fato armazenam exclusivamente descrições textuais de entidades de negócio, enquanto tabelas dimensão concentram medidas quantitativas, chaves de transações e valores numéricos agregáveis utilizados nas consultas OLAP.
Analisadas as sentenças, é CORRETO afirmar que:
I- Rotinas escritas em Oracle PL/SQL podem ser executadas diretamente no Microsoft SQL Server, pois PL/SQL e Transact-SQL são implementações equivalentes do padrão SQL/PSM, diferindo apenas na nomenclatura de comandos de criação de objetos.
PORQUE
II- Oracle Database e Microsoft SQL Server são SGBDs relacionais que suportam objetos programáveis no banco de dados, como procedimentos armazenados, funções, gatilhos e mecanismos de controle transacional, mas possuem dialetos, tipos, funções internas, tratamento de exceções e particularidades semânticas próprias.
Analisadas as sentenças, é CORRETO afirmar que:
ALOCACAO_SERVIDOR (MatriculaServidor, NomeServidor, CodUnidade, NomeUnidade, RamalUnidade, CodProjeto, NomeProjeto, PapelNoProjeto)
A equipe de modelagem identificou as seguintes dependências funcionais:
• MatriculaServidor → NomeServidor, CodUnidade • CodUnidade → NomeUnidade, RamalUnidade • CodProjeto → NomeProjeto • (MatriculaServidor, CodProjeto) → PapelNoProjeto
Considerando que a chave candidata da relação original seja composta por (MatriculaServidor, CodProjeto), analise as sentenças a seguir:
I- A relação viola a Segunda Forma Normal, pois existem atributos não chave que dependem apenas de parte da chave composta, como NomeServidor dependente de MatriculaServidor e NomeProjeto dependente de CodProjeto.
II- A relação viola a Terceira Forma Normal, pois há dependência transitiva envolvendo dados da unidade, uma vez que MatriculaServidor determina CodUnidade, e CodUnidade determina NomeUnidade e RamalUnidade.
III- A relação encontra-se em Forma Normal de Boyce-Codd, pois todas as dependências funcionais identificadas preservam a chave composta (MatriculaServidor, CodProjeto) como determinante direto dos atributos operacionais.
IV- A decomposição da relação em tabelas separadas para servidores, unidades, projetos e alocações eliminaria obrigatoriamente todas as dependências funcionais do modelo, tornando desnecessária a definição de chaves primárias e estrangeiras.
Analisadas as sentenças, estão CORRETAS apenas:
Com base nos conceitos de administração de SGBD (como PostgreSQL, MySQL, SQL Server ou Oracle), assinale a alternativa que corresponde CORRETAMENTE a essa operação.
Considerando a notação clássica do Modelo EntidadeRelacionamento (MER), qual figura geométrica deve ser utilizada para representar esse elemento?
Coluna 1. 1. DML. 2. DDL.
Coluna 2: ( ) INSERT. ( ) UPDATE ( ) DELETE. () CREATE. ( ) DROP. ( ) ALTER.
Qual alternativa preenche, CORRETAMENTE, de cima para baixo, os parênteses acima?
Considerando os conceitos de processamento de fluxo contínuo (streaming), semântica de tempo e mecanismos de tratamento de dados atrasados, é correto afirmar que:
• Abordagem 1
− Extrair dados dos sistemas de cada posto (CSV, Excel, bancos locais)
− Transformar os dados em um servidor intermediário: padronizar formatos de data, validar CPF, limpar dados inconsistentes, calcular métricas agregadas
− Carregar apenas os dados já processados e limpos no Data Warehouse
• Abordagem 2
− Extrair dados dos sistemas de cada posto
− Carregar os dados brutos diretamente no Data Lake (Amazon S3)
− Transformar os dados, quando necessário, usando ferramentas de análise (SQL, Python, Spark)
Sobre essas abordagens, é correto afirmar que:
Considerando os impactos dessa decisão de projeto e os fundamentos da modelagem de dados, é correto afirmar que:
• Transacional e BI: o sistema de vendas gera registros financeiros que exigem consistência estrita (ACID). A equipe de analistas de negócios consome esses dados via painéis de BI que demandam baixa latência em consultas complexas com múltiplas junções (joins).
• Big Data e IA: o sistema de e-commerce gera petabytes de logs de navegação (clickstream) e dados de sensores IoT das lojas físicas (dados semiestruturados). A equipe de ciência de dados precisa acessar esses dados em seu formato bruto para treinar modelos preditivos, sem a perda de informações causada por agregações prematuras.
O arquiteto de dados precisa propor uma solução única que evite a duplicação de dados entre silos (um Data Warehouse para o BI e um Data Lake para a IA) e reduza o custo de armazenamento, mantendo a governança.
Considerando os requisitos apresentados e as características das arquiteturas modernas de dados, a abordagem arquitetural e de modelagem adequada é:
Com relação aos sistemas de arquivos distribuídos e aos sistemas de indexação, julgue o próximo item.
Sistemas de indexação impedem variações de desempenho em consultas analíticas, independentemente do volume de dados armazenados.
Com relação aos sistemas de arquivos distribuídos e aos sistemas de indexação, julgue o próximo item.
Em ambientes analíticos de ciência de dados, índices compostos podem apresentar melhor desempenho em consultas multidimensionais quando a ordem dos atributos indexados possui aderência aos padrões de filtragem utilizados nas consultas.
Acerca do armazenamento de Big Data, do pipeline de dados e dos conceitos de data lake, julgue o item subsequente.
O armazenamento orientado a objetos é incompatível com data lakes devido à natureza dos dados armazenados.
Acerca do armazenamento de Big Data, do pipeline de dados e dos conceitos de data lake, julgue o item subsequente.
Em pipelines de dados, a etapa de ingestão corresponde ao processo de eliminação permanente dos dados de origem após o carregamento no ambiente analítico.