Questões de Concurso Sobre banco de dados paralelos e distribuídos em banco de dados

Foram encontradas 255 questões

Q4223159 Banco de Dados
Uma empresa pública de tecnologia da informação gerencia o sistema de Nota Fiscal Eletrônica de um estado, processando mais de 50 milhões de registros transacionais diariamente. O banco de dados relacional centralizado começou a apresentar degradação crítica de desempenho de E/S de disco e gargalos na gravação de dados devido ao tamanho massivo das tabelas.
Visando descentralizar a escrita e a leitura, o Analista de Tecnologia propôs aplicar a técnica de Sharding horizontal, distribuindo as linhas das tabelas em múltiplos servidores de banco de dados independentes e fisicamente separados.
Ao projetar uma arquitetura distribuída baseada em Sharding, o principal desafio arquitetural que o analista enfrentará para garantir a eficiência das consultas e evitar a degradação do sistema é 
Alternativas
Q4218286 Banco de Dados
A respeito do Apache Hadoop, ecossistema muito usado no contexto de processamento de grandes volumes de dados, analise os itens a seguir.

I. O Hadoop MapReduce é um framework de software que facilita a criação de aplicações para processar vastas quantidades de dados (datasets de múltiplos terabytes) em paralelo, utilizando grandes clusters (milhares de nós) de hardware comum, de maneira confiável e tolerante a falhas.
II. O Hadoop Distributed File System (HDFS) é um sistema de arquivos distribuído, projetado para ser executado em hardware comum.
III. A ideia fundamental do YARN é dividir as funcionalidades de gerenciamento de recursos e o agendamento/monitoramento de tarefas em daemons distintos.

Está correto o que se afirma em 
Alternativas
Q4218268 Banco de Dados
Em relação aos bancos de dados NoSQL orientados a documentos e às técnicas empregadas nesse tipo de NoSQL, analise as afirmativas a seguir e assinale (V) para a verdadeira e (F) para a falsa.

( ) A normalização dos dados é frequentemente utilizada, garantindo a consistência dos dados, escalabilidade e evitando redundância.
( ) Utilizam um modelo de dados flexível (schemaless), e empregam preferencialmente o armazenado de dados em formatos como PDF e TXT.
( ) São comumente mais escaláveis horizontalmente do que bancos de dados relacionais, permitindo dessa forma a distribuição de dados entre múltiplos servidores.

As afirmativas são, respectivamente, 
Alternativas
Q4216244 Banco de Dados

Sistemas back-end distribuídos frequentemente precisam operar em ambientes sujeitos a falhas de rede, latência variável e crescimento horizontal. Nesse contexto, bancos de dados distribuídos adotam diferentes compromissos arquiteturais para equilibrar consistência, disponibilidade e tolerância a particionamento, conforme formalizado pelo Teorema CAP, que orienta decisões de projeto em aplicações de larga escala.


Considere um sistema back-end distribuído que precisa permanecer operacional mesmo diante de falhas de comunicação entre nós, atendendo requisições de leitura e escrita sob carga elevada, com dados replicados geograficamente.


Nesse contexto, assinale a alternativa que descreve corretamente uma implicação do Teorema CAP aplicada ao projeto de bancos de dados distribuídos.

Alternativas
Q4186143 Banco de Dados
Uma universidade possui vários campi nas cidades do mesmo Estado. Para otimizar o acesso, o DBA decide que os dados dos alunos que estudam em cada campus serão armazenados no servidor daquele polo. Cada uma das partes mantém todas as colunas da tabela original.
Essa técnica de divisão de dados é conhecida como: 
Alternativas
Q4186140 Banco de Dados
Em um banco de dados distribuído, o sistema permite que um usuário emita uma consulta como SELECT * FROM FUNCIONARIO sem precisar saber em qual cidade ou servidor as tuplas dessa tabela estão fisicamente armazenadas ou se a tabela foi dividida entre vários locais.
Essa capacidade do SGBDD é chamada de:
Alternativas
Q4185136 Banco de Dados

    A INFRA S.A. passou a lidar com grandes volumes de dados heterogêneos oriundos de sensores de campo, relatórios de fiscalização, sistemas legados e bases externas. Para ampliar a capacidade analítica, a empresa pública adotou um ecossistema baseado em Apache Hadoop para armazenamento e processamento distribuído, integrando os dados consolidados a dashboards interativos desenvolvidos na ferramenta Qlik, voltados à alta gestão e a órgãos de controle. Com o objetivo de aprimorar a comunicação dos resultados analíticos, a INFRA S.A. também incorporou práticas de storytelling com dados, buscando transformar análises técnicas complexas em narrativas compreensíveis para gestores não técnicos, mantendo rigor informacional e rastreabilidade.


A partir da situação hipotética precedente, julgue os itens a seguir.

O HDFS do Apache Hadoop permite o armazenamento distribuído e tolerante a falhas de grandes volumes de dados não estruturados, sendo adequado, no que concerne às atividades da INFRA S.A., para dados históricos de sensores e registros de campo, por exemplo.
Alternativas
Q4185125 Banco de Dados
    A INFRA S.A. implantou uma arquitetura corporativa de dados híbrida para suportar suas atividades estratégicas, sobretudo a estruturação de projetos de infraestrutura logística. Nessa arquitetura, o Oracle Database 21C é utilizado para sistemas críticos de gestão contratual e execução orçamentária; bancos de dados NoSQL são empregados para armazenar dados semiestruturados oriundos de sensores, documentos técnicos e relatórios de campo; e um data lake corporativo é adotado para ingestão massiva de dados brutos históricos, inclusive dados geoespaciais e séries temporais.

Considerando a situação hipotética apresentada, julgue os itens a seguir.
No cenário da INFRA S.A., a replicação automática oferecida por bancos NoSQL distribuídos garante consistência imediata entre todos os nós do cluster, tornando desnecessária a definição de políticas de consistência para aplicações críticas de acompanhamento de contratos de obras
Alternativas
Q4176628 Banco de Dados

Acerca do armazenamento de Big Data, do pipeline de dados e dos conceitos de data lake, julgue o item subsequente.


Em ambientes de Big Data, sistemas distribuídos de armazenamento permitem o processamento de grandes volumes de dados em múltiplos nós computacionais. 

Alternativas
Q4163937 Banco de Dados
No contexto dos sistemas computacionais modernos, especialmente em ambientes corporativos e distribuídos, diversos mecanismos são empregados para garantir integridade, desempenho, continuidade operacional e confiabilidade no processamento das informações. Sobre esse assunto, julgue as sentenças abaixo como VERDADEIRAS (V) ou FALSAS (F).
(__) O controle de concorrência constitui um dos pilares da integridade em sistemas computacionais multiusuários, especialmente em bancos de dados e ambientes distribuídos.
(__) O gerenciamento de desempenho envolve o monitoramento contínuo de métricas como tempo de resposta, throughput, consumo de CPU, memória, latência de rede e gargalos de entrada e saída, buscando otimizar a eficiência operacional dos sistemas.
(__) O gerenciamento de desempenho coordena acessos simultâneos aos mesmos recursos sem comprometer consistência, isolamento e confiabilidade das transações.
A sequência correta é:
Alternativas
Q4091006 Banco de Dados
Um arquiteto de sistemas de uma instituição financeira gerencia um ambiente de banco de dados distribuído que opera com o protocolo de efetivação em duas fases (2PC) para garantir a consistência ACID. Em um cenário de auditoria, uma transação T1 envolve o débito na conta de um cliente no servidor X e o crédito na conta de uma loja no servidor Y. Durante a execução, o coordenador da transação emite a ordem de preparação e tanto o servidor X quanto o servidor Y respondem afirmativamente (Vote Commit), entrando no estado de prontidão. Imediatamente após receber os votos, o coordenador toma a decisão de efetivar a transação e grava o registro Commit em seu armazenamento estável, mas falha criticamente antes de conseguir transmitir a mensagem de decisão para qualquer um dos servidores participantes. Diante desse cenário de falha do coordenador após o voto de prontidão dos participantes, qual é o comportamento técnico obrigatório do servidor Y? 
Alternativas
Q4088619 Banco de Dados
O Auditor fiscaliza a arquitetura de um novo banco de dados NoSQL distribuído para o TCE-SC. O sistema precisa garantir que, em caso de falha na rede entre dois data centers, o sistema continue aceitando gravações, mesmo que os dados fiquem temporariamente inconsistentes entre os nós.
De acordo com o Teorema CAP, esse sistema prioriza as propriedades de
Alternativas
Q4088600 Banco de Dados
Para processar terabytes de logs de notas fiscais eletrônicas, o TCE-SC utiliza um cluster Apache Spark. O Auditor nota que o processamento está lento devido ao excesso de movimentação de dados entre os nós da rede durante operações de agrupamento.
A operação do Spark conhecida por causar esse fenômeno de Shuffle e que deve ser utilizada com cautela em grandes datasets é:
Alternativas
Ano: 2026 Banca: FURB Órgão: SED-SC Prova: FURB - 2026 - SED-SC - Analista de Informática |
Q4080372 Banco de Dados
Em bancos de dados distribuídos, o Sharding é utilizado para distribuir dados entre múltiplos nós, visando escalabilidade horizontal e melhor desempenho. A respeito do Sharding, assinale a alternativa correta: 
Alternativas
Ano: 2026 Banca: FURB Órgão: SED-SC Prova: FURB - 2026 - SED-SC - Analista de Informática |
Q4080371 Banco de Dados
Em sistemas distribuídos que executam transações envolvendo múltiplos nós, a garantia de atomicidade é frequentemente obtida por meio do protocolo Two-Phase Commit, no qual um coordenador interage com participantes por meio de duas fases distintas: prepare (voting) e commit/abort. O protocolo assume comunicação confiável e utiliza registros persistentes (logs) para permitir recuperação após falhas, mantendo consistência entre os participantes. Considerando as propriedades formais do protocolo 2PC, assinale a alternativa correta: 
Alternativas
Q4048568 Banco de Dados

O Portal da Transparência do Governo Federal precisa lidar com um volume massivo e crescente de dados heterogêneos, como despesas, receitas, contratos e informações sobre servidores. A arquitetura de dados atual, baseada em um modelo puramente relacional, enfrenta desafios de desempenho e flexibilidade para incorporar novas fontes de dados.


Analise as seguintes proposições sobre a aplicação de bancos de dados NoSQL para solucionar os desafios do Portal da Transparência: 


I. Bancos de dados relacionais são inerentemente superiores aos NoSQL para cenários de Big Data e dados heterogêneos, pois a rigidez do esquema e o suporte a transações ACID garantem melhor desempenho em consultas analíticas complexas.


 II. A adoção de um banco de dados NoSQL orientado a documentos permitiria armazenar os dados de cada fonte (despesas, contratos, etc.) em seus formatos originais (JSON, por exemplo), facilitando a ingestão e a evolução do modelo de dados sem a necessidade de migrações de esquema complexas.


III. A escalabilidade horizontal, uma característica comum em muitos SGBDs NoSQL, seria um benefício chave, permitindo que a infraestrutura do portal cresça de forma mais elástica e com menor custo para acompanhar o aumento do volume de dados e do número de acessos.


Está correto o que se afirma em:

Alternativas
Q4048561 Banco de Dados

Para lidar com o grande volume e a complexidade dos dados do Big Data, foram desenvolvidas tecnologias e frameworks específicos, que superam as limitações dos sistemas de bancos de dados tradicionais. Um analista de dados de um órgão de pesquisa precisa processar um grande conjunto de dados não estruturados.


Analise as seguintes proposições sobre as tecnologias de Big Data:


I. O Hadoop é um framework de código aberto que permite o processamento distribuído de grandes conjuntos de dados em clusters de computadores. Seus componentes principais são o HDFS (Hadoop Distributed File System), para armazenamento distribuído, e o MapReduce, para o processamento paralelo.

II. O MapReduce é um modelo de programação onde a tarefa é dividida em duas fases: a fase 'Map', que processa e mapeia os dados de entrada em pares de chave-valor, e a fase 'Reduce', que agrega os resultados intermediários da fase 'Map' para produzir o resultado final.

III. O Spark é outro framework de processamento distribuído que, embora compatível com o ecossistema Hadoop, é conhecido por ser significativamente mais rápido, pois realiza o processamento em memória (in-memory), sendo ideal para aplicações de aprendizado de máquina e processamento de dados em tempo real.


Está correto o que se afirma em: 

Alternativas
Q4036220 Banco de Dados
Um Analista de Sistemas, que atua em uma agência de fomento vinculada ao setor governamental, está trabalhando com o Hadoop para processar e analisar grandes volumes de dados armazenados no HDFS (Hadoop Distributed File System). Ele precisa consultar esses dados de forma rápida e eficiente, utilizando uma linguagem semelhante ao SQL (Structured Query Language) para extrair informações agregadas e gerar relatórios. Considerando esse contexto, assinale a alternativa que apresenta duas ferramentas do Hadoop capazes de consultar grandes volumes de dados no HDFS, usando uma linguagem semelhante ao SQL (HiveQL/SQL):
Alternativas
Q4027777 Banco de Dados

Julgue o item a seguir, relacionados à integração de Big Data e inteligência artificial, bem como a ferramentas de migração. 


Sistemas de inteligência artificial executados em infraestrutura de nuvem prescindem da utilização de armazenamento distribuído, pois os modelos de IA processam dados diretamente na memória dos nós de processamento sem necessidade de acesso a dados persistidos.

Alternativas
Q4027776 Banco de Dados

Julgue o item a seguir, relacionados à integração de Big Data e inteligência artificial, bem como a ferramentas de migração. 


Plataformas de processamento distribuído utilizadas em ambientes de Big Data podem ser executadas em infraestrutura de nuvem para realizar processamento paralelo de grandes volumes de dados, os quais podem posteriormente ser utilizados no treinamento de modelos de inteligência artificial. 

Alternativas
Respostas
1: B
2: E
3: A
4: B
5: B
6: C
7: C
8: E
9: C
10: A
11: B
12: C
13: C
14: A
15: E
16: D
17: C
18: A
19: E
20: C