Questões de Concurso Sobre big data em banco de dados

Foram encontradas 402 questões

Q3208409 Banco de Dados

Julgue o próximo item, a respeito de machine leaning


Árvores de decisão são técnicas de modelagem preditiva que particionam iterativamente os dados em subconjuntos homogêneos baseados em variáveis explicativas.

Alternativas
Q3208408 Banco de Dados

Julgue o próximo item, a respeito de machine leaning


Os algoritmos de regressão linear, por minimizarem a soma dos resíduos quadrados para ajustar os coeficientes, são sensíveis a outliers, que podem distorcer os coeficientes e comprometer a previsão do modelo. 

Alternativas
Q3208407 Banco de Dados

Julgue o próximo item, a respeito de machine leaning


Grandes volumes de dados frequentemente revelam padrões e tendências que são valiosos para análises preditivas e tomadas de decisão, facilitando a antecipação de comportamentos futuros e permitindo melhor alocação de recursos e planejamento. 

Alternativas
Q3188247 Banco de Dados
Inicialmente, o conceito de Big Data era amplamente descrito pelos chamados ‘3 Vs’. Com o avanço da área, novos ‘Vs’ foram incorporados para ampliar essa definição. Um desses novos ‘Vs’ é a veracidade.
Assinale a opção que melhor define o conceito de veracidade. 
Alternativas
Q3185290 Banco de Dados
No contexto de análises estatísticas, os dados podem estar disponíveis em diferentes tipos de organização. Dependendo da forma de definição e armazenamento, os conjuntos de dados são tipicamente caracterizados como estruturados, semiestruturados e não estruturados. Diante do exposto, analise as afirmativas a seguir.

I. Enquanto dados não estruturados são normalmente armazenados em seu formato nativo (como vídeos, imagens ou documentos de texto), dados estruturados são armazenados em linhas e colunas e podem ser mapeados para campos predefinidos.
II. Ao contrário dos dados estruturados, que podem ser organizados e acessados por meio de bancos de dados relacionais, dados não estruturados não têm um modelo rígido de organização predefinido.
III. Conjuntos de dados semiestruturados usam tags e marcadores (ou seja, metadados) em vez de exigir um esquema predefinido em tabelas, linhas e colunas, como nos dados estruturados.
IV. Os data lakes podem ser projetados para armazenar dados semiestruturados juntamente com dados estruturados, permitindo a coexistência de dados de ambos os tipos.

Está correto o que se afirma em
Alternativas
Q3178710 Banco de Dados
O pré-processamento de dados é uma etapa essencial para garantir a qualidade e a eficiência das análises em ambientes de Big Data. Sendo assim, assinale a alternativa que descreve corretamente uma técnica comum de pré-processamento de dados.
Alternativas
Q3174803 Banco de Dados
No contexto de ferramentas de integração de ambientes de Big Data e Banco de Dados relacionais, associe cada descrição a seguir à respectiva ferramenta.
1. Apache Kafka. 2. Apache Sqoop.
( ) Muito usado para transferência de dados entre bancos relacionais para o ecossistema Hadoop.
( ) Suas transferências de dados são baseadas em lotes, focando em transferências programadas ou sob demanda.
( ) Muito usado para streaming de dados em tempo real.
( ) Trabalha com mensageria distribuída, baseada no conceito de tópicos, permite que produtores enviem mensagens e consumidores as processem de forma assíncrona.

A associação correta, na ordem apresentada, é
Alternativas
Q3174801 Banco de Dados
No contexto de Big Data, novas ferramentas e novos modelos de armazenamento de dados foram criados para atender às necessidades de flexibilidade, disponibilidade, escalabilidade e desempenho das aplicações, muitas vezes sacrificando uma ou mais propriedades ACID.
Assinale a opção que apresenta, respectivamente, uma ferramenta que trata do modelo de dados orientado a colunas e outra, do modelo orientado a documentos.
Alternativas
Q3174800 Banco de Dados
As organizações públicas podem se beneficiar do uso de Big Data para auditar grandes volumes de informações de maneira eficiente.
Sobre os 5Vs que caracterizam o Big Data, assinale a afirmativa correta.
Alternativas
Q3174795 Banco de Dados
NoSQL é uma abreviação de Not only SQL (não somente SQL), termo cunhado para definir os novos modelos de armazenamento de dados, criados para atender às necessidades de flexibilidade, disponibilidade, escalabilidade e desempenho das aplicações inseridas no contexto de Big Data.
Esses modelos são classificados de acordo com a estrutura em que os dados são armazenados.
Um deles, especificamente, não considera conceitos como normalização de dados, criação de joins e definição de esquemas rígidos. Ele armazena estruturas flexíveis que podem ser obtidas por meio de dados semiestruturados, como os formatos XML e JSON. Cada uma dessas estruturas armazenadas não contém necessariamente os mesmos atributos, pois não é necessário definir um esquema.
O modelo em questão é o
Alternativas
Q3171169 Banco de Dados
Nos últimos anos, houve um crescimento colossal de dados gerados nos ramos de tecnologia da informação (TI), indústrias, saúde, IoT e em outros sistemas envolvendo quase todos os setores da sociedade. Uma estimativa da IBM de 2019 concluiu que 2,5 quintilhões de bytes de dados são criados diariamente. Assinale a alternativa que apresenta qual das fontes de dados contribui para o Big Data.
Alternativas
Q3171168 Banco de Dados
O conceito de Big Data vem sendo constantemente discutido por diversas áreas de estudo, por conta de seu grande avanço ao longo dos anos. Assinale a alternativa correta quanto à principal característica que torna o Big Data desafiador para armazenamento e análise.
Alternativas
Q3171167 Banco de Dados
Big Data se refere a conjuntos de dados extremamente grandes e complexos que crescem exponencialmente. Essa massa de informações, muitas vezes estruturadas e não estruturadas, exige ferramentas e técnicas específicas para serem armazenadas, processadas e analisadas. A análise de Big Data permite identificar padrões, tendências e insights valiosos que podem impulsionar a tomada de decisões em diversas áreas, como negócios, ciência e governo. Assinale a alternativa que apresenta um dos principais objetivos do uso de big data nas empresas.
Alternativas
Q3167194 Banco de Dados

No que se refere à ciência de dados, julgue o item seguinte.


Em big data, representações visuais, como gráficos e dashboards, permitem que padrões sejam rapidamente identificados.

Alternativas
Q3167057 Banco de Dados

Acerca da arquitetura de sistemas analíticos e do ecossistema Apache Hadoop, julgue o próximo item. 


O Hadoop é considerado ineficiente em cenários que exigem escalabilidade horizontal, sendo mais adequado para processamento em clusters pequenos.

Alternativas
Q3167047 Banco de Dados

A respeito de Big Data, julgue o item a seguir.


O armazenamento de Big Data em sistemas distribuídos, a exemplo do HDFS (Hadoop Distributed File System), melhora a tolerância a falhas e a escalabilidade ao distribuir dados entre múltiplos nós.

Alternativas
Q3167046 Banco de Dados

A respeito de Big Data, julgue o item a seguir.


Na etapa de ingestão de um pipeline de dados de Big Data, os dados de diversas fontes são coletados e transportados para um armazenamento centralizado.

Alternativas
Q3167045 Banco de Dados

A respeito de Big Data, julgue o item a seguir.


Os data lakes, por armazenarem dados em seus formatos originais, eliminam completamente a necessidade de data warehouses em ambientes de Big Data.

Alternativas
Q3162131 Banco de Dados
MapReduce é um modelo de programação utilizado no processamento de grandes volumes de dados. Seu sucesso é decorrente do uso facilitado para processar dados de forma distribuída. Em seu uso, o usuário precisa especificar uma função de Map para gerar os pares de chave/valor. Além disso, torna-se necessário definir a função de Reduce para juntar os valores intermediários processados associados a uma mesma chave. Qual das seguintes ferramentas implementa esse modelo de programação?
Alternativas
Q3156891 Banco de Dados

A respeito de inteligência artificial, de tipos de análise de dados e de Big Data, julgue o item que se segue.


A veracidade em Big Data reflete o desafio de se assegurar a qualidade e precisão de dados frequentemente confusos, ruidosos e propensos a erros que comprometem sua confiabilidade.

Alternativas
Respostas
121: C
122: C
123: C
124: D
125: A
126: B
127: E
128: B
129: E
130: A
131: D
132: B
133: B
134: C
135: E
136: C
137: C
138: E
139: A
140: C