🎯 Saiba o que estudar

Avançado com Treinador a partir de R$ 0,76/dia

Questões de Concurso Sobre data mining em banco de dados

Questões Discursivas

Foram encontradas 573 questões

Q2515933 Banco de Dados
Extrair conhecimento útil ou insights de dados massivos é um dos maiores desafios enfrentado pelos cientistas de dados. Uma das principais tarefas utilizadas para diminuir a complexidade desses dados é reduzir sua dimensionalidade preservando as características (features) mais importantes.
No ciclo de vida de ciência de dados, a tarefa de redução de dimensionalidade dos dados é executada na fase:
Alternativas
Q2491650 Banco de Dados

No que se refere à qualidade e visualização de dados, julgue o item a seguir.


A discretização de frequência igual divide os dados de modo que cada intervalo tenha aproximadamente o mesmo número de valores.

Alternativas
Q2491649 Banco de Dados

No que se refere à qualidade e visualização de dados, julgue o item a seguir.


O tratamento de dados ausentes é prescindível, pois muitos algoritmos de aprendizado de máquina funcionam bem com dados incompletos.

Alternativas
Q2491646 Banco de Dados

No que se refere à qualidade e visualização de dados, julgue o item a seguir.


Matching, ou correspondência de dados, é o processo de identificação de registros que se referem ao mesmo item na mesma fonte de dados.

Alternativas
Q2491645 Banco de Dados

No que se refere à qualidade e visualização de dados, julgue o item a seguir.


Outliers podem ser resultantes de erros de medição, entrada de dados ou processamento de dados, ou amostragem não representativa.

Alternativas
Q2491644 Banco de Dados

No que se refere à qualidade e visualização de dados, julgue o item a seguir.


Para a identificação de outliers, deve-se calcular o intervalo interquartil (IQR) e identificar dados que estão a mais de 1,5 vezes o IQR abaixo do primeiro quartil ou acima do terceiro quartil.

Alternativas
Q2491641 Banco de Dados

A respeito de análise exploratória de dados, julgue o item a seguir. 


Na etapa de pré-processamento de dados, a discretização envolve o ranqueamento estatístico dos dados, dividindo-os em faixas ou intervalos e agrupando-os em classes definidas com base em suas características intrínsecas.

Alternativas
Q2491640 Banco de Dados

A respeito de análise exploratória de dados, julgue o item a seguir. 


Um dado anômalo, ou outlier, é um valor que se destaca significativamente dos demais em um conjunto de dados e pode ser identificado visualmente por meio do gráfico boxplot.

Alternativas
Q2491639 Banco de Dados

A respeito de análise exploratória de dados, julgue o item a seguir. 


Na análise exploratória de dados, é comum categorizar os valores não numéricos como variáveis qualitativas, que podem ser subdivididas em discreta, como raça e cor, e em ordinal, como tamanho de uma roupa ou classe social.

Alternativas
Q2469939 Banco de Dados
A mineração de dados consiste em métodos, ferramentas e técnicas automatizadas para extrair informações de um conjunto de dados. Qual é o método de mineração de dados que tem como objetivo classificar as instâncias em categorias previamente definidas com base em suas características ou atributos?
Alternativas
Q2469936 Banco de Dados
Um analista de tecnologia da Prefeitura de Rio Branco recebeu a seguinte demanda da Secretaria de Segurança Pública: identificar comportamentos e características, de um conjunto de dados referente a processos judiciais ligados a ataques maliciosos a servidores de dados. O analista utilizou técnicas de mineração de dados e apresentou o seguinte resultado: 75% dos envolvidos em processos judiciais ligados a ataques maliciosos a servidores de dados também estão envolvidos em processos ligados a roubo de dados sigilosos. Com base no relato, o analista utilizou a técnica de 
Alternativas
Q2462643 Banco de Dados

No que se refere a deep learning e mineração de dados, julgue o item subsecutivo. 


A mineração de dados é comumente classificada por sua capacidade de realizar determinadas tarefas, entre as quais está a estimação, que, embora similar à classificação, é usada quando o registro é identificado por um valor numérico e não um categórico.

Alternativas
Q2457952 Banco de Dados
A mineração de dados consiste na inferência de relações com base em um grande volume de dados. No que tange à mineração de dados, um algoritmo de classificação é o:
Alternativas
Q2391946 Banco de Dados

No que se refere a modelagem dimensional, mineração de dados e big data, julgue o item subsequente.


No modelo CRISP-DM, a fase de preparação dos dados é caracterizada por atividades como análise da qualidade dos dados, exploração dos dados, geração dos primeiros insights e formulação de hipóteses. 

Alternativas
Q2387578 Banco de Dados
Considerando os conceitos principais de ciência de dados, analise as afirmativas a seguir e assinale (V) para a verdadeira e (F) para a falsa.

( ) Em um sistema BigData, o pipeline de dados implementa as etapas necessárias para mover dados de sistemas de origem, transformar esses dados com base nos requisitos e armazenar os dados em um sistema de destino, incluindo todos os processos necessários para transformar dados brutos em dados preparados que os usuários podem consumir.
( ) Dentre os métodos de manipulação de valores ausentes, em processamento massivo e paralelo, consta a normalização numérica, que se refere ao processo de ajustar os dados para que estejam em uma escala comparável, geralmente entre 0 e 1.
( ) A demanda crescente por medidas de criptografia ponta a ponta (da produção ao backup) tornam menos eficazes e relevantes tecnologias legadas, como a deduplicação de dados (data deduplication), que busca ajudar a otimizar o armazenamento e melhorar o desempenho de um sistema ao estabelecer processo de identificar e eliminar dados duplicados em um sistema.

As afirmativas são, respectivamente,
Alternativas
Q2383274 Banco de Dados
No gráfico XY, são apresentados pontos que representam duas propriedades de elementos de duas classes, R e S. Os pontos da classe R, representados como círculos, são [(3,5),(3,4),(2,3)], enquanto os pontos da classe S, representados como quadrados, são [(4,3),(4,2),(4,1),(3,1),(2,2)]. É necessário classificar pontos novos, de acordo com o algoritmo K-NN, com K=3, considerando a distância euclidiana.

Imagem associada para resolução da questão

Nesse contexto, as classes dos pontos [(3,2),(3,3) e (4,4)] são, respectivamente:
Alternativas
Q2383223 Banco de Dados
Apesar de existirem diversas aplicações reais em que há necessidade de ingestão periódica de dados, em algumas a ingestão em lote pode não ser vantajosa, como, por exemplo, em 
Alternativas
Q2380789 Banco de Dados
Identificar o tipo de dados ausentes é crucial para se encontrar soluções que os resolvam.

Avalie se os dados ausentes são categorizados como

I. MCAR. Valores ausentes completamente aleatórios.
II. Valores ausentes aleatórios.
III. MICE. Valores ausentes usando imputação múltipla usando equações encadeadas.

Está correto o que se apresenta em
Alternativas
Q2367131 Banco de Dados

Julgue o item a seguir que tratam de extração e representação de conhecimento. 


Em mineração de dados, interpretação e explanação consiste em filtrar o conjunto de dados por meio de mecanismo que varia de acordo com a técnica de mineração utilizada. 

Alternativas
Q2367100 Banco de Dados

Considerando processos de análise e mineração de dados, julgue o item subsecutivo. 


No contexto de mineração de dados, o atributo da veracidade está associado ao grau de confiabilidade dos dados utilizados na solução. 

Alternativas
Respostas
141: D
142: C
143: E
144: E
145: C
146: C
147: C
148: C
149: E
150: A
151: C
152: C
153: B
154: E
155: B
156: C
157: D
158: A
159: E
160: C