Questões de Concurso
Sobre banco de dados textuais em banco de dados
Foram encontradas 50 questões
Stop words integram uma lista universal de palavras utilizadas para identificar as paradas ou finais de textos, de modo a auxiliar na análise semântica.
O mecanismo denominado PageRank utiliza metadados semânticos e informações ligadas ao domínio para buscar as características de classificação de componentes de seu conteúdo.
Arquivo de assinatura é uma estrutura de comprovação de autenticidade do documento perante um certificador digital.
Arquivo invertido é um mecanismo que utiliza palavras para indexar uma coleção de documentos com a finalidade de facilitar a busca.
Encontrar uma informação na Web depende do uso de máquinas de busca e, consequentemente, de sua eficácia. Para permitir a busca por palavras-chaves, frases ou consultas booleanas no conteúdo completo de textos (full text searching), as ferramentas de busca varrem a Web, fazendo o download dos textos e indexando seu conteúdo.
Os dois métodos principais de busca por frases em bancos de dados textuais de larga escala, utilizando indexação de textos, são os arquivos invertidos com contadores de posição e índices para a próxima palavra.
Um banco de dados textual é uma coleção de documentos, que também pode ser visto como um longo conjunto de registros, em que cada registro contém apenas uma lista de palavras de tamanho arbitrário.
Exemplo: se uma consulta for feita para a palavra “ automóvel ” , podem ser pesquisados , simultaneamente, os sinônimos “carro” e “veículo”.
Essa técnica é conhecida como:
O método de busca descrito é conhecido como arquivos invertidos com:
De acordo com a fórmula da técnica IDF (inverse document frequence), o termo com maior número de ocorrências em trechos de um texto gera menor índice na fórmula de prioridades, sendo esse termo o mais representativo do documento.
A técnica denominada extração de termos (term extraction) compreende a análise de especialistas no domínio do texto e a incorporação de informações linguísticas às informações estatísticas sobre os termos do documento.
Em um banco de dados textual com hiperligações, em linguagem natural, os dados são altamente restringidos e suportam alto grau de computação.
Diferentemente dos bancos de dados relacionais, os textuais não possuem índices para recuperação da informação, haja vista não terem campos específicos. Em vez de índices, esses bancos de dados possuem stopwords, que são palavras-chaves utilizadas como base nas consultas de dados.
itens seguintes.
itens seguintes.
itens seguintes.
I. Os métodos de arquivos invertidos são caracterizados por possuírem duas partes principais: vocabulário e listas invertidas, sendo que o vocabulário é uma estrutura de busca que contém todos os diferentes termos existentes no texto de forma desordenada.
II. O arquivo invertido é como uma lista ordenada de palavras-chave. Sendo que por palavra existe um apontador para cada um dos documentos onde ela ocorre e sua posição nesse documento.
III. No método de índices para a próxima palavra, para cada termo distinto do vocabulário é criado uma lista de termos que ocorrem em uma posição posterior no texto, juntamente com apontadores de posição para essas ocorrências.
IV. No método de índices para a próxima palavra, os níveis são implementados como árvores binárias, sendo que as palavras existentes no documento que possuem sucessoras, ficam no primeiro nível e no nível seguinte ao índice para a próxima palavra.
Está correto o que se afirma em: