Indexação e recuperação de teses e dissertações por meio de sintagmas nominais

Autor: Camila Oliveira de Almeida Lima, Darliane Goes de Miranda, Renato Fernandes Corrêa, Tiago José da Silva
Rok vydání: 2011
Předmět:
Zdroj: AtoZ: novas práticas em informação e conhecimento. 1:11
ISSN: 2237-826X
Popis: Introducao . Aborda a utilizacao dos sintagmas nominais no processo indexacao automatica das teses e dissertacoes depositadas na Biblioteca Digital de Teses e Dissertacoes da UFPE (BDTD-UFPE), considerando a hipotese de que os sintagmas nominais consistiriam numa melhor unidade de conhecimento para a indexacao e recuperacao de informacao que as palavras isoladas, permitindo aumentar a satisfacao da necessidade de informacao do usuario durante a busca pela informacao. Discute-se sobre o estado da arte dos sintagmas nominais e de sua extracao automatica, bem como sua aplicacao na indexacao automatica e recuperacao de informacao. Metodo . Analisa, com base em ferramenta para analise de texto (OGMA), a aplicabilidade da extracao de sintagmas nominais na indexacao automatica e recuperacao de informacao de teses e dissertacoes no contexto da BDTD-UFPE. Com base em resumos da area de Direito, Computacao e Nutricao, definiram-se os valores totais para cada uma das variaveis observadas, o que permitiu avaliar a extracao de sintagmas nominais atraves dos percentuais de precisao de sintagmas nominais relevantes; da taxa de erro ao extrair cadeias de caracteres que nao constituem sintagmas nominais, e; do percentual de sintagmas nominais extraidos nao relevantes. Resultados . O processo de extracao de sintagmas nominais atraves do OGMA teve diferentes desempenhos para cada programa de pos-graduacao, sendo obtido melhor desempenho (melhor indice de precisao) para resumos de Direito, seguidos dos de Computacao e Nutricao. Esta diferenca de desempenho pode em parte ser explicada pela diferente natureza dos termos tecnicos presentes nos resumos. Conclusoes . Embora existam limitacoes nas ferramentas disponiveis, a aplicacao de metodos automatizados de extracao e indexacao por sintagmas nominais mostra-se promissora, pois os sintagmas nominais se configuram como melhores descritores e pontos de acesso aos documentos, eliminando os problemas causados pela sinonimia e a polissemia das palavras isoladas.
Databáze: OpenAIRE