LinguaKit: uma ferramenta multilingue para a análise linguística e a extração de informação

Autor: Pablo Gamallo, Marcos Garcia
Jazyk: Catalan; Valencian<br />English<br />Spanish; Castilian<br />Basque<br />Galician<br />Portuguese
Rok vydání: 2017
Předmět:
Zdroj: Linguamática, Vol 9, Iss 1 (2017)
Druh dokumentu: article
ISSN: 1647-0818
DOI: 10.21814/lm.9.1.243
Popis: Este artigo apresenta LinguaKit, uma suite multilingue de ferramentas de análise, extração, anotação e correção linguísticas. LinguaKit permite realizar tarefas tão diversas como a lematização, a etiquetagem morfossintática ou a análise sintática (entre outras), incluindo também aplicações para a análise de sentimentos (ou minaria de opiniões), a extração de termos multipalavra, ou a anotação concetual e ligação a recursos enciclopédicos tais como a DBpedia. A maior parte dos módulos funcionam para quatro variedades linguísticas: português, espanhol, inglês e galego. A linguagem de programação de LinguaKit é Perl, e o código está disponível sob a licença livre GPLv3.
Databáze: Directory of Open Access Journals