Autor: |
Antoni Oliver González |
Jazyk: |
Catalan; Valencian<br />English<br />Spanish; Castilian<br />Basque<br />Galician<br />Portuguese |
Rok vydání: |
2023 |
Předmět: |
|
Zdroj: |
Linguamática, Vol 14, Iss 2 (2023) |
Druh dokumentu: |
article |
ISSN: |
1647-0818 |
DOI: |
10.21814/lm.14.2.380 |
Popis: |
En aquest article presentem el procés de compilació de la nova versió del corpus paral·lel català-castellà creat a partir dels textos del Diari Oficial de la Generalitat de Catalunya (DOGC). Es descriuen els processos de descàrrega, conversió a text, segmentació i alineació automàtica. Tots els programes que s'han desenvolupat per dur a terme aquests processos es distribueixen amb una llicència lliure i el corpus compilat es pot descarregar lliurement. A més, es descriu el procés d'entrenament i avaluació de dos motors de traducció automàtica neuronal català-castellà i castellà-català que s'ha dut a terme fent servir aquest corpus paral·el. |
Databáze: |
Directory of Open Access Journals |
Externí odkaz: |
|