Adquisición automática de información léxica y morfosintáctica a partir de corpus sin anotar: aplicación al serbocroata y al ruso
Resumen
En este artículo presentamos una metodología para la adquisición automática de información léxica y morfosintáctica a partir de corpus sin anotar. El sistema utiliza información sobre la morfología flexiva de la lengua que se desea tratar, así como información léxica y morfosintáctica de las palabras pertenecientes a clases no flexivas y de las palabras cuya flexión no responde a paradigmas regulares. Es un sistema en desarrollo, por lo que las evaluaciones que incluimos son preliminares.
Palabras clave
morfología computacional; análisis morfológico; lenguas eslavas
Texto completo:
PDFIN3 Working Paper Series es una publicación electrónica impulsada por el Internet Interdisciplinary Institute (IN3) de la Universitat Oberta de Catalunya.

Los textos publicados en esta serie de monografías están -si no se indica lo contrario- bajo una licencia Reconocimiento-NoComercial-SinObraDerivada 3.0 España de Creative Commons. Puede copiarlos, distribuirlos y comunicarlos públicamente siempre que cite su autor, el nombre de esta publicación (IN3 Working Paper Series) y las instituciones que los publican (IN3, UOC); no los utilice para fines comerciales y no haga con ellos obra derivada. La licencia completa se puede consultar en http://creativecommons.org/licenses/by-nc-nd/3.0/es/deed.es.