Adquisición automática de información léxica y morfosintáctica a partir de corpus sin anotar: aplicación al serbocroata y al ruso

Antoni Oliver, Irene Castellón

Resumen


En este artículo presentamos una metodología para la adquisición automática de información léxica y morfosintáctica a partir de corpus sin anotar. El sistema utiliza información sobre la morfología flexiva de la lengua que se desea tratar, así como información léxica y morfosintáctica de las palabras pertenecientes a clases no flexivas y de las palabras cuya flexión no responde a paradigmas regulares. Es un sistema en desarrollo, por lo que las evaluaciones que incluimos son preliminares.

Palabras clave


morfología computacional; análisis morfológico; lenguas eslavas

Texto completo:

PDF


IN3 Working Paper Series es una publicación electrónica impulsada por el Internet Interdisciplinary Institute (IN3) de la Universitat Oberta de Catalunya.

Creative Commons
Los textos publicados en esta serie de monografías están -si no se indica lo contrario- bajo una licencia Reconocimiento-NoComercial-SinObraDerivada 3.0 España de Creative Commons. Puede copiarlos, distribuirlos y comunicarlos públicamente siempre que cite su autor, el nombre de esta publicación (IN3 Working Paper Series) y las instituciones que los publican (IN3, UOC); no los utilice para fines comerciales y no haga con ellos obra derivada. La licencia completa se puede consultar en http://creativecommons.org/licenses/by-nc-nd/3.0/es/deed.es.