Sociedad Española para el Procesamiento del Lenguaje Natural
Abstract
En los últimos años se han popularizado herramientas de Extracción de Información comerciales dentro del ecosistema de servicios de la Web Semántica. OpenCalais ofrece actualmente reconocimiento y categorización de Entidades Nombradas en castellano de fácil integración en aplicaciones de PLN. Hemos evaluado esta herramienta de anotación de entidades en el corpus de noticias CoNLL 2002. OpenCalais obtiene valores de precisión aceptables en las principales clases (persona, lugares y organización). Sin embargo, en comparación con los prototipos de investigación en castellano puede mejorar la cobertura y el tratamiento de la ambigüedad.The Semantic Web ecosystem has seen the growing popularity of commercial
Information Extraction services. Among them, OpenCalais provides Named Entity
Recognition and Classification in Spanish. We have evaluated this service in the CONLL
2002 news corpus. The precision results are good enough for the development of
applications that use the main classes (person, location and organization). However, recall
and the treatment of ambiguous entities could be improved to be in pair with research
prototypes.Este trabajo ha sido parcialmente financiado
por la red MA2VICMR (S2009/TIC-1542) y por el
proyecto BRAVO (TIN2007-67407-C03-01)Publicad