Articulo de referencia

LanguageWare

LanguageWare es una tecnología de procesamiento del lenguaje natural (PLN) desarrollada por IBM que permite a las aplicaciones procesar texto en lenguaje natural. Consta de un c...

LanguageWare es una tecnología de procesamiento del lenguaje natural (PLN) desarrollada por IBM que permite a las aplicaciones procesar texto en lenguaje natural. Consta de un conjunto de bibliotecas Java que ofrecen diversas funciones de PLN : identificación de idioma , segmentación/tokenización de texto, normalización, extracción de entidades y relaciones , y análisis y desambiguación semántica. El motor de análisis utiliza un enfoque de máquina de estados finitos en múltiples niveles, lo que optimiza su rendimiento y, al mismo tiempo, reduce considerablemente su consumo de recursos.

El comportamiento del sistema se basa en un conjunto de recursos léxico-semánticos configurables que describen las características y el dominio del idioma procesado. LanguageWare incluye un conjunto predeterminado de recursos que describe las características del idioma nativo, como la morfología y el vocabulario básico. Se han creado recursos complementarios que incluyen vocabularios, terminologías, reglas y gramáticas adicionales, que pueden ser genéricas para el idioma o específicas de uno o más dominios.

Un conjunto de herramientas de personalización basadas en Eclipse , LanguageWare Resource Workbench, está disponible en el sitio alphaWorks de IBM [ 1 ] , y permite compilar el conocimiento del dominio en estos recursos y, por lo tanto, incorporarlo al proceso de análisis.

LanguageWare se puede implementar como un conjunto de anotadores compatibles con UIMA , complementos de Eclipse o servicios web .

Véase también

Referencias

  1. "Comunidad alphaWorks" . alphaworks.ibm.com. 20 de octubre de 2009.
  • IBM LanguageWare Resource Workbench en alphaWorks
  • IBM LanguageWare Miner para redes sociosemánticas multidimensionales en alphaWorks
  • JumpStart Infocenter para IBM LanguageWare en IBM.com
  • Página principal de UIMA en la Fundación Apache Software
  • Marco de trabajo UIMA en SourceForge
  • IBM OmniFind Yahoo! Edition (motor de búsqueda empresarial GRATUITO) Archivado el 17/02/2007 en Wayback Machine.
  • Grupo de Sistemas de Información Semántica e Ingeniería del Lenguaje
  • Escritorio semántico.org
  • Branimir K. Boguraev, Procesamiento de estados finitos basado en anotaciones en una arquitectura de PLN a gran escala, Informe de investigación de IBM, 2004
  • Alexander Troussov, Mikhail Sogrin, "IBM LanguageWare Ontological Network Miner"
  • Sheila Kinsella, Andreas Harth, Alexander Troussov, Mikhail Sogrin, John Judge, Conor Hayes, John G. Breslin, "Navegación y anotación de redes semánticamente habilitadas de personas y objetos asociados"
  • Mikhail Kotelnikov, Alexander Polonsky, Malte Kiesel, Max Völkel, Heiko Haller, Mikhail Sogrin, Pär Lannerö, Brian Davis, "Wikis semánticas interactivas"
  • Sebastian Trüg, Jos van den Oever, Stéphane Laurière, "El escritorio semántico social: Nepomuk"
  • Séamus Lawless, Vincent Wade, "Descubrimiento, recopilación y entrega dinámica de contenido"
  • R. Mack, S. Mukherjea, A. Soffer, N. Uramoto, E. Brown, A. Coden, J. Cooper, A. Inokuchi, B. Iyer, Y. Mass, H. Matsuzawa y LV Subramaniam, "Análisis de texto para ciencias de la vida utilizando la arquitectura de gestión de información no estructurada"
  • Alex Nevidomsky, "Marco UIMA y descubrimiento de conocimiento en IBM", 4º Simposio de Minería de Texto, Fraunhofer SCAI, 2006