UBY-LMF [ 1 ] [ 2 ] es un formato para estandarizar recursos léxicos para el procesamiento del lenguaje natural (PLN). [ 3 ] UBY-LMF se ajusta al estándar ISO para léxicos: LMF , diseñado dentro del ISO-TC37 , y constituye una llamada serialización de este estándar abstracto. [ 4 ] De acuerdo con LMF, todos los atributos y otros términos lingüísticos introducidos en UBY-LMF hacen referencia a descripciones estandarizadas de su significado en ISOCat .
UBY-LMF se ha implementado en Java y se desarrolla activamente como un proyecto de código abierto en Google Code . A partir de esta implementación en Java, se ha creado automáticamente el léxico electrónico a gran escala UBY [ 5 ] , resultado de la estandarización de diversos recursos léxicos utilizados frecuentemente en aplicaciones de PLN mediante UBY-LMF.
En 2013, UBY contiene 10 léxicos que están interconectados por pares a nivel de sentido: [ 6 ] [ 7 ] [ 8 ]
- Inglés WordNet , Wikcionario , Wikipedia , FrameNet , VerbNet , OmegaWiki
- Wikcionario alemán , Wikipedia , GermaNet , IMSLex-Subcat y
- OmegaWiki multilingüe.
Un subconjunto de léxicos integrados en UBY se ha convertido a un formato de Web Semántica según el modelo de léxico Lemon. [ 9 ] Esta conversión se basa en un mapeo de UBY-LMF al modelo de léxico Lemon.
Referencias externas
- el sitio web de UBY
- Proyecto UBY en GitHub
- lemonUby (versión de UBY para la web semántica)
Referencias
- ↑ Judith Eckle-Kohler, Iryna Gurevych, Silvana Hartmann, Michael Matuschek, Christian M Meyer: UBY-LMF - explorando los límites de los modelos léxicos independientes del idioma, en Gil Francopoulo, LMF Lexical Markup Framework , ISTE / Wiley 2013 ( ISBN) 978-1-84821-430-9)
- ↑ Judith Eckle-Kohler, Iryna Gurevych, Silvana Hartmann, Michael Matuschek y Christian M. Meyer. UBY-LMF: un modelo uniforme para estandarizar recursos léxico-semánticos heterogéneos en ISO-LMF. En: Nicoletta Calzolari, Khalid Choukri, Thierry Declerck, Mehmet Uğur Doğan, Bente Maegaard, Joseph Mariani, Jan Odijk y Stelios Piperidis: Actas de la 8.ª Conferencia Internacional sobre Recursos y Evaluación del Lenguaje (LREC), págs. 275-282, mayo de 2012.
- ↑ Gottfried Herzog, Laurent Romary, Andreas Witt: Estándares para recursos lingüísticos. Presentación de póster en el META-FORUM 2013 - Exposición META, septiembre de 2013, Berlín, Alemania.
- ↑ Laurent Romary: TEI y LMF (referencias cruzadas). CoRR abs/1301.2444 (2013)
- ↑ Iryna Gurevych, Judith Eckle-Kohler, Silvana Hartmann, Michael Matuschek, Christian M. Meyer, Christian Wirth: UBY – un recurso léxico-semántico unificado a gran escala basado en LMF, Actas de EACL, págs. 580–590, 2012, Aviñón, Francia.
- ↑ Christian M. Meyer e Iryna Gurevych. Lo que los psicolingüistas saben sobre química: Alineación de Wikcionario y WordNet para una mayor cobertura del dominio, en: Actas de la 5.ª Conferencia Internacional Conjunta sobre Procesamiento del Lenguaje Natural (IJCNLP), págs. 883-892, noviembre de 2011. Chiang Mai, Tailandia.
- ↑ Silvana Hartmann e Iryna Gurevych. FrameNet en camino a Babel: Creación de una red FrameNet bilingüe utilizando Wikcionario como conexión interlingüística. En: Actas de la 51.ª Reunión Anual de la Asociación de Lingüística Computacional (ACL 2013), vol. 1, págs. 1363-1373, Asociación de Lingüística Computacional, agosto de 2013.
- ↑ Michael Matuschek e Iryna Gurevych. Dijkstra-WSA: Un enfoque basado en grafos para la alineación del sentido de las palabras. En: Transactions of the Association for Computational Linguistics (TACL), vol. 1, págs. 151-164, mayo de 2013.
- ^ John McCrae, Guadalupe Aguado-de-Cea, Paul Buitelaar, Philipp Cimiano, Thierry Declerck, Asunción Gómez-Pérez, Jorge Gracia, Laura Hollink, Elena Montiel-Ponsoda, Dennis Spohr, Tobias Wunner. (2012) Intercambio de recursos léxicos en la Web Semántica. Evaluación y recursos lingüísticos 46:701–719.
- Bases de datos léxicas