
La notación WX es un esquema de transliteración para representar idiomas indios en ASCII . Este esquema se originó en IIT Kanpur para el procesamiento computacional de idiomas indios, y es ampliamente utilizado entre la comunidad de procesamiento de lenguaje natural (NLP) en India. La notación (aunque no identificada) se utiliza, por ejemplo, en un libro de texto sobre NLP de IIT Kanpur. [1] Las características sobresalientes de este esquema de transliteración son: Cada consonante y cada vocal tiene una única asignación al alfabeto latino. Por lo tanto, es un código de prefijo, [2] ventajoso desde un punto de vista computacional. Por lo general, las letras minúsculas se utilizan para consonantes no aspiradas y vocales cortas, mientras que las letras mayúsculas se utilizan para consonantes aspiradas y vocales largas. Mientras que las consonantes sordas y sonoras retroflexionadas se asignan a 't, T, d y D', las dentales se asignan a 'w, W, x y X'. De ahí el nombre del esquema "WX", que hace referencia a la asignación idiosincrásica. Ubuntu Linux proporciona soporte de teclado para la notación WX.
En las siguientes tablas, se destacan en negrita las asignaciones idiosincrásicas de letras a fonemas con los que normalmente no están asociadas. Además de 'w', 'W', 'x' y 'X', se incluyen 'f', 'F', 'q', 'Q', 'L' y 'R'.
Vocales
Sonorantes
Anusvara y visarga
El Anunasika se representa con la letra "z". Por ejemplo, अँ = az. En sánscrito, el Avagraha se representa con la letra "Z". Por ejemplo, वमतोऽन्तः = vamawoZnwaH. Esto puede causar confusión, ya que la "Z" también se utiliza con otro propósito en el caso de otras lenguas índicas (véase más abajo, último párrafo).
Consonantes
Este esquema se amplió aún más para representar todas las escrituras indias derivadas del brahmi. Para tener en cuenta los caracteres de otros idiomas indios que faltan en el devanagari, se utilizan tres operadores: 'Y' para obtener el siguiente carácter ISCII , 'V' para obtener el carácter ISCII anterior y 'Z' para añadir el nuqta . Así, por ejemplo, 'l' representa ल (U0932) del devanagari y 'lY' representa ळ (U0933) en maratí. 'e' representa ए (U090F) del devanagari o ఏ (U0C0F) del telugu y eV representa ऎ (U090E) o ఎ (U0C0E) del telugu. De forma similar, 'ka' representa क del devanagari y 'kZa' representa क़.
Véase también
- Transliteración del devanagari
- Asociación Internacional de Ingenieros
- ITRANS
- Romanización de la Biblioteca Nacional de Calcuta
- Alfabeto internacional de transliteración sánscrita
Referencias
- ^ Akshar Bharati; Vineet Chaitanya; Rajeev Sangal (1996). "Apéndice B". Procesamiento del lenguaje natural: una perspectiva paniniana (PDF) . Prentice-Hall de la India. págs. 191-193. ISBN 9788120309210. Recuperado el 16 de febrero de 2014 .
- ^ {{Primer y segundo simposio internacional de lingüística computacional sánscrita Rocquencourt, Francia, 29-31 de octubre de 2007 Providence, RI, EE. UU., 15-17 de mayo de 2008, artículos seleccionados revisados Editores: Huet, Gérard, Kulkarni, Amba, Scharf, Peter (Eds.) | url=https://www.springer.com/gp/book/9783642001543 ; consulte el Apéndice B}}
Enlaces externos
- Herramientas para el análisis del servidor universitario sánscrito (संसाधनी)
- Herramientas para el análisis del sánscrito (संसाधनी) Servidor en la nube
- Sitio de patrimonio sánscrito
- Utilidades en línea para aprender sánscrito
- Implementación de Python