Articulo de referencia

Notación WX

Disposición del teclado en hindi (WX) de Ubuntu La notación WX es un esquema de transliteración para representar idiomas indios en ASCII . Este esquema se originó en IIT Kanpur ...

Disposición del teclado en hindi (WX) de Ubuntu
Disposición del teclado en hindi (WX) de Ubuntu

La notación WX es un esquema de transliteración para representar idiomas indios en ASCII . Este esquema se originó en IIT Kanpur para el procesamiento computacional de idiomas indios, y es ampliamente utilizado entre la comunidad de procesamiento de lenguaje natural (NLP) en India. La notación (aunque no identificada) se utiliza, por ejemplo, en un libro de texto sobre NLP de IIT Kanpur. [1] Las características sobresalientes de este esquema de transliteración son: Cada consonante y cada vocal tiene una única asignación al alfabeto latino. Por lo tanto, es un código de prefijo, [2] ventajoso desde un punto de vista computacional. Por lo general, las letras minúsculas se utilizan para consonantes no aspiradas y vocales cortas, mientras que las letras mayúsculas se utilizan para consonantes aspiradas y vocales largas. Mientras que las consonantes sordas y sonoras retroflexionadas se asignan a 't, T, d y D', las dentales se asignan a 'w, W, x y X'. De ahí el nombre del esquema "WX", que hace referencia a la asignación idiosincrásica. Ubuntu Linux proporciona soporte de teclado para la notación WX.

En las siguientes tablas, se destacan en negrita las asignaciones idiosincrásicas de letras a fonemas con los que normalmente no están asociadas. Además de 'w', 'W', 'x' y 'X', se incluyen 'f', 'F', 'q', 'Q', 'L' y 'R'.

Vocales

Sonorantes

Anusvara y visarga

El Anunasika se representa con la letra "z". Por ejemplo, अँ = az. En sánscrito, el Avagraha se representa con la letra "Z". Por ejemplo, वमतोऽन्तः = vamawoZnwaH. Esto puede causar confusión, ya que la "Z" también se utiliza con otro propósito en el caso de otras lenguas índicas (véase más abajo, último párrafo).

Consonantes

Este esquema se amplió aún más para representar todas las escrituras indias derivadas del brahmi. Para tener en cuenta los caracteres de otros idiomas indios que faltan en el devanagari, se utilizan tres operadores: 'Y' para obtener el siguiente carácter ISCII , 'V' para obtener el carácter ISCII anterior y 'Z' para añadir el nuqta . Así, por ejemplo, 'l' representa ल (U0932) del devanagari y 'lY' representa ळ (U0933) en maratí. 'e' representa ए (U090F) del devanagari o ఏ (U0C0F) del telugu y eV representa ऎ (U090E) o ఎ (U0C0E) del telugu. De forma similar, 'ka' representa क del devanagari y 'kZa' representa क़.

Véase también

Referencias

  1. ^ Akshar Bharati; Vineet Chaitanya; Rajeev Sangal (1996). "Apéndice B". Procesamiento del lenguaje natural: una perspectiva paniniana (PDF) . Prentice-Hall de la India. págs. 191-193. ISBN 9788120309210. Recuperado el 16 de febrero de 2014 .
  2. ^ {{Primer y segundo simposio internacional de lingüística computacional sánscrita Rocquencourt, Francia, 29-31 de octubre de 2007 Providence, RI, EE. UU., 15-17 de mayo de 2008, artículos seleccionados revisados ​​Editores: Huet, Gérard, Kulkarni, Amba, Scharf, Peter (Eds.) | url=https://www.springer.com/gp/book/9783642001543 ; consulte el Apéndice B}}
  • Herramientas para el análisis del servidor universitario sánscrito (संसाधनी)
  • Herramientas para el análisis del sánscrito (संसाधनी) Servidor en la nube
  • Sitio de patrimonio sánscrito
  • Utilidades en línea para aprender sánscrito
  • Implementación de Python
Retrieved from "https://en.wikipedia.org/w/index.php?title=WX_notation&oldid=1242057773"