Articulo de referencia

Escritura cirílica en Unicode

A partir de la versión 17.0 de Unicode , la escritura cirílica se codifica en varios bloques : Cirílico : U+0400–U+04FF , 256 caracteres Suplemento cirílico : U+0500–U+052F , 48...

A partir de la versión 17.0 de Unicode , la escritura cirílica se codifica en varios bloques :

Los caracteres del rango U+0400–U+045F están dispuestos en las mismas posiciones que ISO 8859-5 , pero desplazados hacia arriba 864 posiciones. Los siguientes caracteres del bloque cirílico, rango U+0460–U+0489, son letras históricas, algunas de las cuales todavía se utilizan para el eslavo eclesiástico . Los caracteres del rango U+048A–U+04FF y el bloque completo del suplemento cirílico (U+0500–U+052F) son letras adicionales para varios idiomas que se escriben con escritura cirílica . Dos caracteres se encuentran en el bloque de extensiones fonéticas: U+1D2B LETRA CIRÍLICA MAYÚSCULA MINÚSCULA EL del alfabeto fonético urálico y U+1D78 LETRA MODIFICADORA CIRÍLICA EN para transcribir vocales nasales.

Unicode incluye algunas letras cirílicas acentuadas precompuestas ; las demás se pueden combinar añadiendo U+0301 ́ COMBINACIÓN DE ACENTO AGUDO después de la vocal acentuada (por ejemplo, е́ у́ э́); véase más abajo.

Se pueden utilizar varios signos diacríticos no específicos del alfabeto cirílico con texto cirílico, entre ellos:

  • en Combinación de marcas diacríticas bloque U+0300 U+036F .
    • U+0301 ́ ACENTO AGUDO COMBINADO (como marca de acento común en cirílico).
    • U+0300 ̀ ACENTO GRAVE COMBINADO (como marca de énfasis en búlgaro).
    • U+0303 ̃ COMBINACIÓN DE LA TILDE (en lenguas no eslavas)
    • U+0304 ̄ MACRON DE COMBINACIÓN (en lenguas no eslavas)
    • U+0306 ̆ COMBINACIÓN BREVE (con й pero también con otras letras en lenguas no eslavas)
    • U+0307 ̇ PUNTO DE COMBINACIÓN ARRIBA (en transliteraciones de otros sistemas de escritura)
    • U+0308 ̈ DIÉRESIS COMBINADA (en lenguas no eslavas)
    • U+030A ̊ ANILLO DE COMBINACIÓN SUPERIOR (en idiomas no eslavos)
    • U+030B ̋ COMBINACIÓN DE ACENTO AGUDO DOBLE (en lenguas no eslavas)
    • U+030C ̌ COMBINANDO CARON (en lenguas no eslavas)
    • U+030F ̏ COMBINANDO EL ACENTO DE DOBLE GRAVE (con ѷ en la ortografía antigua)
    • U+0311 ̑ COMBINACIÓN DE BREVE INVERTIDA (en el alfabeto aleutiano del siglo XIX)
    • U+0323 ̣ PUNTO DE COMBINACIÓN DEBAJO (en transliteraciones de otros sistemas de escritura)
    • U+0328 ̨ COMBINANDO OGONEK (en alfabeto cirílico polaco del siglo XIX, en alfabeto cirílico lituano del siglo XIX) [ 1 ]
    • U+0331 ̱ COMBINANDO MACRON A CONTINUACIÓN (en transliteraciones de otros sistemas de escritura)
    • U+033E ̾ COMBINACIÓN DE LA TILDE VERTICAL (en el alfabeto cirílico polaco del siglo XIX)
  • en Combinación de marcas diacríticas para símbolos bloque U+20D0 U+20F0
    • U+20DD CÍRCULO DE ENCIERRE COMBINADO (como el signo de las decenas de millar cirílicas).

En la tabla siguiente, las letras minúsculas están ordenadas según sus números Unicode; las mayúsculas se colocan inmediatamente antes de las minúsculas correspondientes. Se incluyen los nombres Unicode estándar y las descomposiciones canónicas .

Tabla de caracteres

Bloques

El bloque cirílico (U+0400 – U+04FF) se añadió al estándar Unicode en octubre de 1991 con el lanzamiento de la versión 1.0:

El bloque del suplemento cirílico (U+0500 – U+052F) se añadió al estándar Unicode en marzo de 2002 con el lanzamiento de la versión 3.2:

Los bloques Cirílico Extendido-A (U+2DE0 – U+2DFF) y Cirílico Extendido-B (U+A640 – U+A69F) se añadieron al estándar Unicode en abril de 2008 con el lanzamiento de la versión 5.1:

El bloque de caracteres cirílicos extendidos en C (U+1C80 – U+1C8F) se añadió al estándar Unicode en junio de 2016 con el lanzamiento de la versión 9.0:

El bloque de caracteres cirílicos extendidos D (U+1E030 – U+1E08F) se añadió al estándar Unicode en septiembre de 2022 con el lanzamiento de la versión 15.0:

Véase también

Referencias

  1. Subačius, Giedrius (2008). "La letra <Ј> y la escritura cirílica lituana: dos estrategias de planificación lingüística a finales del siglo XIX". Journal of Baltic Studies . 39 (1): 73– 82. doi : 10.1080/01629770801908747 . JSTOR 43212808 . )
  • Gordana Jovanović, ed. (2009).Registro estándar de estrellas de mar y de registro único[ Estandarización del alfabeto cirílico del antiguo eslavo eclesiástico y su registro en Unicode ] (PDF) . Vol.  CXXV (  ed. Reuniones científicas). Belgrado: Academia Serbia de Ciencias y Artes . ISBN 978-86-7025-494-7. Archivado del original (PDF) el 18-03-2012 . Consultado el 07-08-2011 .