Articulo de referencia

ISO/IEC 8859-2

ISO/IEC 8859-2:1999 , Tecnología de la información — Conjuntos de caracteres gráficos codificados de un solo byte de 8 bits — Parte 2: Alfabeto latino n.° 2 , forma parte de la ...

ISO/IEC 8859-2:1999 , Tecnología de la información — Conjuntos de caracteres gráficos codificados de un solo byte de 8 bits — Parte 2: Alfabeto latino n.° 2 , forma parte de la serie ISO/IEC 8859 de codificaciones de caracteres estándar basadas en ASCII , cuya primera edición se publicó en 1987. Se la conoce informalmente como «Latin-2». Generalmente está destinada a lenguas de Europa Central [ 1 ] o «Europa del Este» que se escriben en alfabeto latino. Nótese que ISO/IEC 8859-2 es muy diferente de la página de códigos 852 (MS-DOS Latin 2, PC Latin 2), que también se conoce como «Latin-2» en las regiones checa y eslovaca. [ 2 ] Casi la mitad del uso de la codificación es para el polaco, y es la principal codificación heredada para el polaco, mientras que prácticamente todo su uso ha sido reemplazado por UTF-8 (en la web).

ISO-8859-2 es el nombre de conjunto de caracteres preferido por IANA para este estándar cuando se complementa con los códigos de control C0 y C1 de ISO/IEC 6429. Menos del 0,04 % de todas las páginas web utilizan ISO-8859-2 a octubre de 2022. [ 3 ] [ 4 ] Microsoft ha asignado la página de códigos 28592, también conocida como Windows-28592, a ISO-8859-2 en Windows. IBM asignó la página de códigos 912 a ISO 8859-2, [ 5 ] hasta que esa página de códigos se extendió en 1999. [ 6 ] La página de códigos 1111 es similar, pero reemplaza el byte B0 ° (signo de grado) con U+02DA ˚ (anillo arriba).

Windows-1250 es similar a ISO-8859-2 y contiene todos los caracteres imprimibles que tiene, e incluso más. Sin embargo, algunos de ellos están reorganizados (a diferencia de Windows-1252 , que mantiene todos los caracteres imprimibles de ISO-8859-1 en la misma posición).

Cobertura lingüística

Estos valores de código se pueden utilizar para los siguientes idiomas:

  1. La letra Å que falta forma parte oficialmente del alfabeto finlandés , sin embargo, no tiene un uso nativo y su uso se limita únicamente a nombres extranjeros.
  2. En 2017, el Consejo de Ortografía Alemana añadió oficialmente una mayúscula , pero en realidad no es necesaria ya que se puede usar SS en su lugar.
  3. Este conjunto de caracteres unifica Ș y Ț (S, T con comas debajo) con Ş y Ţ (S, T con cedillas ), al igual que prácticamente todos los demás conjuntos de caracteres, incluidos Windows-1250 de Microsoft y la primera versión de Unicode . Sin embargo, Unicode posteriormente los desunificó, lo que complica el procesamiento de datos rumanos, ya que los datos y métodos de entrada preexistentes aún contienen los puntos de código de cedilla antiguos.

Diseño de página de código

Las diferencias con respecto a ISO-8859-1 tienen el número de punto de código Unicode debajo.

Véase también

Referencias

  1. "Codificaciones de mensajes de Microsoft Outlook" . 10 de enero de 2017.
  2. "Se explica el caos en la codificación de caracteres checos y eslovacos" . luki.sdf-eu.org . Consultado el 27 de febrero de 2022 .
  3. "Estadísticas de uso y cuota de mercado de ISO-8859-2 para sitios web, octubre de 2022" . w3techs.com . Consultado el 23 de octubre de 2022 .
  4. "Tendencias históricas en las estadísticas de uso de codificaciones de caracteres para sitios web, febrero de 2022" .
  5. "Icu-data/Charset/Data/XML/Ibm-912_P100-1995.XML en main · unicode-org/Icu-data" . GitHub .
  6. "Icu-data/Charset/Data/Ucm/Ibm-912_P100-1999.ucm en main · unicode-org/Icu-data" . GitHub .
  • ISO/IEC 8859-2:1999
  • Estándar ECMA-94 : Conjuntos de caracteres gráficos codificados en un solo byte de 8 bits - Alfabetos latinos n.° 1 a n.° 4, 2.ª edición (junio de 1986)
  • ISO-IR 101 Parte derecha del alfabeto latino n.º 2 (1 de febrero de 1986)
  • Recursos ISO 8859-2 (Latín 2)
Obtenido de " https://en.wikipedia.org/w/index.php?title=ISO/IEC_8859-2&oldid=1334893082 "