ISO/IEC 8859-15:1999 , Tecnología de la información — Conjuntos de caracteres gráficos codificados de un solo byte de 8 bits — Parte 15: Alfabeto latino n.º 9 , forma parte de la serie ISO/IEC 8859 de codificaciones de caracteres estándar basadas en ASCII , cuya primera edición se publicó en 1999. Se la conoce informalmente como Latin-9 (y durante un tiempo como Latin-0 ). Es similar a ISO 8859-1 y, por lo tanto, también está destinada a lenguas de Europa occidental, pero reemplaza algunos símbolos menos comunes con el símbolo del euro y algunas letras que se consideraron necesarias. [ 1 ]
ISO-8859-15 es el nombre de conjunto de caracteres preferido por IANA para este estándar cuando se complementa con los códigos de control C0 y C1 de ISO/IEC 6429 .
Microsoft ha asignado la página de códigos 28605, también conocida como Windows-28605, a ISO-8859-15. IBM ha asignado la página de códigos 923 ( CCSID 923) a ISO 8859-15. [ 2 ] [ 3 ]
Todos los caracteres imprimibles de ISO/IEC 8859-1 e ISO/IEC 8859-15 también se encuentran en Windows-1252 . Desde octubre de 2016, menos del 0,1 % (actualmente menos del 0,02 %) de todos los sitios web utilizan ISO-8859-15. [ 4 ] [ 5 ]
Historia
El identificador ISO 8859-15 fue propuesto para las lenguas sami en 1996, el cual finalmente fue rechazado, pero fue aprobado como ISO-IR 197. [ 6 ] [ 7 ] [ 8 ]
La ISO 8859-16 se propuso como una codificación similar a la actual ISO 8859-15, para reemplazar 11 caracteres de la ISO 8859-1 que no se usaban o se usaban raramente con los caracteres franceses faltantes Œ œ (en la misma posición que en DEC-MCS y Lotus International Character Set ) y Ÿ (que no estaba en la misma posición que en estos conjuntos, ya que Ý estaba en esa posición para el islandés), el neerlandés IJ ij y el turco Ğ ğ İ ı Ş ş. El símbolo del euro no existía en ese momento. [ 9 ]
El borrador era el siguiente:
El nombre se cambió posteriormente a ISO-8859-0 y se reestructuró en 1997. Se eliminaron los caracteres turcos porque se consideró que potencialmente harían más daño a la práctica turca entonces vigente mientras la implementación de UCS (Unicode) no estaba tan lejos, y la ligadura IJ holandesa se eliminó ya que se encontró que el dígrafo ij existente era adecuado. También se consideró agregar los galeses Ŵ ŵ y Ŷ ŷ, pero eso se pospuso a la espera de una investigación más profunda. 4 caracteres ISO 8859-1 no utilizados o poco utilizados ( ¤ , ¨ , ´ , y ¸ ) fueron reemplazados por € , Ÿ , Œ , y œ respectivamente. [ 10 ] € se hizo necesario cuando se introdujo el euro . Ÿ es necesario para que el texto francés se pueda convertir de minúsculas a mayúsculas y viceversa sin pérdida, y Œ y œ son ligaduras francesas. Irónicamente, los tres últimos ya estaban presentes en el Conjunto de Caracteres Multinacionales (MCS) de DEC en 1983, un conjunto de caracteres del que se derivaron ECMA-94 (1985) e ISO-8859-1 (1987). Dado que sus puntos de código originales ahora estaban ocupados por otros caracteres, hubo que elegir puntos de código menos lógicos para su reintroducción.
La misma propuesta también recomendaba reemplazar otros 6 caracteres ( ¢ , ¦ , ± , ¼ , ½ , ¾ ) con "otros caracteres para abarcar el mayor número posible de idiomas". Las razones para elegir estos caracteres se indicaban en la propuesta. [ 10 ] Para el símbolo del euro, algunos querían reemplazar el signo más-menos en lugar del símbolo de moneda. El símbolo de moneda se utiliza en algunas aplicaciones como separador de campos y en otras para indicar subtotal . Hubo una fuerte oposición a esto. Una persona dijo: "El '+-' propuesto no es una alternativa adecuada, ya que esta secuencia, aunque rara vez se usa, ya tiene un significado matemático fijo, bastante diferente de '±'; e incluso si un lector dedujera el significado previsto, '±', del contexto, '+-' en lugar de '±' herirá los sentimientos estéticos de un físico al menos tanto como 'oe' en lugar de una ligadura oe a un francófono". [ 11 ] Al final, se mantuvo ± y se eliminó ¤ (como se planeó originalmente).
Hacia 1997/1998 (cuando se actualizó Windows-1252 ) se seleccionaron cuatro caracteres: Š , š , Ž y ž , que se utilizan en finlandés y estonio para la transliteración de préstamos y nombres rusos . La propuesta se renombró como ISO 8859-15 al mismo tiempo. Finalmente, se eliminaron los caracteres ¦ , ¼ , ½ y ¾ , mientras que se mantuvo ¢ por ser más común que los otros cuatro.
Se intentó convertir ISO 8859-15 en el conjunto de caracteres predeterminado para la comunicación de 8 bits, pero nunca logró reemplazar al popular ISO 8859-1. Sí se utilizó como conjunto de caracteres predeterminado para la consola de texto y los programas de terminal en Linux cuando se necesitaba el símbolo del euro, pero el uso de Unicode completo no era práctico, y desde entonces se ha sustituido por UTF-8 .
Cobertura
La norma ISO 8859-15 codifica lo que denomina « alfabeto latino n.º 9». Este conjunto de caracteres se utiliza en toda América , Europa occidental , Oceanía y gran parte de África . También se emplea habitualmente en la mayoría de las romanizaciones estándar de lenguas de Asia oriental.
Cada carácter se codifica como un único valor de código de ocho bits. Estos valores de código se pueden utilizar en casi cualquier sistema de intercambio de datos para comunicarse en los siguientes idiomas:
Notas
- ↑ Soporte completo excepto para Ǿ/ǿ, que faltan. Ǿ/ǿ se pueden reemplazar por Ø/ø a costa de una mayor ambigüedad.
- ↑ Generalmente se admite con una cobertura casi completa del alfabeto holandés, ya que las letras faltantes IJ y ij siempre deben representarse como IJ o ij de dos caracteres en formato electrónico.
- ↑ Estados Unidos y Gran Bretaña moderna
- ↑ Compatibilidad total excepto con la letra mayúscula ẞ , que no fue adoptada oficialmente por el Consejo de Ortografía Alemana hasta 2017.
- ↑ Nueva ortografía
- 1 2 Ortografía clásica básica
- ↑ Escritura de Rumi
- ↑ Bokmål y Nynorsk
- ↑ Europeo y brasileño
Cobertura de signos de puntuación y apóstrofes
Para algunos de los idiomas mencionados anteriormente, faltan las comillas tipográficas correctas, ya que solo se incluyen «, », ", y '.
Además, esta codificación no proporciona el carácter correcto para el apóstrofo y las comillas simples altas orientadas, aunque algunos textos utilizan el acento grave espaciado y el acento agudo espaciado, que forman parte de la norma ISO 8859-1, en lugar de las comillas o apóstrofos en forma de 6/9 (y esto funciona de forma fiable con algunos estilos de fuente, donde todos estos caracteres se muestran como glifos de cuña inclinados).
Diseño de página de código
Las diferencias con respecto a ISO-8859-1 se manifiestan cuando el punto de código Unicode se muestra debajo del carácter.
Alias
La norma ISO 8859-15 también tiene los siguientes alias específicos del proveedor:
- WE8ISO8859P15 ( base de datos Oracle ) [ 15 ]
Véase también
- Conjuntos de caracteres latinos occidentales (informática)
- Subconjunto Unicode DIN 91379 para Europa
Referencias
- ↑ "ISO-8859-15" . IANA . Consultado el 8 de marzo de 2016 .
- ↑ "Documento informativo de la página 923 del código" . Archivado del original el 28 de febrero de 2013.
- ↑ "Documento informativo CCSID 923" . Archivado del original el 1 de diciembre de 2014.
- ↑ "Tendencias históricas en el uso de codificaciones de caracteres, noviembre de 2018" . w3techs.com .
- ↑ "Preguntas frecuentes" . w3techs.com .
- ↑ TIEKE en representación de la Asociación Finlandesa de Normalización SFS (1999-12-07). Conjunto suplementario latino sami n.º 2 (PDF) . ITSCJ/ IPSJ . ISO-IR -209.
- ↑ Everson, Michael. "Propuesta ISO 8859-15" . Consultado el 26 de febrero de 2017 .
- ↑ Everson, Michael. "Propuesta ISO 8859-14 (posteriormente 15)" . Consultado el 26 de febrero de 2017 .
- ↑ Everson, Michael. "Propuesta ISO 8859-16" . Consultado el 26 de febrero de 2017 .
- 1 2 Everson, Michael. "Propuesta ISO 8859-0 (posteriormente 15)" . Recuperado el 26 de febrero de 2017 .
- ↑ Stolz, Otto (11 de julio de 1997). "Re: Nuevo borrador ISO 8859-0" . Lista de correo Unicode (Lista de correo).
- ↑ Página de códigos CPGID 00923 (pdf) (PDF) , IBM
- ↑ Página de códigos CPGID 00923 (txt) , IBM
- ↑ Componentes internacionales para Unicode (ICU), ibm-923_P100-1998.ucm , 3 de diciembre de 2002
- ↑ Baird, Cathy; Chiba, Dan; Chu, Winson; Fan, Jessica; Ho, Claire; Law, Simon; Lee, Geoff; Linsley, Peter; Matsuda, Keni; Oscroft, Tamzin; Takeda, Shige; Tanaka, Linus; Tozawa, Makoto; Trute, Barry; Tsujimoto, Mayumi; Wu, Ying; Yau, Michael; Yu, Tim; Wang, Chao; Wong, Simon; Zhang, Weiran; Zheng, Lei; Zhu, Yan; Moore, Valarie (2002) [1996]. "Apéndice A: Datos de localización". Guía de soporte de globalización de la base de datos Oracle9i (PDF) (ed. Versión 2 (9.2) ). Oracle Corporation . Oracle A96529-01. Archivado (PDF) del original el 14 de febrero de 2017. Recuperado el 14 de febrero de 2017 .
Enlaces externos
- ISO/IEC 8859-15:1999 - Conjuntos de caracteres gráficos codificados de un solo byte de 8 bits, Parte 15: Alfabeto latino n.º 9 (publicado el 15 de marzo de 1999)
- ISO/IEC 8859-15 (borrador final del comité, con fecha del 1 de agosto de 1997)
- ISO Latin 9 en comparación con ISO Latin 1
- ISO-IR 203 Conjunto suplementario europeo en latín (16 de septiembre de 1998)
- ISO/IEC 8859
- Introducciones relacionadas con la informática en 1998