Articulo de referencia

Formatos de media anchura y anchura completa

Un símbolo del sistema ( cmd.exe ) con localización coreana, que muestra caracteres de ancho medio y ancho completo. En la informática CJK (chino, japonés y coreano), los caract...

Un símbolo del sistema ( cmd.exe ) con localización coreana, que muestra caracteres de ancho medio y ancho completo.

En la informática CJK (chino, japonés y coreano), los caracteres gráficos se clasifican tradicionalmente en caracteres de ancho completo [ a ] y de ancho medio [ b ] . A diferencia de las fuentes monoespaciadas , un carácter de ancho medio ocupa la mitad del ancho de un carácter de ancho completo, de ahí su nombre.

Las formas de ancho medio y ancho completo también son el nombre de un bloque Unicode U+FF00 FFEF, que se proporciona para que las codificaciones más antiguas que contienen caracteres de ancho medio y ancho completo puedan tener una traducción sin pérdidas hacia y desde Unicode.

Razón fundamental

Los caracteres que aparecen tanto en JIS X 0201 (un byte) como en JIS X 0208 / JIS X 0213 (doble byte) tienen una forma de ancho medio y una forma de ancho completo en Shift JIS .

En la época de la informática basada en texto , los caracteres occidentales se disponían normalmente en una cuadrícula en la pantalla, a menudo de 80 columnas por 24 o 25 líneas. Cada carácter se mostraba como una pequeña matriz de puntos , generalmente de unos 8 píxeles de ancho, y se utilizaba un SBCS (conjunto de caracteres de un solo byte) para codificar los caracteres de las lenguas occidentales.

Por razones estéticas y de legibilidad, es preferible que los caracteres chinos tengan una forma aproximadamente cuadrada, es decir, el doble de ancho que los caracteres SBCS de ancho fijo. Dado que estos últimos se codificaban normalmente en un DBCS (conjunto de caracteres de doble byte), su ancho en pantalla, en una fuente de doble espacio, era proporcional a su longitud en bytes. Algunos terminales y programas de edición no podían procesar caracteres de doble byte que comenzaran en columnas impares, solo en las pares (algunos ni siquiera podían colocar caracteres de doble byte y de un solo byte en la misma línea). Por lo tanto, los conjuntos DBCS generalmente incluían también caracteres romanos y dígitos, para su uso junto con los caracteres CJK en la misma línea.

Por otro lado, la informática japonesa temprana utilizaba una página de códigos de un solo byte llamada JIS X 0201 para katakana . Estos se representaban con el mismo ancho que los demás caracteres de un solo byte, convirtiéndolos en caracteres kana de ancho reducido en lugar de kana con proporciones normales. Aunque el estándar JIS X 0201 en sí no especificaba la visualización de ancho reducido para katakana, esta se convirtió en la característica visual distintiva en Shift JIS entre el katakana de un solo byte JIS X 0201 y el katakana de doble byte JIS X 0208. Algunas páginas de códigos de IBM utilizaban un tratamiento similar para el jamo coreano , [ 1 ] basado en el código Hangul de N bytes y su traducción EBCDIC .

En Unicode

Para garantizar la compatibilidad con los conjuntos de caracteres existentes que contenían versiones de ancho medio y ancho completo del mismo carácter, Unicode asignó un único bloque en U+FF00 FFEF que contiene los caracteres de "ancho alternativo" necesarios. Esto incluye una versión de ancho completo de todos los caracteres ASCII y algunos signos de puntuación no ASCII, como el símbolo del yen, versiones de ancho medio de katakana y hangul , y versiones de ancho medio de otros símbolos, como los círculos. Solo se asignaron los caracteres necesarios para una conversión sin pérdidas a los conjuntos de caracteres existentes, en lugar de (por ejemplo) crear una versión de ancho completo de cada carácter latino acentuado.

Unicode asigna a cada punto de código una East_Asian_Widthpropiedad . Esta puede ser: [ 2 ]

Ejemplos de la propiedad Unicode East_Asian_Width. F, H y W generalmente solo se utilizan en escrituras de Asia Oriental.

Los emuladores de terminal pueden usar esta propiedad para decidir si un carácter debe ocupar una o dos "columnas" al calcular las tabulaciones y la posición del cursor.

En OpenType

OpenType tiene las etiquetas de características fwid, halt, hwid, y vhalque se utilizan para reproducir la forma de ancho completo o medio ancho de un carácter. CSS proporciona control sobre estas características mediante las propiedades font-variant-east-asiany font-feature-settings. [ 3 ]

Véase también

Notas

Referencias

  1. "Demostración de ICU - Explorador de convertidores" . demo.icu-project.org . Consultado el 7 de mayo de 2018 .
  2. Lunde, Ken (2019-01-25). "Anexo estándar Unicode® n.º 11: Ancho de Asia Oriental" . Consorcio Unicode .
  3. "Sintaxis para las características OpenType en CSS" . Adobe . Consultado el 20 de septiembre de 2023 .
  • Ancho de Asia Oriental Estándar Unicode Anexo n.° 11