Articulo de referencia

Codificación de corcho

La codificación Cork (también conocida como T1 o EC ) es una codificación de caracteres utilizada para codificar glifos en fuentes . [ 1 ] Recibe su nombre de la ciudad de Cork ...

La codificación Cork (también conocida como T1 o EC ) es una codificación de caracteres utilizada para codificar glifos en fuentes . [ 1 ] Recibe su nombre de la ciudad de Cork en Irlanda , donde durante una conferencia del Grupo de Usuarios de TeX (TUG) en 1990 se introdujo una nueva codificación para LaTeX . [ 1 ] Contiene 256 caracteres que admiten la mayoría de las lenguas de Europa occidental y oriental con el alfabeto latino . [ 2 ]

Detalles

En los motores TeX de 8 bits , la codificación de la fuente debe coincidir con la codificación de los patrones de división de palabras donde esta codificación se usa con mayor frecuencia. [ 3 ] En LaTeX se puede cambiar a esta codificación con \usepackage[T1]{fontenc}, mientras que en ConTeXt MkII esta ya es la codificación predeterminada. En motores modernos como XeTeX y LuaTeX, Unicode es totalmente compatible y las codificaciones de fuente de 8 bits están obsoletas.

Conjunto de caracteres

Notas

  • Los valores hexadecimales que aparecen debajo de los caracteres en la tabla son los códigos de caracteres Unicode.
  • Los primeros 12 caracteres se utilizan a menudo como caracteres combinatorios .
  1. 0x17 se denomina “marca de palabra compuesta” (CWM) en la codificación Cork, y es una innovación de este estándar. Es un carácter invisible que separa compuestos en una palabra compleja, por ejemplo en alemán, para impedir ligaduras estéticas en los límites de los compuestos. [ 2 ] Se asigna al “ espacio de ancho cero ” (ZWSP, U+200B) de Unicode, definido casi al mismo tiempo, cuyo propósito es similar, si no idéntico.
  2. 0x18 es una “o minúscula”, que se utiliza para componer o (o cantidades arbitrariamente menores) a partir del signo de porcentaje (%). [ 2 ]
  3. 1 2 La i sin punto y la j sin punto pueden usarse para componer variantes acentuadas como la i con macrón (ī) .
  4. 0x7F es el carácter de división de palabras, no realmente un guion suave (SHY) como lo define Unicode.
  5. 0xD0 se usa tanto como Eth (Ð, U+00D0) como D con trazo (Đ, U+0110), lo que podría ser un problema en algunas ocasiones (como copiar texto de un PDF, división de palabras, ...).
  6. 0xDF contiene una variante en mayúscula de ß. Tradicionalmente, era SS (dos letras S ), pero algunas fuentes más recientes pueden usar ẞ. [ 4 ] Permite que TeX convierta automáticamente la ß minúscula alemana a su forma en mayúscula.

Idiomas compatibles

La codificación admite la mayoría de los idiomas europeos escritos en alfabeto latino. Las excepciones notables son:

Entre los idiomas con soporte ligeramente subóptimo se incluyen:

  • Idioma gallego , idioma portugués e idioma español – debido a la falta de los caracteres ª y º , que no son versiones en superíndice de las minúsculas "a" y "o" (los superíndices son más delgados) y a menudo están subrayados
  • Idioma croata , idioma bosnio , idioma serbio – debido al uso compartido de la ranura para Đ
  • Idioma turco : debido a que la i sin punto tiene combinaciones de mayúsculas y minúsculas diferentes a las de otros idiomas.
  • Idioma rumano – debido a que los caracteres "Ş ş Ţ ţ" (con una cedilla) se consideran tipográficamente incorrectos según los estándares modernos [ 5 ] [ 6 ] , siendo las formas correctas esperadas "Ș ș Ț ț" [ 7 ] (con una coma debajo) - aunque cuando se desarrolló la codificación, se podría decir que se consideraba aceptable en ese momento, pero el estado de soporte cambió retroactivamente a subóptimo o insuficiente cuando se desunificaron los puntos de código Unicode.

Referencias

  1. 1 2 Petrlik, Lukas (1996-06-19). "El lío de la codificación de caracteres checos y eslovacos explicado" . cs-encodings-faq . 1.10. Archivado del original el 21-06-2016 . Recuperado el 21-06-2016 .
  2. 1 2 3 Ferguson, Michael (1990), "Informe sobre actividades multilingües" (PDF) , TUGboat , 11 ( 4): 514–516
  3. Patrones de división de palabras en TeX
  4. https://tex.stackexchange.com/questions/754903/how-to-make-the-letter-%e1%ba%9e-in-latex
  5. https://typedrawers.com/discussion/318/tcomma-and-tcedilla
  6. https://www.oxygenxml.com/forum/other-issues/topic25658.html
  7. https://tex.stackexchange.com/questions/347629/issue-with-diacritics-in-romanian-language-document/347645#347645
  • Archivo de codificación
  • Descripción general de las codificaciones en LaTeX
Obtenido de " https://en.wikipedia.org/w/index.php?title=Cork_encoding&oldid=1352541083 "