La codificación Cork (también conocida como T1 o EC ) es una codificación de caracteres utilizada para codificar glifos en fuentes . [ 1 ] Recibe su nombre de la ciudad de Cork en Irlanda , donde durante una conferencia del Grupo de Usuarios de TeX (TUG) en 1990 se introdujo una nueva codificación para LaTeX . [ 1 ] Contiene 256 caracteres que admiten la mayoría de las lenguas de Europa occidental y oriental con el alfabeto latino . [ 2 ]
Detalles
En los motores TeX de 8 bits , la codificación de la fuente debe coincidir con la codificación de los patrones de división de palabras donde esta codificación se usa con mayor frecuencia. [ 3 ] En LaTeX se puede cambiar a esta codificación con \usepackage[T1]{fontenc}, mientras que en ConTeXt MkII esta ya es la codificación predeterminada. En motores modernos como XeTeX y LuaTeX, Unicode es totalmente compatible y las codificaciones de fuente de 8 bits están obsoletas.
Conjunto de caracteres
Notas
- Los valores hexadecimales que aparecen debajo de los caracteres en la tabla son los códigos de caracteres Unicode.
- Los primeros 12 caracteres se utilizan a menudo como caracteres combinatorios .
- ↑ 0x17 se denomina “marca de palabra compuesta” (CWM) en la codificación Cork, y es una innovación de este estándar. Es un carácter invisible que separa compuestos en una palabra compleja, por ejemplo en alemán, para impedir ligaduras estéticas en los límites de los compuestos. [ 2 ] Se asigna al “ espacio de ancho cero ” (ZWSP, U+200B) de Unicode, definido casi al mismo tiempo, cuyo propósito es similar, si no idéntico.
- ↑ 0x18 es una “o minúscula”, que se utiliza para componer ‰ o ‱ (o cantidades arbitrariamente menores) a partir del signo de porcentaje (%). [ 2 ]
- 1 2 La i sin punto y la j sin punto pueden usarse para componer variantes acentuadas como la i con macrón (ī) .
- ↑ 0x7F es el carácter de división de palabras, no realmente un guion suave (SHY) como lo define Unicode.
- ↑ 0xD0 se usa tanto como Eth (Ð, U+00D0) como D con trazo (Đ, U+0110), lo que podría ser un problema en algunas ocasiones (como copiar texto de un PDF, división de palabras, ...).
- ↑ 0xDF contiene una variante en mayúscula de ß. Tradicionalmente, era SS (dos letras S ), pero algunas fuentes más recientes pueden usar ẞ. [ 4 ] Permite que TeX convierta automáticamente la ß minúscula alemana a su forma en mayúscula.
Idiomas compatibles
La codificación admite la mayoría de los idiomas europeos escritos en alfabeto latino. Las excepciones notables son:
- Idiomas esperanto y maltés (usando IL3)
- Idioma letón e idioma lituano (usando L7X)
- idioma galés
Entre los idiomas con soporte ligeramente subóptimo se incluyen:
- Idioma gallego , idioma portugués e idioma español – debido a la falta de los caracteres ª y º , que no son versiones en superíndice de las minúsculas "a" y "o" (los superíndices son más delgados) y a menudo están subrayados
- Idioma croata , idioma bosnio , idioma serbio – debido al uso compartido de la ranura para Đ
- Idioma turco : debido a que la i sin punto tiene combinaciones de mayúsculas y minúsculas diferentes a las de otros idiomas.
- Idioma rumano – debido a que los caracteres "Ş ş Ţ ţ" (con una cedilla) se consideran tipográficamente incorrectos según los estándares modernos [ 5 ] [ 6 ] , siendo las formas correctas esperadas "Ș ș Ț ț" [ 7 ] (con una coma debajo) - aunque cuando se desarrolló la codificación, se podría decir que se consideraba aceptable en ese momento, pero el estado de soporte cambió retroactivamente a subóptimo o insuficiente cuando se desunificaron los puntos de código Unicode.
Referencias
- 1 2 Petrlik, Lukas (1996-06-19). "El lío de la codificación de caracteres checos y eslovacos explicado" . cs-encodings-faq . 1.10. Archivado del original el 21-06-2016 . Recuperado el 21-06-2016 .
- 1 2 3 Ferguson, Michael (1990), "Informe sobre actividades multilingües" (PDF) , TUGboat , 11 ( 4): 514–516
- ↑ Patrones de división de palabras en TeX
- ↑ https://tex.stackexchange.com/questions/754903/how-to-make-the-letter-%e1%ba%9e-in-latex
- ↑ https://typedrawers.com/discussion/318/tcomma-and-tcedilla
- ↑ https://www.oxygenxml.com/forum/other-issues/topic25658.html
- ↑ https://tex.stackexchange.com/questions/347629/issue-with-diacritics-in-romanian-language-document/347645#347645
Enlaces externos
- Archivo de codificación
- Descripción general de las codificaciones en LaTeX
- Codificación de caracteres
- Conjuntos de caracteres
- Texas