Articulo de referencia

GB 18030

{{notelist}} "}},"i":0}}]}"> GB 18030 es un estándar del gobierno chino , descrito como Tecnología de la Información: conjunto de caracteres codificados en chino , y define el i...

GB 18030 es un estándar del gobierno chino , descrito como Tecnología de la Información: conjunto de caracteres codificados en chino , y define el idioma y la compatibilidad de caracteres necesarios para el software en China . GB18030 es el nombre registrado en Internet para el conjunto de caracteres oficial de la República Popular China (RPC), que reemplaza a GB2312 . [ 1 ] Como formato de transformación Unicode [ a ] ​​(es decir, una codificación de todos los puntos de código Unicode ), GB18030 admite caracteres chinos simplificados y tradicionales . También es compatible con codificaciones heredadas, incluidas GB/T 2312 , CP936 , [ b ] y GBK 1.0. 

El Consorcio Unicode ha advertido a los implementadores que la última versión de este estándar chino, GB  18030-2022 , introduce lo que describen como "cambios disruptivos" con respecto a la versión anterior GB  18030-2005, "que involucran 33 caracteres diferentes y 55 posiciones de código". [ 2 ] GB  18030-2022 se implementó a partir del 1 de agosto de 2023. [ 3 ] Se ha implementado en ICU 73.2; y en Java 21, [ 4 ] y se ha adaptado a versiones anteriores de Java 8, 11, 17 (versiones LTS) y 20.0.2. [ 5 ]

Además del método de codificación, esta norma contiene requisitos sobre qué escrituras e idiomas adicionales deben representarse y a quién se aplica esta norma. [ 6 ] Sin embargo, esta norma no define las formas oficiales de los caracteres chinos; esto se estandariza en la Lista de caracteres chinos estándar de uso común .

Historia

El conjunto de caracteres GB18030 se denomina formalmente "Estándar Nacional Chino GB  18030-2005: Tecnología de la Información - Conjunto de caracteres codificados en chino". GB es la abreviatura de Guójiā Biāozhǔn (国家标准), que significa estándar nacional en chino. El estándar fue publicado por China Standard Press, Pekín, el 8 de noviembre de 2005. Solo una parte del estándar es obligatoria. [ 6 ] Desde el 1 de mayo de 2006, la compatibilidad con el subconjunto obligatorio es oficialmente requerida para todos los productos de software vendidos en la República Popular China.

Una versión anterior del estándar, conocida como "Estándar Nacional Chino GB  18030-2000: Tecnología de la Información: Conjunto de caracteres codificados mediante ideogramas chinos para el intercambio de información: Extensión del conjunto básico", se publicó el 17 de marzo de 2000. El esquema de codificación se mantiene igual en la nueva versión, y la única diferencia en la asignación de GB a Unicode es que GB  18030-2000 asignaba el carácter A8 BC(ḿ) a un punto de código de uso privado U+E7C7, y el carácter 81 35 F4 37(sin especificar ningún glifo) a U+1E3F (ḿ), mientras que GB  18030-2005 intercambia estas dos asignaciones. [ 7 ] : 534 Ahora se asocian más puntos de código con caracteres debido a la actualización de Unicode , especialmente la aparición de la extensión B de ideogramas unificados CJK. También se han añadido algunos caracteres utilizados por minorías étnicas en China , como caracteres mongoles y caracteres tibetanos ( GB 16959 -1997 y GB/T 20542 -2006), lo que explica el cambio de nombre del estándar.

En comparación con sus predecesores, la asignación de GB 18030 a Unicode se ha modificado para los 81 caracteres que se asignaron provisionalmente a un punto de código de Área de Uso Privado Unicode (U+E000–F8FF) en GBK 1.0 y que posteriormente se codificaron en Unicode. [ 8 ] Esto se especifica en el Apéndice E de GB  18030. [ 7 ] : 534 [ 9 ] : 499 Hay 24 caracteres en GB  18030-2005 que todavía se asignan a Unicode PUA. [ 10 ]

En la  actualización GB 18030-2022, se eliminaron por completo los requisitos para que los caracteres se asignaran a PUA y todos los caracteres deben asignarse a sus puntos de código Unicode estándar. De estos, 18 asignaciones se actualizaron mediante un intercambio de posiciones similar al que ocurrió entre GBK y GB 18030. Las seis restantes mantuvieron las asignaciones PUA de dos bytes, por lo que se necesita un cambio a la secuencia de 4 bytes para seguir la preferencia sin PUA. [ 11 ]

Como estándar nacional

La primera versión de GB  18030, designada GB  18030-2000 Tecnología de la información: conjunto de caracteres codificados chinos para el intercambio de información: extensión para el conjunto básico , consta de codificaciones de 1 byte y 2 bytes, junto con una codificación de 4 bytes para la extensión A de ideogramas unificados CJK que coincide con las de Unicode 3.0. Los puntos de código Unicode correspondientes de este subconjunto, incluidas las asignaciones privadas provisionales, se encuentran completamente en el BMP . Estas partes son totalmente obligatorias en GB  18030-2000. [ 6 ] : 2 La mayoría de las principales empresas de informática ya habían estandarizado alguna versión de Unicode como formato principal para su uso en sus formatos binarios y llamadas al sistema operativo. Sin embargo, en su mayoría solo habían admitido puntos de código en el BMP definido originalmente en Unicode 1.0, que admitía solo 65.536 puntos de código y a menudo se codificaba en 16 bits como UCS-2 . Este estándar es básicamente una extensión basada en GBK con caracteres adicionales en la Extensión A de Ideogramas Unificados CJK.

La segunda versión designada GB  18030-2005 Tecnología de la información—conjunto de caracteres codificados en chino tiene el mismo subconjunto obligatorio que GB  18030-2000 de codificaciones de 1, 2 y 4 bytes. [ 7 ] : 3 Esta versión también incluye la extensión completa de ideogramas unificados CJK B en la sección de codificación de 4 bytes que está fuera del BMP [ 10 ] como un requisito de soporte de sugerencia. [ 14 ] Sin embargo, como la inclusión de la extensión de ideogramas unificados CJK B en una región de 4 bytes debe mantenerse durante el procesamiento de la información, el software ya no puede tratar los caracteres como entidades de ancho fijo de 16 bits ( UCS-2 ). Por lo tanto, deben procesar los datos como un formato de ancho variable (como con UTF-8 o UTF-16 ), que es la opción más común, o pasar a un formato de ancho fijo más grande (es decir, UTF-32 ). Microsoft realizó el cambio de UCS-2 a UTF-16 con Windows 2000. Esta versión coincide con Unicode 3.1 y también proporcionó soporte para Hangul ( coreano ), mongol (incluidos manchú , escritura clara , Sibe hergen , Galik ), Tai Nuea , tibetano , uigur / kazajo / kirguís e Yi .

La tercera y última versión, GB  18030-2022 Tecnología de la información: conjunto de caracteres codificados en chino , exige la sugerencia de soporte para la extensión B de los ideogramas unificados CJK en GB  18030-2005, junto con actualizaciones hasta Unicode 11.0, incluidos los radicales Kangxi y los ideogramas unificados CJK URO , extensiones C, D, E y F. GB 18030-2022 también reconoce otros idiomas,  como parte del árabe , Tai Le , Nuevo Tai Lue , Tai Tham , Lisu y Miao . GB  ​​18030-2022 también introduce tres niveles de implementación, con el requisito de que "todos los productos que utilicen este estándar deben implementar el Nivel de implementación 1", que incluye 66 nuevos caracteres BMP en la región de codificación de 4 bytes que se agregaron entre Unicode 3.1 y Unicode 11.0. El nivel de implementación 2 requiere la compatibilidad con la Lista de caracteres chinos estándar de uso común , y el nivel de implementación 3 requiere todas las demás regiones especificadas en el estándar. [ 11 ]

Desde finales de 2022 hasta 2023, se publicarán borradores de una enmienda adicional a GB  18030-2022 para consulta pública. El borrador actual actualiza Unicode 15.1 sobre caracteres de descripción ideográfica , ideogramas unificados CJK URO, extensión A, B, C, G, H e I. [ 15 ] [ 16 ] [ 17 ] Originalmente, a finales de 2022, se habrían colocado 897 nuevos caracteres sinográficos en el plano 10 ( hexadecimal : 0A), un plano astral Unicode aún sin título , para la certificación de nombres reales de ciudadanos en China, pero finalmente el repertorio (reducido a 622 caracteres después de la revisión de expertos) se incorporó rápidamente a Unicode 15.1 en septiembre de 2023, como el bloque de extensión I de ideogramas unificados CJK . [ 18 ] Posteriormente, el borrador de la enmienda se modificó para utilizar los puntos del código de la Extensión I. [ 17 ]

Cartografía

GB 18030 define una codificación de uno (ASCII), dos (GBK extendido) o cuatro bytes (UTF). Los códigos de dos bytes se definen en una tabla de búsqueda, mientras que los de cuatro bytes se definen secuencialmente (y, por lo tanto, algorítmicamente) para rellenar las partes no codificadas de UCS . GB  18030 hereda los inconvenientes de GBK , sobre todo la necesidad de un código especial para encontrar de forma segura los caracteres ASCII en una secuencia GB18030.

Los puntos de código de uno y dos bytes son esencialmente GBK con el símbolo del euro, asignaciones PUA para puntos no asignados/definidos por el usuario y signos de puntuación verticales. El esquema de cuatro bytes puede considerarse como compuesto por dos unidades, cada una de dos bytes. Cada unidad tiene un formato similar al de un carácter GBK de dos bytes, pero con un rango de valores para el segundo byte de 0x30–0x39 (los códigos ASCII para dígitos decimales). El primer byte tiene el rango de 0x81 a 0xFE, como antes. Esto significa que una rutina de búsqueda de cadenas que sea segura para GBK también debería ser razonablemente segura para GB18030 (de manera muy similar a como una rutina de búsqueda básica orientada a bytes es razonablemente segura para EUC ).

Esto da un total de 1.587.600 (126×10×126×10) posibles secuencias de 4 bytes, lo cual es más que suficiente para cubrir los 1.112.064 (17×65536 − 2048 sustitutos) puntos de código asignados, reservados y que no son caracteres de Unicode .

Desafortunadamente, para complicar aún más las cosas, no existen reglas sencillas para traducir entre una secuencia de 4 bytes y su punto de código correspondiente . En cambio, los códigos se asignan secuencialmente (donde el primer byte contiene la parte más significativa y el último la menos significativa) solo a puntos de código Unicode que no se asignan de ninguna otra manera. [ h ] Por ejemplo:

U+00DE (Þ) → 81 30 89 37 U+00DF (ß) → 81 30 89 38 U+00E0 (à) → A8 A4 U+00E1 (á) → A8 A2 U+00E2 (â) → 81 30 89 39 U+00E3 (ã) → 81 30 8A 30

En la versión de GB 18030 de WHATWG y W3C  se utiliza una tabla de desplazamiento para traducir eficientemente los puntos de código. [ 20 ] ICU [ 19 ] y glibc utilizan definiciones de rango similares para evitar desperdiciar espacio en grandes bloques secuenciales.

Apoyo

Codificación

GB  18030 ha sido compatible con Windows desde el lanzamiento de Windows 95 , como página de códigos 54936. [ 21 ] Windows 2000 y XP ofrecen un paquete de compatibilidad con GB18030. [ 22 ] La base de datos de código abierto PostgreSQL admite GB18030 a través de su compatibilidad total con UTF-8, es decir, convirtiéndolo a y desde UTF-8. De manera similar, Microsoft SQL Server admite GB18030 mediante la conversión a y desde UTF-16.

Más concretamente, la compatibilidad con la codificación GB18030 en Windows implica que la página de códigos 54936 es compatible con MultiByteToWideChary WideCharToMultiByte. Gracias a la retrocompatibilidad de la asignación, muchos archivos en GB18030 pueden abrirse correctamente con la página de códigos heredada 936, es decir, GBK, incluso si la página de códigos 54936 no es compatible. Sin embargo, esto solo es cierto si el archivo en cuestión contiene únicamente caracteres GBK. La carga fallará o provocará un resultado corrupto si el archivo contiene caracteres que no existen en GBK (véase la sección  Asignación para ver ejemplos).

La biblioteca de códecs de caracteres gconv de GNU glibc  , utilizada en la mayoría de las distribuciones de Linux, admite GB 18030-2000 desde la versión 2.2, [ 23 ] y GB  18030-2005 desde la versión 2.14; [ 24 ] glibc incluye notablemente asignaciones no PUA para GB  18030-2005 para lograr la conversión de ida y vuelta. [ 25 ] GNU libiconv , una implementación alternativa de iconv utilizada frecuentemente en entornos tipo UNIX que no son glibc, como Cygwin , admite GB  18030 desde la versión 1.4. [ 26 ]

A partir de 2022, "la compatibilidad con escrituras no chinas sigue siendo opcional" [ 27 ] (presumiblemente solo para la visualización/compatibilidad de fuentes; y en China, dado que la codificación es UTF completa). Se sabe que el estándar admite inglés/ASCII y "los siguientes alfabetos no chinos son reconocidos por GB 18030-2022: árabe, tibetano, mongol, tai le, nuevo tai lue, tai tham, yi, lisu, hangul (coreano) y miao". [ 27 ]

Fuentes

El paquete de soporte GB18030 para Windows XP y Windows 2000 contenía SimSun18030.ttc, un archivo de colección de fuentes TrueType que combina dos fuentes chinas: SimSun-18030 y NSimSun-18030. La fuente SimSun -18030 incluía todos los caracteres CJK obligatorios requeridos por GB18030-2000, incluidos los caracteres de los bloques de ideogramas unificados CJK y extensión A de ideogramas unificados CJK de Unicode 3.0. Desde Windows Vista, Windows incluye las fuentes Simsun y Simsun-ExtB. (Simsun admite caracteres CJK en el plano multilingüe básico de Unicode , mientras que Simsun-ExtB admite la mayoría de los caracteres CJK en el plano ideográfico suplementario de Unicode ). Estas fuentes se han actualizado en versiones posteriores de Windows para admitir caracteres CJK adicionales. A partir de 2022, la fuente Simsun-ExtB admitía CJK Unified Ideograph Extension B , Extension C y Extension D. Para GB 18030-2022, la fuente Simsun-ExtB se actualizó para agregar compatibilidad con CJK Unified Ideograph Extension E y Extension F. [ 28 ] Además , la fuente Simsun-ExtG se agregó a Windows 10 y Windows 11 para admitir caracteres CJK en CJK Unified Ideographs Extension G , Extension H y Extension I. [ 29 ] [ 30 ] Las fuentes Simsun en Windows 10 y Windows 11 admiten todos los caracteres CJK requeridos para GB18030-2022 más la conformidad de nivel 3 de la Enmienda 1.

Microsoft YaHei y DengXian proporcionados por Microsoft se actualizaron en 2023 para coincidir con  el nivel de implementación 2 de GB 18030-2022. [ 28 ]

La fuente Han Sans (y su equivalente Noto Sans CJK) ya cumplen con el nivel de implementación 2 de GB 18030-2022 cuando se anuncie  la actualización del estándar GB 18030 en noviembre de 2022. Sin embargo , Source Han Serif (y su contraparte Noto Serif CJK) no cumple con los requisitos en ese momento, y se proporciona una actualización para garantizar que la fuente cumpla con el nivel de implementación 2. De manera similar, Microsoft YaHei y PingFang (Apple) requieren una pequeña cantidad de adiciones URO que están asociadas con el nivel de implementación 1 para cumplir con el  nivel de implementación 2 de GB 18030-2022. [ 27 ]

Otras familias de fuentes CJK como HAN NOM [ 31 ] y Hanazono Mincho [ 32 ] ofrecen una cobertura más amplia para los bloques de extensión Unicode CJK que SimSun-18030 o incluso SimSun (Founder Extended), pero no admiten todos los puntos de código definidos en GB 18030.

Véase también

Notas

  1. Tenga en cuenta que GB18030 omite los sustitutos; consulte §  Mapeo .
  2. El símbolo del euro es una excepción, al que se le asigna un código de un solo byte de 0x80 en las versiones posteriores de CP936/GBK de Microsoft y un código de dos bytes de A2 E3 en GB18030.
  3. Los puntos de código incluyen los 66 caracteres no Unicode.
  4. ICU parece considerar erróneamente válido este punto de código, que no aparece en ninguna de las versiones de los estándares publicados. WHATWG asigna este byte a U+20AC ( símbolo del euro GBK ) en su decodificador universal gb2312-gbk-gb18030.
  5. Para una división más precisa de este rango, consulte GBK (codificación de caracteres) §  Codificación .
  6. Algunos puntos de código se codifican con dos bytes (fila superior), otros con cuatro bytes (fila inferior). U+FFFF se codifica como84 31 A4 39en la página 239 del estándar de 2005, aunque el estándar llega hasta84 39 FE 39el mapeo BMP.
  7. Estos son puntos de código sustitutos ; no tienen ningún significado fuera de la codificación UTF-16 .
  8. Además, debido a que las codificaciones de U+E7C7 y U+1E3F se intercambiaron, U+E7C7 se codifica en la edición de 2005 del estándar como 81 35 F4 37, entre U+1E3E (81 35 F4 36) y U+1E40 (81 35 F4 38). Por lo tanto, solo la edición de 2000 es completamente secuencial al asignar los códigos de cuatro bytes a puntos de código que de otro modo no estarían mapeados.

Referencias

  1. Anthony Fok (15 de marzo de 2002). "Aplicación del registro de conjuntos de caracteres de IANA para GB18030" . Registros de conjuntos de caracteres de IANA . Consultado el 5 de diciembre de 2016 .
  2. Peter Constable. "Cambios disruptivos en GB 18030-2022" (PDF) . www.unicode.org . Consultado el 12 de febrero de 2024 .
  3. " [ JDK-8301119 ] Soporte para GB18030-2022 - Sistema de errores de Java" . bugs.openjdk.org . Consultado el 14 de agosto de 2023 .
  4. "Notas de la versión de JDK 21" . jdk.java.net . Consultado el 14 de agosto de 2023 .
  5. " [ JDK-8307340 ] Nota de la versión: Compatibilidad con GB18030-2022 - Sistema de errores de Java" . bugs.openjdk.org . Consultado el 30-08-2023 .
  6. ^ CESI ( 8 de julio de 2009). "GB18030 符合性问与答" [ Preguntas frecuentes sobre el cumplimiento de GB18030 ] . Centro de Certificación CESI . Archivado desde el original el 28 de septiembre de 2016 . Consultado el 12 de octubre de 2016 . Página 4同时达到以下两个要求的产品,为符合ES 18030-2005强制部分的产品:①产品可以正确输入、输出、处理GB 18030-2005强制部分规定的全部汉字字符;②产品可以正确识别GB 18030-2005强制性部分规定的全部汉字字符对应的编码。 [Un producto que cumpla con la parte obligatoria de GB 18030 debe poder correctamente a) ingresar, generar y procesar todos los caracteres chinos definidos en el conjunto obligatorio; b) reconocer codificaciones de caracteres en el conjunto obligatorio.] URL alternativa
  7. 1 2 3 4 5 Administración de Normalización de China (SAC) (18-11-2005). GB 18030-2005: Tecnología de la información—Conjunto de caracteres codificados chinos .
  8. "Preguntas frecuentes sobre Unicode en GB 18030" . Proyecto ICU . Archivado del original el 2 de marzo de 2018. Consultado el 10 de septiembre de 2016 .
  9. 1 2 GB 18030-2000: Tecnología de la información—Conjunto de caracteres codificados mediante ideogramas chinos para el intercambio de información—Extensión del conjunto básico . 2000-03-17.{{cite book}}: |work=ignorado ( ayuda )
  10. 1 2 3 Lunde, Ken (2006). "L2/06-394 Actualización sobre GB 18030:2005" . Registro de documentos del Comité Técnico de Unicode . Recuperado el 28 de septiembre de 2016 .
  11. ^ Lunde , Ken (4 de agosto de 2022) . "El estándar GB 18030-2022" . Medio . Consultado el 7 de agosto de 2022 .
  12. ^ "Grupo: GBK外字" . GlifoWiki . Consultado el 11 de septiembre de 2016 .
  13. ^ Lunde , Ken (diciembre de 2008). Procesamiento de Información CJKV . O'Reilly Media, Inc. ISBN 978-0-596-51447-1Consultado el 11 de septiembre de 2016 .
  14. ^ CESI (8 de julio de 2009). "GB18030 符合性问与答" [ Preguntas frecuentes sobre el cumplimiento de GB18030 ] . Centro de Certificación CESI . Archivado desde el original el 28 de septiembre de 2016 . Consultado el 12 de octubre de 2016 . Página 4同时达到以下两个要求的产品,为符合ES 18030-2005强制部分的产品:①产品可以正确输入、输出、处理GB 18030-2005强制部分规定的全部汉字字符;②产品可以正确识别GB 18030-2005强制性部分规定的全部汉字字符对应的编码。 [Un producto que cumpla con la parte obligatoria de GB 18030 debe poder correctamente a) ingresar, generar y procesar todos los caracteres chinos definidos en el conjunto obligatorio; b) reconocer codificaciones de caracteres en el conjunto obligatorio.] 
  15. Lunde, Dr. Ken (12 de noviembre de 2023). "La Primera Enmienda" . Medium . Consultado el 9 de septiembre de 2024 .
  16. ^ Organismo Nacional de China (26 de abril de 2023). "GB 18030—2022《信息技术 中文编码字符集》国家标准第1号修改单(征求意见稿)" (PDF) . UTCL2 /23-113.
  17. ^ Organismo Nacional de China ( 13 de octubre de 2023). "Informe de actividad del IRG n.º 61" (PDF) . ISO/IEC JTC1/SC2 /WG2/ IRG N2623; UTC L2/23-240.
  18. Organismo Nacional de los Estados Unidos (1 de mayo de 2023). "Comentarios del USNB sobre el borrador 2 de la enmienda 1 de GB 18030-2022 y recomendación para la enmienda 2 de ISO/IEC 10646:2020" (PDF) . ISO/IEC JTC1/SC2 N4852, WG2 N5222; UTC L2/23-115.
  19. 1 2 Tabla de correspondencia autorizada entre GB18030-2000 y Unicode . ICU Componentes Internacionales para Unicode. 21/02/2001. Consultado el 04/09/2016. 
  20. "Estándar de codificación # gb18030-index" . WHATWG . Consultado el 24 de septiembre de 2016 .
  21. Bridge, Karl (13 de octubre de 2021). "Función MultiByteToWideChar (stringapiset.h) - Aplicaciones Win32" . learn.microsoft.com . Consultado el 1 de noviembre de 2022 .
  22. Microsoft. "Paquete de soporte GB18030" . Microsoft . Archivado del original el 5 de junio de 2012.
  23. Drepper, Ulrich. "GB18030 iconv module for glibc" . glibc git . Consultado el 29 de noviembre de 2016 .
  24. Drepper, Ulrich. "Actualizar GB18030 a la versión 2005" . glibc git . Consultado el 29 de noviembre de 2016 .
  25. ^ Weimer, Florián; O´Donell, Carlos. "Estado de las tablas GB18030 (#19575)" . Fuente Bugzilla . Consultado el 29 de noviembre de 2016 .
  26. "NOTICIAS - libiconv.git - libiconv" . git.savannah.gnu.org . Consultado el 13-10-2016 .
  27. ^ Lunde, Ken (16 de agosto de 2022 ) . "El estándar GB 18030-2022" . Medio . Consultado el 1 de noviembre de 2022 .
  28. 1 2 "11 de julio de 2023—KB5028171 (compilación del SO 20348.1850) - Soporte de Microsoft" . support.microsoft.com . Microsoft . Consultado el 25 de marzo de 2024 .
  29. "KB5051987: Nuevas funciones y correcciones para una experiencia de Windows mejorada" . windowsforum.com . 11 de febrero de 2025. Consultado el 31 de julio de 2025 .
  30. "11 de febrero de 2025—KB5051987 (compilación del sistema operativo 26100.3194)" . support.microsoft.com . Microsoft. 11 de febrero de 2025. Consultado el 31 de julio de 2025 .
  31. ^ VietnamUnicode. "/hannom" . fuenteforge.net . Consultado el 13 de octubre de 2016 .
  32. "Fuentes de Hanazono" . fonts.jp . Archivado del original el 12 de abril de 2010. Consultado el 13 de octubre de 2016 .
  • Registro de codificación de caracteres IANA para GB18030
  • Resumen en inglés de -2000  (PDF) . 16 de febrero de 2001. Archivado del original (PDF) el 2 de febrero de 2017.
  • Introducción a GB18030, incluyendo su evolución a partir de GB2312 y GBK (Sun/Internet Archive)
  • datos de la UCI
    • GB18030: Una megapágina de código (IBM DeveloperWorks)
    • Tabla de correspondencia autorizada entre GB18030-2000 y Unicode.
    • Explorador de convertidores de UCI: GB18030
  • Tablas Unicode
    • Extensión A de ideogramas unificados Unicode CJK (PDF, 1,5  MB)
    • Extensión B de ideogramas unificados Unicode CJK (PDF, 13  MB)
  • Paquete de soporte GB18030 para Windows 2000/XP, que incluye fuentes chinas, tibetanas, yi, mongolas y tailandesas de Microsoft (Internet Archive).
  • Fuentes, editores y documentación gratuitos de SIL
Obtenido de " https://en.wikipedia.org/w/index.php?title=GB_18030&oldid=1309954071 "