En el estándar Unicode , un plano es un grupo contiguo de 65,536 (2 16 ) puntos de código . Hay 17 planos, identificados por los números del 0 al 16, que corresponden a los posibles valores 00–10 16 de las dos primeras posiciones en formato hexadecimal de seis posiciones ( U+hhhhhh ). El plano 0 es el Plano Multilingüe Básico (BMP), que contiene los caracteres más utilizados. Los planos superiores del 1 al 16 se denominan "planos suplementarios". [ 1 ] El último punto de código en Unicode es el último punto de código en el plano 16, U+10FFFF. A partir de la versión 17.0 de Unicode , cinco de los planos tienen puntos de código (caracteres) asignados y siete tienen nombre.
El límite de 17 planos se debe a UTF-16 , que puede codificar 2²⁰ puntos de código (16 planos) como pares de palabras , más el BMP como una sola palabra. [ 2 ] UTF-8 fue diseñado con un límite mucho mayor de 2³¹ (2.147.483.648) puntos de código (32.768 planos), y aún podría codificar 2²¹ ( 2.097.152) puntos de código (32 planos) incluso bajo el límite actual de 4 bytes . [ 3 ]
Los 17 planos pueden albergar 1.114.112 puntos de código. De estos, 2.048 son caracteres sustitutos (utilizados para formar pares en UTF-16), 66 no son caracteres y 137.468 están reservados para uso privado , quedando 974.530 para asignación pública.
Los planos se subdividen a su vez en bloques Unicode , que, a diferencia de los planos, no tienen un tamaño fijo. Los 346 bloques definidos en Unicode 17.0 cubren el 27 % del espacio de puntos de código posible y varían en tamaño desde un mínimo de 16 puntos de código (dieciséis bloques) hasta un máximo de 65 536 puntos de código (Área de Uso Privado Suplementario A y B, que constituyen la totalidad de los planos 15 y 16). Para su uso futuro, se han trazado tentativamente rangos de caracteres para la mayoría de los sistemas de escritura conocidos, tanto actuales como antiguos. [ 4 ]
Descripción general
Plano multilingüe básico

El primer plano, el plano 0 , denominado Plano Multilingüe Básico ( BMP ), contiene caracteres para casi todos los idiomas modernos y una gran cantidad de símbolos . Un objetivo primordial del BMP es facilitar la unificación de conjuntos de caracteres previos, así como la incorporación de caracteres para la escritura . La mayoría de los puntos de código asignados en el BMP se utilizan para codificar caracteres chinos, japoneses y coreanos ( CJK ), así como caracteres de otros sistemas de escritura de Asia Oriental.
Los códigos High Surrogate (U+D800–U+DBFF) y Low Surrogate (U+DC00–U+DFFF) están reservados para codificar caracteres que no son BMP en UTF-16 mediante un par de códigos de 16 bits : uno High Surrogate y otro Low Surrogate. A un único punto de código subrogate nunca se le asignará un carácter.
De los 65.536 puntos de código en este plano, 65.520 se han asignado a un bloque Unicode, quedando 16 puntos de código en un único rango no asignado (2FE0..2FEF).
A partir de Unicode 17.0El BMP comprende los siguientes 164 bloques:
- Sistemas de escritura alfabéticos de izquierda a derecha:
- Latín básico (mitad inferior de ISO/IEC 8859-1 : ISO/IEC 646:1991-IRV, también conocido como ASCII ) (0000–007F)
- Suplemento Latin-1 (mitad superior de ISO/IEC 8859-1 ) (0080–00FF)
- Latín extendido-A (0100–017F)
- Latín extendido-B (0180–024F)
- Extensiones del Alfabeto Fonético Internacional (0250–02AF)
- Letras modificadoras de espaciado (02B0–02FF)
- Combinación de signos diacríticos (0300–036F)
- Griego y copto (0370–03FF)
- Cirílico (0400–04FF)
- Suplemento cirílico (0500–052F)
- Armenio (0530–058F)
- Escrituras semíticas abjad y otras escrituras de derecha a izquierda:
- Hebreo (0590–05FF)
- Árabe (06:00–06FF)
- Siríaco (0700–074F)
- Suplemento en árabe (0750–077F)
- Thaana (0780–07BF)
- N'Ko (07C0–07FF)
- Samaritano (08:00–08:3F)
- Mandaic (0840–085F)
- Suplemento siríaco (0860–086F)
- Árabe extendido-B (0870–089F)
- Árabe extendido-A (08A0–08FF)
- Escrituras bráhmicas :
- Otros sistemas de escritura alfabéticos o silábicos de izquierda a derecha:
- Georgiano (10A0–10FF)
- Hangul Jamo (1100–11FF)
- Etíope (1200–137 °F)
- Suplemento etíope (1380-139F)
- Cherokee (13A0–13FF)
- Sistema silábico aborigen canadiense unificado (1400–167F)
- Ogham (1680–169F)
- Rúnico (16A0–16FF)
- Guiones filipinos :
- Jemer (1780–17FF)
- Mongol (1800–18 d. C.)
- Sistema silábico aborigen canadiense unificado ampliado (18B0–18FF)
- Escrituras bráhmicas :
- Limbu (1900–194F)
- Guiones tai :
- Tai Le (1950–197F)
- Nuevo Tai Lue (1980–19DF)
- Símbolos jemeres (19E0–19FF)
- Buginés (1A00–1A1F)
- Tai Tham (1A20–1AAF)
- Combinación de signos diacríticos ampliada (1AB0–1AFF)
- Escrituras indonesias :
- Lepcha (1C00–1C4F)
- Ol Chiki (1C50–1C7F)
- Otros complementos alfabéticos o silábicos de izquierda a derecha:
- C extendida cirílica (1C80–1C8F)
- Georgiano extendido (1C90–1CBF)
- Suplemento sundanés (1CC0–1CCF)
- Extensiones védicas (1CD0–1CFF)
- Otros suplementos alfabéticos de izquierda a derecha:
- Extensiones fonéticas (1D00–1D7F)
- Suplemento de extensiones fonéticas (1D80–1DBF)
- Suplemento para la combinación de signos diacríticos (1DC0–1DFF)
- Español adicional extendido en latín (1E00–1EFF)
- Griego extendido (1F00–1FFF)
- Símbolos :
- Puntuación general (2000–206F)
- Superíndices y subíndices (2070–209F)
- Símbolos monetarios (20A0–20CF)
- Combinación de signos diacríticos para símbolos (20D0–20FF)
- Símbolos tipo letras (2100–214F)
- Formularios numéricos (2150–218F)
- Flechas (2190–21FF)
- Operadores matemáticos (2200–22FF)
- Información técnica diversa (2300–23FF)
- Imágenes de control (2400–243F)
- Reconocimiento óptico de caracteres (2440–245F)
- Alfanuméricos encerrados (2460–24FF)
- Dibujo de la caja (2500–257F)
- Elementos de bloque (2580–259F)
- Figuras geométricas (25A0–25FF)
- Símbolos varios (2600–26FF)
- Dingbats (2700–27BF)
- Símbolos matemáticos diversos-A (27C0–27EF)
- Flechas suplementarias-A (27F0–27FF)
- Patrones Braille (2800–28FF)
- Flechas suplementarias-B (2900–297F)
- Símbolos matemáticos varios-B (2980–29FF)
- Operadores matemáticos suplementarios (2A00–2AFF)
- Símbolos y flechas varios (2B00–2BFF)
- Otros sistemas de escritura alfabéticos de izquierda a derecha o suplementos:
- Glagolítico (2C00–2C5F)
- Latín extendido-C (2C60–2C7F)
- Copto (2C80–2CFF)
- Suplemento georgiano (2D00–2D2F)
- Escrituras africanas:
- Tifinagh (2D30–2D7F)
- Etíope extendido (2D80–2DDF)
- Otros suplementos alfabéticos de izquierda a derecha:
- Cirílico extendido-A (2DE0–2DFF)
- Puntuación suplementaria (2E00–2E7F)
- Alfabetos y símbolos CJK :
- Suplemento de radicales CJK (2E80–2EFF)
- Radicales Kangxi (2F00–2FDF)
- Caracteres de descripción ideográfica (2FF0–2FFF)
- Símbolos y puntuación CJK (3000–303F)
- Hiragana (3040–309F)
- Katakana (30A0–30FF)
- Bopomofo (3100–312 °F)
- Compatibilidad con Hangul Jamo (3130–318F)
- Kanbun (3190–319F)
- Bopomofo Extendido (31A0–31BF)
- Accidentes cerebrovasculares CJK (31C0–31EF)
- Extensiones fonéticas del katakana (31F0–31FF)
- Cartas y meses CJK adjuntos (3200–32FF)
- Compatibilidad con caracteres CJK (3300–33FF)
- Extensión A de los ideogramas unificados CJK (3400–4DBF)
- Símbolos de los hexagramas del I Ching (4DC0–4DFF)
- Ideogramas unificados CJK (4E00–9FFF)
- Sílabas Yi (A000–A48F)
- Radicales Yi (A490–A4CF)
- Lisu (A4D0–A4FF)
- Escrituras africanas:
- Vai (A500–A63F)
- Otros suplementos alfabéticos de izquierda a derecha:
- Cirílico extendido-B (A640–A69F)
- Escrituras africanas:
- Bamum (A6A0–A6FF)
- Otros suplementos alfabéticos de izquierda a derecha:
- Letras de tono modificador (A700–A71F)
- Latín extendido-D (A720–A7FF)
- Escrituras bráhmicas :
- Syloti Nagri (A800–A82F)
- Formas comunes de números índicos (A830–A83F)
- Phags-pa (A840–A87F)
- Saurashtra (A880–A8DF)
- Devanagari extendido (A8E0–A8FF)
- Kayah Li (A900–A92F)
- Rejang (A930–A95F)
- Hangul Jamo Extendido-A (A960–A97F)
- Escrituras bráhmicas :
- Javanés (A980–A9DF)
- Myanmar Extended-B (A9E0–A9FF)
- Cham (AA00–AA5F)
- Myanmar Extended-A (AA60–AA7F)
- Tai Viet (AA80–AADF)
- Extensiones de Meetei Mayek (AAE0 – AAFF)
- Etiopic Extended-A (AB00–AB2F)
- Latín extendido-E (AB30–AB6F)
- Suplemento Cherokee (AB70–ABBF)
- Meetei Mayek (ABC0–ABFF)
- Sílabas Hangul (AC00 – D7AF)
- Hangul Jamo Extendido-B (D7B0–D7FF)
- Madres sustitutas :
- Sustitutos de alto grado (D800–DB7F)
- Madres sustitutas de alto uso privado (DB80–DBFF)
- Subrogados bajos (DC00–DFFF)
- Zona de uso privado (E000–F8FF)
- Ideogramas de compatibilidad CJK (F900–FAFF)
- Formularios de presentación alfabéticos (FB00–FB4F)
- Formularios de presentación en árabe-A (FB50–FDFF)
- Selectores de variación (FE00–FE0F)
- Formas verticales (FE10–FE1F)
- Combinación de medias calificaciones (FE20–FE2F)
- Formularios de compatibilidad CJK (FE30–FE4F)
- Variantes de formato pequeño (FE50–FE6F)
- Formularios de presentación en árabe-B (FE70–FEFF)
- Formatos de ancho medio y ancho completo (FF00–FFEF)
- Especiales (FFF0–FFFF)
Plano multilingüe suplementario

El plano 1 , el Plano Multilingüe Suplementario ( PMS ), contiene escrituras históricas (excepto la ideográfica CJK), y símbolos y notación utilizados en ciertos campos. Las escrituras incluyen Lineal B , jeroglíficos egipcios y escritura cuneiforme . También incluye ortografías de la reforma inglesa como Shavian y Deseret , y algunas escrituras modernas como Osage , Warang Citi , Adlam , Wancho y Toto . Los símbolos y notaciones incluyen notación musical histórica y moderna ; alfanuméricos matemáticos ; taquigrafía; emojis y otros conjuntos pictográficos; y símbolos de juegos para naipes , mahjong y dominó .
A partir de Unicode 17.0El SMP comprende los siguientes 168 bloques:
- Griego arcaico y otros sistemas de escritura de izquierda a derecha:
- Silabario lineal B (10000–1007F)
- Ideogramas lineales B (10080–100FF)
- Números del Egeo (10100–1013F)
- Números de la Antigua Grecia (10140–1018F)
- Símbolos antiguos (10190–101 d. C.)
- Disco de Festos (101D0–101FF)
- Licio (10280–1029F)
- Cariano (102A0–102DF)
- Números epactos coptos (102E0–102FF)
- Cursiva antigua (10300–1032F)
- Gótico (10330–1034F)
- Pérmico antiguo (10350–1037 °F)
- Ugarítico (10380–1039F)
- Persa antiguo (103A0–103DF)
- Deseret (10400–1044 °F)
- Shaviano (10450–1047F)
- Osmanya (10480–104 AF)
- Osage (104B0–104FF)
- Elbasan (10500–1052 °F)
- Albanés caucásico (10530–1056F)
- Vithkuqi (10570–105 a. C.)
- Todhri (105 °C0–105 °F)
- Lineal A (10600–1077F)
- Latín extendido-F (10780–107BF)
- Escrituras de derecha a izquierda:
- Silabario chipriota (10800–1083F)
- Arameo imperial (10840–1085F)
- Palmireno (10860–1087F)
- Nabateo (10880–108 AF)
- Hatran (108E0–108FF)
- Fenicio (10900–1091F)
- Lidio (10920–1093F)
- Sidetic (10940-1095F)
- Jeroglíficos meroíticos (10980–1099F)
- Cursiva meroítica (109A0–109FF)
- Kharoshthi (10A00–10A5F)
- Antiguo árabe del sur (10A60–10A7F)
- Antiguo árabe del norte (10A80–10A9F)
- Maniqueo (10AC0–10AFF)
- Avestan (10B00–10B3F)
- Parto con inscripciones (10B40–10B5F)
- Pahlavi inscribcional (10B60–10B7F)
- Salterio Pahlavi (10B80–10BAF)
- Turco antiguo (10C00–10C4F)
- Húngaro antiguo (10C80–10CFF)
- Hanifi Rohingya (10D00–10D3F)
- Garay (10D40–10D8F)
- Símbolos numéricos de Rumi (10E60–10E7F)
- Yazidí (10E80–10EBF)
- Árabe extendido-C (10EC0–10EFF)
- Antiguo sogdiano (10F00–10F2F)
- Sogdiano (10F30–10F6F)
- Antiguo uigur (10F70–10FAF)
- Corasmiano (10FB0–10FDF)
- Elymaico (10FE0–10FFF)
- Escrituras bráhmicas :
- Brahmi (11000–1107 °F)
- Kaithi (11080–110CF)
- Sora Sompeng (110D0–110FF)
- Chakma (11100–1114F)
- Mahajani (11150–1117F)
- Sharada (11180–111DF)
- Números arcaicos cingaleses (111E0–111FF)
- Khojki (11200–1124F)
- Multani (11280–112 d. C.)
- Khudawadi (112B0–112FF)
- Grantha (11300–1137F)
- Tulu-Tigalari (11380–113FF)
- Newa (11400–1147 °F)
- Tirhuta (11480–114DF)
- Siddham (11580–115FF)
- Modi (11600–1165F)
- Suplemento mongol (11660–1167F)
- Takri (11680–116CF)
- Myanmar Extended-C (116D0–116FF)
- Ahom (11700–1174F)
- Dogra (11800–1184F)
- Warang Citi (118A0–118FF)
- Inmersiones Akuru (11900–1195 °F)
- Nandinagari (119A0–119FF)
- Plaza Zanabazar (11A00–11A4F)
- Soyombo (11A50–11AAF)
- Sistema silábico aborigen canadiense unificado extendido-A (11AB0–11ABF)
- Escrituras bráhmicas:
- Pau Cin Hau (11AC0–11AFF)
- Devanagari Extendido-A (11B00–11B5F)
- Suplemento Sharada (11B60-11B7F)
- Sunuwar (11BC0–11BFF)
- Bhaiksuki (11C00–11C6F)
- Marchen (11C70–11CBF)
- Masaram Gondi (11D00–11D5F)
- Gunjala Gondi (11D60–11DAF)
- Tolong Siki (11DB0-11DEF)
- Makassar (11EE0–11EFF)
- Kawi (11F00–11F5F)
- Suplemento Lisu (11FB0–11FBF)
- Suplemento en tamil (11FC0–11FFF)
- Escrituras cuneiformes:
- Cuneiforme (12000–123 FF)
- Números y puntuación cuneiformes (12400–1247F)
- Escritura cuneiforme del Período Dinástico Temprano (12480–1254F)
- Minoico chipriota (12F90–12FFF)
- Escrituras jeroglíficas:
- Jeroglíficos egipcios (13000–1342F)
- Controles de formato de jeroglíficos egipcios (13430–1345F)
- Jeroglíficos egipcios extendidos-A (13460–143FF)
- Jeroglíficos anatolios (14400–1467F)
- Gurung Khema (16100–1613F)
- Suplemento de Bamum (16800–16A3F)
- Mro (16A40–16A6F)
- Tangsa (16A70–16ACF)
- Bassa Vah (16 d. C.–16 d. C.)
- Pahawh Hmong (16B00–16B8F)
- Kirat Rai (16D40–16D7F)
- Medefaidrina (16E40–16E9F)
- Beria Erfe (16EA0-16EDF)
- Miao (16F00–16F9F)
- Escrituras de Asia oriental:
- Símbolos ideográficos y puntuación (16FE0–16FFF)
- Tangut (17000–187FF)
- Componentes tangut (18800–18AFF)
- Escritura pequeña khitan (18B00–18CFF)
- Suplemento de tangut (18D00–18D7F)
- Suplemento de componentes de Tangut (18D80-18DFF)
- Kana Extendido-B (1AFF0–1AFFF)
- Suplemento Kana (1B000–1B0FF)
- Kana Extended-A (1B100–1B12F)
- Extensión Kana pequeña (1B130–1B16F)
- Nushu (1B170–1B2FF)
- Sistemas de escritura notacional:
- Duployan (1BC00–1BC9F)
- Controles de formato taquigráfico (1BCA0–1BCAF)
- Símbolos para el suplemento de computación heredada (1CC00–1CEBF)
- Suplemento de símbolos varios (1CEC0–1CEFF)
- Símbolos y números:
- Notación musical :
- Notación musical Znamenny (1CF00–1CFCF)
- Símbolos musicales bizantinos (1D000–1D0FF)
- Símbolos musicales (1D100–1D1FF)
- Notación musical de la antigua Grecia (1D200–1D24F)
- Numerales de Kaktovik (1D2C0–1D2DF)
- Numerales mayas (1D2E0–1D2FF)
- Símbolos matemáticos :
- Símbolos de Tai Xuan Jing (1D300–1D35F)
- Números de varillas de conteo (1D360–1D37F)
- Símbolos alfanuméricos matemáticos (1D400–1D7FF)
- Notación musical :
- Sistemas de escritura notacional:
- Sutton SignWriting (1D800–1DAAF)
- Otros sistemas de escritura de izquierda a derecha:
- Latín extendido-G (1DF00–1DFFF)
- Suplemento glagolítico (1E000–1E02F)
- Cirílico extendido-D (1E030–1E08F)
- Nyiakeng Puachue Hmong (1E100–1E14F)
- Toto (1E290–1E2BF)
- Wancho (1E2C0–1E2FF)
- Nag Mundari (1E4D0–1E4FF)
- Ol Onal (1E5D0–1E5FF)
- Escrituras africanas:
- Tai Yo (1E6C0-1E6FF)
- Etíope extendido-B (1E7E0–1E7FF)
- Mende Kikakui (1E800–1E8DF)
- Adlam (1E900–1E95F)
- Símbolos y números:
- Números Siyaq Índicos (1EC70–1ECBF)
- Números Siyaq otomanos (1ED00–1ED4F)
- Símbolos alfabéticos matemáticos árabes (1EE00–1EEFF)
- Fichas y cartas del juego:
- Fichas de Mahjong (1F000–1F02F)
- Fichas de dominó (1F030–1F09F)
- Naipes (1F0A0–1F0FF)
- Suplemento alfanumérico adjunto (1F100–1F1FF)
- Suplemento ideográfico adjunto (1F200–1F2FF)
- Símbolos y pictogramas diversos (1F300–1F5FF)
- Emoticonos (1F600–1F64F)
- Dingbats ornamentales (1F650–1F67F)
- Símbolos de transporte y mapas (1F680–1F6FF)
- Símbolos alquímicos (1F700–1F77F)
- Formas geométricas extendidas (1F780–1F7FF)
- Flechas suplementarias-C (1F800–1F8FF)
- Símbolos y pictogramas suplementarios (1F900–1F9FF)
- Símbolos de ajedrez (1FA00–1FA6F)
- Símbolos y pictogramas (versión extendida A) (1FA70–1FAFF)
- Símbolos para la informática heredada (1FB00–1FBFF)
Plano ideográfico suplementario

El plano 2 , el plano ideográfico suplementario ( SIP ), se utiliza para los ideogramas CJK, principalmente los ideogramas unificados CJK , que no estaban incluidos en los estándares de codificación de caracteres anteriores.
A partir de Unicode 17.0El SIP consta de los siguientes siete bloques:
- Extensión B de los ideogramas unificados CJK (20000–2A6DF)
- Extensión C de ideogramas unificados CJK (2A700–2B73F)
- Extensión D de los ideogramas unificados CJK (2B740–2B81F)
- Extensión E de los ideogramas unificados CJK (2B820–2CEAF)
- Extensión F de los ideogramas unificados CJK (2CEB0–2EBEF)
- Extensión I de los ideogramas unificados CJK (2EBF0–2EE5F)
- Suplemento de ideogramas de compatibilidad CJK (2F800–2FA1F)
Plano ideográfico terciario

El plano 3 es el Plano Ideográfico Terciario (TIP). La extensión G de los ideogramas unificados CJK se añadió al TIP en Unicode 13.0, publicado en marzo de 2020. [ 5 ] También se le ha asignado provisionalmente la escritura de sello pequeño . [ 6 ]
A partir de Unicode 17.0El TIP comprende los siguientes tres bloques:
- Extensión G de los ideogramas unificados CJK (30000–3134F)
- Extensión H de ideogramas unificados CJK (31350–323AF)
- Extensión J de ideogramas unificados CJK (323B0–3347F)
Aviones no asignados
Planos 4 a 13 (planos 4 a D en hexadecimal ): Aún no se han asignado caracteres, ni se ha propuesto su asignación, a los planos 4 a 13.
Avión suplementario de propósito especial

El plano 14 ( E en hexadecimal ) se denomina plano suplementario de propósito especial ( SSP ). Comprende los dos bloques siguientes , según Unicode 17.0.:
- Etiquetas (E0000–E007F)
- Suplemento de selectores de variación (E0100–E01EF): se utiliza para indicar glifos alternativos para los caracteres.
Planos de la zona de uso privado
Los planos 15 y 16 ( F y 10 en hexadecimal ) contienen cada uno un " Área de Uso Privado ". Estos contienen bloques denominados Área de Uso Privado Suplementaria-A ( PUA-A ) y -B ( PUA-B ). Las Áreas de Uso Privado están disponibles para su uso por terceros ajenos a ISO y Unicode (codificación de caracteres de uso privado).
Notas
- ↑ Puntos de código que se han asignado a un bloque Unicode .
Referencias
- ↑ "Glosario" . Unicode . Consultado el 27 de septiembre de 2021 .
- ↑ "El estándar Unicode versión 6.0 – Especificación principal" (PDF) . El Consorcio Unicode. Febrero de 2011. Tabla 3.5 "Distribución de bits UTF-16".
- ↑ "El estándar Unicode versión 6.0 – Especificación principal" (PDF) . El Consorcio Unicode. Febrero de 2011. Tabla 3.6 "Distribución de bits UTF-8".
- ↑ "Hojas de ruta hacia Unicode" . Unicode . Consultado el 27 de septiembre de 2021 .
- ↑ "Anuncio del estándar Unicode, versión 13.0" . El blog de Unicode . 10 de marzo de 2020.
- ↑ "Nuevos caracteres propuestos: El proceso de desarrollo" . www.unicode.org .
- Unicode