Los caracteres fantasma ( en japonés :幽霊文字, Hepburn : yūrei moji ) son kanji erróneos incluidos en la norma industrial japonesa JIS X 0208. De los 6355 caracteres kanji, hay 12 caracteres fantasma.
Descripción general

En 1978, el Ministerio de Comercio e Industria estableció la norma JIS C 6226 (posteriormente JIS X 0208 ). Esta norma definió 6349 caracteres como caracteres kanji de nivel 1 y 2 de JIS. Este conjunto de caracteres kanji se denomina "Kanji básico de JIS". En ese momento, se utilizaron como fuentes las siguientes cuatro listas de caracteres kanji: [ 1 ] : 269f
- Tabla de caracteres kanji para códigos estándar (borrador): Comité de códigos kanji del IPSJ (1971)
- Directorio Nacional de Distritos Administrativos Territoriales: Sociedad Geográfica de Japón (1972)
- Tabla de apellidos de Nippon Seimei: Nippon Life (1973, ya no existe)
- Kanji básico para el procesamiento de información administrativa: Agencia de gestión administrativa (1975)
En el momento del establecimiento del estándar, la autoridad de cada carácter no estaba claramente definida, y se señaló que algunos caracteres tenían significados y ejemplos de uso desconocidos. El término « carácter fantasma» se acuñó a partir de «palabra fantasma» , que significa una palabra que se incluye en los diccionarios pero que no tiene uso práctico. [ 2 ] Los ejemplos más comunes son妛y彁. Estos caracteres nunca se mencionaron en el Diccionario Kangxi ni en el Dai Kan-Wa Jiten , una colección exhaustiva de libros de caracteres chinos antiguos.
En 1997, el comité de redacción del estándar revisado, presidido por Koji Shibano e integrado por Hiroyuki Sasahara del Instituto Nacional de Lengua y Lingüística Japonesa , investigó la bibliografía citada en la redacción del estándar de 1978. Se descubrió que muchos de los caracteres considerados caracteres fantasma eran en realidad kanji utilizados en topónimos.
Según la encuesta, antes de la redacción del estándar de 1978, la Agencia de Gestión Administrativa había compilado ocho listas de caracteres Kanji, incluidas las mencionadas anteriormente (1-3), en 1974, tituladas "Resultados del análisis de frecuencia de uso y correspondencia de caracteres Kanji para la selección de caracteres Kanji estándar para el procesamiento de información administrativa". Esta lista incluía una lista de caracteres Kanji y sus fuentes originales. Para la selección de los caracteres Kanji básicos del JIS en aquel entonces, se consultaron los resultados de este análisis de correspondencia, en lugar de las fuentes originales. Se encontró que muchos caracteres fantasma estaban incluidos en aquellos basados en la Lista exhaustiva de divisiones administrativas del territorio nacional y en la Lista de caracteres Kanji para nombres propios de Nippon Life Insurance Company. En particular, la Lista de caracteres Kanji para nombres propios no tenía una fuente original al momento de redactar el primer estándar, y se ha señalado que su contenido era inadecuado. [ 3 ]
En respuesta a estos resultados, el Comité de Revisión de Normas recuperó la edición de 1972 de la Lista exhaustiva de divisiones administrativas del territorio nacional , revisando su historial de corrección de pruebas, y cotejó todos los caracteres kanji que aparecían en el libro con todas las páginas para confirmar los ejemplos. Además, como reemplazo de la Lista de caracteres kanji para nombres propios , que ya no existe, realizaron una exhaustiva búsqueda bibliográfica, que incluyó un estudio comparativo de las bases de datos de directorios telefónicos de NTT y Nippon Telegraph and Telephone Public Corporation, así como un análisis de más de 30 libros de caracteres antiguos y modernos.
Hay doce caracteres kanji que permanecen sin identificar, de los cuales tres parecen ser errores tipográficos. Los otros ocho caracteres se han encontrado en diccionarios antiguos japoneses o chinos. Para el carácter彁( ka ), no se ha encontrado ninguna fuente concreta. [ 1 ] : 269f
Los caracteres fantasma ya se han incorporado a estándares internacionales como Unicode , y es probable que los cambios en estos estándares causen problemas de compatibilidad, lo que dificultará la modificación o eliminación de los caracteres fantasma.
Lista de personajes fantasma
Fuentes identificadas
Los resultados de la encuesta mencionada anteriormente, realizada por Hiroyuki Sasahara et al., se resumen en el Anexo 7, "Descripción detallada de la ubicación de los distritos", de la norma JIS X 0208:1997. Esta sección presenta algunos extractos de dichos resultados.
La norma JIS X 0208:1997 recopila los detalles de las fuentes de 72 caracteres cuyas fuentes han sido identificadas, principalmente aquellos que no figuran ni en el Dai Kan-Wa Jiten de Morohashi ni en el Shin Jigen de Kadokawa . Sin embargo, también incluye caracteres que se ha comprobado que fueron escritos erróneamente en las fuentes originales.
La lista de delimitadores adjunta como "autoridad de origen" en el Anexo 7 de JIS X 0208:1997 enumera 72 caracteres, pero el texto detallado no enumera鰛(82-60), y aunque幤(54-82) está marcado como "autoridad de origen", no figura en la lista de 72 caracteres.
Algunos de ellos se enumeran en la tabla siguiente, incluidos algunos que se sabe que son errores tipográficos en el texto original.

Fuentes desconocidas
La norma JIS X 0208:1997 trata los doce caracteres de la tabla siguiente como "Autoridad desconocida", "Desconocido" o "No identificable" porque no se sabe con certeza cuál de las cuatro listas de kanji mencionadas anteriormente es la fuente de los caracteres.
Dado que los caracteres fantasma son "kanji que no existen", las lecturas se dan "por conveniencia".
Posibles errores tipográficos
Se cree que algunos de los caracteres de origen desconocido fueron escritos erróneamente por el creador del estándar.
- Es posible que壥se haya escrito mal porque㕓, que es similar a壥, no está incluido en el JIS Basic Kanji.㕓tampoco está incluido en JIS X 0213 .
- Es posible que妛se haya escrito incorrectamente porque 𡚴 , que es similar a妛, no está incluido en el Kanji básico JIS. En el Índice de Distritos Administrativos Nacionales de Tierras, la fuente de este documento, hay una marca de impresión similar a una sombra en la superposición que parece haber sido creada cortando y pegando partes de diferentes caracteres al crear el bloque, y se supone que esto fue transcrito erróneamente como un trazo horizontal. [ 1 ] : 288, 289f, 292 [ 38 ]
- Es posible que椦se haya escrito incorrectamente porque橳, que es similar a椦, no está incluido en el JIS Basic Kanji.
Tratamiento en los diccionarios
Desde el establecimiento del estándar, la política para la compilación de diccionarios ha sido publicar libros de caracteres que parten del supuesto de que todos los caracteres Kanji básicos del JIS están listados. Para los caracteres fantasma, no es posible recurrir a fuentes anteriores. Por lo tanto, su tratamiento varió según los diccionarios y los caracteres individuales, como se detalla a continuación.
Lecturas improvisadas asignadas
En los equipos que implementan caracteres Kanji básicos JIS, a menudo se les asigna una lectura fonética. Algunos diccionarios también incluyen estas lecturas provisionales. Hiroyuki Sasahara señala que estas lecturas podrían haberse basado en un informe de investigación de la Asociación Japonesa de Industrias de Electrónica y Tecnología de la Información (1982) y en materiales publicados por NEC (1982) e IBM Japón (1983). [ 39 ]
Consideradas variaciones de caracteres similares
El carácter妛puede ser un error tipográfico del carácter muy similar 𡚴 (el radical superior山se convierte en屮), y se encuentra en el Dai Kan-Wa Jiten y el Diccionario Kangxi . [ 40 ] Esto también se introduce en el estudio JIS X 0208:1997 con un ejemplo de fusión implícita con una fuente autorizada. Estos dos caracteres también se fusionan en el mismo punto de código en Unicode . De manera similar, algunos diccionarios han asignado駲como una variante de馴[ 41 ] y軅como una variante de軈. [ 42 ]
Interpretaciones individuales
Dado que竜es una variante de龍, existe una interpretación de que槞es una variante de櫳. [ 29 ] Algunos diccionarios consideran que鵈es el carácter para milanos negros . [ 43 ]
Explicado como desconocido
Tras la publicación de los resultados de la investigación anterior, estos contenidos se adoptaron generalmente en los diccionarios. El Dai Kan-Wa Jiten publicó un volumen suplementario en 2000; allí se registraron los caracteres垈,垉,岾,橸,汢,粭,糘,膤,軅y鵈. [ 44 ] El Shin Jigen (Nueva Fuente de Caracteres) de Kadokawa se revisó en 2017 para incluir todos los estándares JIS del primero al cuarto, incluidos los caracteres fantasma. [ 45 ]
Restos del personaje
Dado que los caracteres chinos (incluidos los kanji japoneses ) se han utilizado en los países de Asia Oriental desde la antigüedad y se han transmitido principalmente a través de la escritura a mano, han surgido caracteres con estilos de escritura ligeramente diferentes de un país a otro o incluso dentro de un mismo país, los llamados caracteres chinos variantes . Unicode no adoptó todas las variaciones, y los caracteres con solo ligeras diferencias fueron incluidos y registrados. [ 47 ]
Por otro lado, la combinación de partes simples de caracteres chinos para crear otros caracteres también se ha realizado en diferentes países y regiones. Como resultado, los mismos caracteres chinos pueden inventarse en distintos países por coincidencia, con significados diferentes (a veces idénticos). [ 48 ]
Como se mencionó anteriormente, se presume que el carácter japonés "妛" era originalmente solo "塚ゴ", que es una combinación de "山" y "女", pero con un "一" accidental en medio. Por otro lado, existe un carácter chino en China "妛" que es una combinación de "屮", "一" y "女", que también es una variante de "媸". Sin embargo, en Unicode, "妛", que no existía originalmente en Japón, fue incluido porque resultó ser similar a "妛". [ 47 ] Además, el carácter japonés "妛", que es un error, fue registrado como un carácter Unicode. [ 49 ]
Además, se cree que el carácter japonés fantasma "閠" (parte inferior "玉") es una errata de "閏" (parte inferior "王"). Un manuscrito del siglo XVI del Wagokuhen japonés del siglo XV también contiene el carácter "閠", pero es un ejemplo aislado. Por otro lado, el carácter chino "閠" en China es una variante de "閏", que no es una errata. [ 33 ] Esto también se unificó en Unicode. [ 46 ]
Algunos creen que el carácter japonés para fantasmas "岾" es un kokuji (un kanji exclusivamente japonés) que significa montañas desnudas, y que originalmente fue una errata de "岵". Sin embargo, en Corea, este carácter se creó como un carácter chino que significa paso de montaña . [ 50 ] Esto también se unificó en Unicode. [ 46 ]
Uso contemporáneo
Desde la publicación del estándar, han aparecido ejemplos de caracteres fantasma junto con su uso generalizado.
El祢宜, título del subdirector de un santuario japonés, a veces se usa erróneamente como袮宜(usando el carácter fantasma袮). En algunos casos, el apellido japonés栩谷se confunde con挧谷(usando el carácter fantasma挧). [ 1 ] : 292, 304 El folclorista japonés Motoji Niwa introdujo el apellido妛芸凡( Akiōshi ) en su libro. [ 2 ] [ 51 ]
La base de datos de Asahi Shimbun contenía el nombre埼玉自彊会impreso en su edición del 23 de febrero de 1923, pero cuando se digitalizó, estaba incorrectamente etiquetado como埼玉自彁会(con el fantasma彁), que desde entonces ha sido corregido. [ 52 ]
Ejemplos de uso en la ficción
La serie de televisión japonesa tokusatsu Gosei Sentai Dairanger presenta un personaje llamado嘉挧( Kaku ). El nombre está tomado del antiguo estadista chino Jia Xu (賈詡), pero los caracteres fueron reemplazados por caracteres fantasma porque el carácter詡no está registrado en JIS X 0208 .
El libro 5A73 , del escritor japonés de misterio Yuji Yomisaka, comienza con una serie de asesinatos en los que el carácter fantasmal暃está escrito en los cuerpos de las víctimas. [ 53 ]
El juego de música Beatmania IIDX incluye una canción titulada閠槞彁の願いque utiliza personajes fantasmas. Según los comentarios sobre la canción, la pronunciación es "impronunciable para los humanos" y tentativamente se llama " Gyokurōka no Negai " (ぎょくろうかのねがい), que es la lectura ateji de los personajes fantasma. [ 54 ]
De manera similar, varias entregas de la serie de juegos de ritmo Taiko no Tatsujin incluyen una canción titulada simplemente "彁" o " Ka ". Esta es una pista notoriamente extraña y difícil que se agregó como una actualización del Día de los Inocentes en 2021, y solo se puede desbloquear mediante un código QR. [ 55 ]
Casos similares en Unicode
Los ideogramas unificados CJK en Unicode también incluyen caracteres cuyo historial de inclusión se desconoce y que a veces se denominan «caracteres fantasma». Por ejemplo, se ha señalado que el carácter螀(U+8780), que también se registró en Unicode por estar incluido en el conjunto primario chino CCITT , podría ser un error tipográfico adoptado sin una verificación suficiente de las fuentes. [ 56 ]
U+237C ⍼ ÁNGULO RECTO CON FLECHA EN ZIGZAG HACIA ABAJO fue añadido por Monotype Imaging a sus conjuntos matemáticos en 1972 por razones desconocidas. Desde entonces, se ha incluido en Unicode.
En el bloque de compatibilidad CJK de Unicode 1.0, hay una versión cuadrada de la palabra japonesa para " baht ", escrita en escritura katakana . [ 57 ] El japonés para "baht" esバーツ( bā tsu ). Sin embargo, el glifo de referencia ⟨ ㌬ ⟩ y el nombre del carácter corresponden aパーツ( pātsu , del inglés "parts"). [ 57 ] El punto de código CJK, U+332C ㌬ SQUARE PAATU , está documentado en versiones posteriores del estándar como "una representación errónea y no utilizada" y se dirige a los usuarios a U+0E3F ฿ THAI CURRENCY SYMBOL BAHT en su lugar. [ 58 ] En consecuencia, solo unas pocas fuentes de computadora tienen algún contenido para este punto de código y su uso está obsoleto. [ 57 ]
Referencias
- 1 2 3 47ビット及び8ビットの2バイト情報交換用符号化漢字集合[ Conjunto de caracteres kanji codificados para intercambio de información de 2 bytes de 7 y 8 bits ] (en japonés). Asociación Japonesa de Estándares . 1997.
- ^ Sasahara , Hiroyuki (2007). 国字の位相と展開[ Fases y desarrollo de la escritura nacional ] (en japonés). Sanseidō . págs. 212, 788. ISBN 978-4-385-36263-2.
- ^ Sasahara, Hiroyuki (9 de abril de 2019).Capítulo 9 民間の名字ランキング ——日本に多い名字とは?(4)[ Vol. 9: Clasificación de apellidos en el sector privado: ¿Cuáles son los apellidos más comunes en Japón? (4) ] . Taishukan (en japonés) . Consultado el 3 de septiembre de 2023 .
- ↑ Sasahara 2007 , pág. 780.
- ↑ Sasahara 2007 , pág. 781.
- ↑ Sasahara 2007 , pág. 789.
- ↑ Sasahara 2007 , pág. 826.
- ↑ Sasahara 2007 , pág. 133.
- ↑ Sasahara 2007 , pág. 799.
- ↑ Sasahara 2007 , pág. 827.
- ↑ Sasahara 2007 , pág. 801.
- ↑ Sasahara 2007 , pág. 803.
- 1 2 Sasahara 2007 , pág. 804.
- 1 2 Sasahara 2007 , pág. 805.
- ↑ Sasahara 2007 , pág. 808.
- ↑ Sasahara 2007 , pág. 810.
- ↑ Sasahara 2007 , pág. 811.
- ↑ Sasahara 2007 , pág. 834.
- ↑ Sasahara 2007 , pág. 835.
- ↑ Sasahara 2007 , pág. 836.
- ↑ Sasahara 2007 , pág. 837.
- ^ "三字經六八演音 • Tam tự kinh lục bát diễn âm" . Fundación Nom . pag. 2a.
- 1 2 Sasahara 2007 , pág. 786.
- ↑ Sasahara 2007 , pág. 137.
- 1 2 Sasahara 2007 , pág. 138.
- 1 2 Sasahara 2007 , pág. 130.
- 1 2 Sasahara 2007 , pág. 140.
- ↑ Sasahara 2007 , pág. 797.
- 1 2 Sasahara 2007 , pág. 798.
- ^ Nguyễn, Quang Hồng. Từ điển chữ Nôm dẫn giải . vol. 2. pág. 2011.
- ↑ Sasahara 2007 , pág. 839.
- ↑ Sasahara 2007 , pág. 143.
- 1 2 Sasahara 2007 , pág. 124.
- ↑ Sasahara 2007 , pág. 125.
- ^ Trịnh, Khắc Mạnh (2024). Chữ Hán dị thể ở Việt Nam [ variantes de caracteres chinos en Vietnam ] (en vietnamita). Thế Giới. pag. 440.
- ↑ Sasahara 2007 , pág. 830.
- ↑ Sasahara 2007 , pág. 831.
- ^ Sasahara, Hiroyuki (2006). 日本漢字[ Kanji japonés ] . Iwanami Shinsho (en japonés). Iwanami Shoten . pag. 82.ISBN 4-00-430991-3.
- ^ Hiruma, Naokazu (22 de agosto de 2011).幽霊文字の読み、どこから — 変換辞書のはなし5[¿ De dónde vienen los personajes fantasma? ] . Asahi Shimbun (en japonés) . Consultado el 24 de septiembre de 2023 .
- ^ Izuru, Shinmura (1998). Kōjien (en japonés) (5ª ed.). Iwanami Shoten . ISBN 978-400-0-80111-9.
- ^ Togawa, Yoshio (2016). 漢辞海(en japonés) (4ª ed.). Sanseido . ISBN 978-438-5-14048-3.
- ^ Kamada, Tadashi; Yoneyama, Torataro (2011). 新漢語林(en japonés) (2ª ed.). Taishūkan Shoten. ISBN 978-446-9-03163-8.
- ↑ Sasahara 2007 , pág. 812.
- ↑ "文字情報基盤検索システム / 垈" [ Sistema de recuperación de la base de información de personajes / 垈] . 文字情報技術促進協議会. Consultado el 30 de junio de 2024 .
- ↑ "全面改訂で『新字源』のここが進化" [ El Shin Jigen ha evolucionado en esta edición completamente revisada. ] . 角 川 書店. Archivado desde el original el 16 de abril de 2024 . Consultado el 30 de junio de 2024 .
- 1 2 3 "ISO/IEC 10646:2003 (E)" (PDF) . Consultado el 27 de junio de 2024 .
- ^ Ikeda , Shoju (1 de octubre de 2003). "篆隷万象名義 データベースの改訂" [ Revisión de la base de datos Tenrei Banshō Meigi ] (PDF) . Revista de JAET . 4 : 4-11 . Consultado el 29 de junio de 2024 .
- ^ Sasahara, Hiroyuki (25 de marzo de 2019). "字体に生じる偶然の一致: 「JIS X0208」と他文献における字体の「暗合」と「衝突」" [ Coincidencia en Glifos: Glifos en ""JIS X0208"" y otras literaturas ""Implicación"" y ""Conflicto"". ] .日本語科学. 1 : 7-24 . Consultado el 29 de junio de 2024 .
- ↑ "Estándar Unicode / Versión 15.1.0 Índice de trazos de radicales" (PDF) . Unicode, Inc. 2023. Consultado el 29 de junio de 2024 .
- ↑ Sasahara 2007 , pág. 790.
- ^ Niwa, Motoji (1998). 苗字のはなし2[ Sin apellido 2 ] (en japonés). Houbunkan. pág. 165. ISBN 978-4-990-05847-0.
- ^ Naokazu, Hiruma (5 de septiembre de 2011).大正十二年の幽霊文字[ Personajes fantasma de 1923 ] (en japonés) . Consultado el 10 de septiembre de 2023 .
- ^ Yomisaka, Yuji (2022). 5A73 (en japonés). Kobunsha . ISBN 9784334914745.
- ↑ "Diversión electrónica"閠槞彁の願い. beatmania IIDX 28 BISTROVER (en japonés) . Consultado el 10 de septiembre de 2023 .
- ↑ Entretenimiento Bandai Namco . "¡最新曲・人気曲がたくさん!" [¡ Muchas de las canciones más recientes y populares! (lista de canciones de Taiko no Tatsujin: Nijiiro Ver.) ] (en japonés).
- ^ Yasuoka, Koichi; Yasuoka, Motoko (1997).「唡」はなぜJIS X 0221に含まれているのか —Unicode幽霊字研究—[¿ Por qué se incluye "唡" en JIS X 0221? ] (PDF) (en japonés). Sociedad de Procesamiento de la Información de Japón .
- 1 2 3 Lunde, Ken (26 de marzo de 2016). "Tipo CJK | Fuentes, conjuntos de caracteres y codificaciones CJK. Todo CJK. Todo el tiempo" . Adobe Inc. Archivado del original el 29 de junio de 2016. Recuperado el 7 de julio de 2024 .
- ↑ "Compatibilidad CJK 3300–33FF" (PDF) . El estándar Unicode, versión 15.1 . págs. 3327–334C.
Enlaces externos
Contenido multimedia relacionado con los personajes de Ghost en Wikimedia Commons.
Definición de personaje fantasma en Wikcionario
- Codificación de caracteres
- Listas de caracteres chinos
- Error
- Unicode