

El método de entrada Wubizixing ( chino simplificado :五笔字型输入法; chino tradicional :五筆字型輸入法; pinyin : wǔbǐ zìxíng shūrùfǎ ; lit. ' método de entrada de caracteres de cinco trazos ' ), a menudo abreviado simplemente como Wubi o Wubi Xing , [ 1 ] es un método de entrada de caracteres chinos principalmente para introducir texto en chino simplificado y chino tradicional en un ordenador. Wubi no debe confundirse con el método Wubihua (五笔画) , que es un método de entrada diferente que comparte la categorización en cinco tipos de trazos.
El método también se conoce como Wang Ma ( chino simplificado :王码; chino tradicional :王碼; pinyin : Wáng mǎ ; lit. ' código Wang ' ), llamado así por su inventor, Wang Yongmin (王永民). Existen cuatro versiones de Wubi consideradas estándar: Wubi 86, Wubi 98, Wubi 18030 y Wubi New-century (la versión de tercera generación). Las tres últimas también pueden utilizarse para introducir texto en chino tradicional , aunque de forma más limitada. Wubi 86 es el método de entrada basado en formas más conocido y utilizado para teclados completos en China continental . Si se necesita introducir caracteres chinos tradicionales con frecuencia, otros métodos como Cangjie o Zhengma pueden ser más adecuados y, además, es mucho más probable encontrarlos en el ordenador que se vaya a utilizar.
El método Wubi se basa en la estructura de los caracteres en lugar de su pronunciación, lo que permite introducir caracteres incluso cuando el usuario desconoce la pronunciación, además de no estar demasiado vinculado a ninguna variedad hablada de chino en particular . También es extremadamente eficiente: casi todos los caracteres se pueden escribir con un máximo de 4 pulsaciones de teclas. En la práctica, la mayoría de los caracteres se pueden escribir con menos. Hay informes de mecanógrafos experimentados que alcanzan los 160 caracteres por minuto con Wubi. [ 2 ] Lo que esto significa en el contexto del chino no es exactamente lo mismo que en el inglés, pero es cierto que Wubi es extremadamente rápido cuando lo usa un mecanógrafo experimentado. La razón principal de esto es que, a diferencia de los métodos de entrada fonética tradicionales, no es necesario perder tiempo seleccionando el carácter deseado de una lista de posibilidades homófonas: prácticamente todos los caracteres tienen una representación única.
Como su nombre indica, el teclado está dividido en cinco regiones. El carácter chino笔(bǐ), cuando se utiliza en el contexto de la escritura de caracteres chinos, se refiere a los trazos de pincel empleados en la caligrafía china. A cada región se le asigna un tipo de trazo específico.
- Región 1: horizontal (一)
- Región 2: vertical (丨)
- Región 3: descendente de derecha a izquierda (丿)
- Región 4: trazos de puntos o trazos descendentes de izquierda a derecha (丶)
- Región 5: gancho (乙)
Al ser un sistema más complejo, dominar Wubi lleva más tiempo. La memorización y la práctica son factores clave para un uso eficaz.
Para usar Wubi, existen varios métodos de entrada disponibles, incluyendo las Herramientas de Entrada de Google (utilizadas por Google Translate) y las opciones de teclado en dispositivos Mac. Las secuencias de caracteres específicos de Wubi se pueden consultar en diccionarios en línea.
En este artículo se utilizará la siguiente convención: carácter siempre se referirá a un carácter chino, mientras que letra , tecla y pulsación de tecla siempre se referirán a las teclas del teclado.

Cómo funciona
Básicamente, un carácter se descompone en componentes, que suelen ser (aunque no siempre) los mismos que los radicales . Estos se teclean en el orden en que se escribirían a mano . Para garantizar que los caracteres extremadamente complejos no requieran un número excesivo de pulsaciones, cualquier carácter que contenga más de 4 componentes se introduce tecleando primero los 3 primeros y luego el último. De esta forma, los datos de cada carácter se pueden introducir con no más de 4 pulsaciones.
Wubi distribuye sus caracteres de forma muy uniforme, por lo que la gran mayoría se definen de forma única mediante las cuatro teclas mencionadas anteriormente. A continuación, se pulsa un espacio para mover el carácter del búfer de entrada a la pantalla. Si la representación de cuatro letras del carácter no es única, se pulsa un dígito para seleccionar el carácter correspondiente (por ejemplo, si dos caracteres tienen la misma representación, al pulsar 1 se selecciona el primero y al pulsar 2 el segundo). En la mayoría de las implementaciones, siempre se puede pulsar un espacio, que simplemente equivale a un 1 en caso de ambigüedad. El software inteligente intentará asegurarse de que el carácter en la posición predeterminada sea el deseado.
Muchos caracteres tienen más de una representación. Esto a veces se debe a que facilita su uso, en caso de que exista más de una forma obvia de descomponer un carácter. Sin embargo, con mayor frecuencia, se debe a que ciertos caracteres tienen una representación corta de menos de 4 letras, además de una representación completa.
Para caracteres con menos de 4 componentes que no tienen una representación abreviada, se escribe cada componente y luego se completa la representación (es decir, se escriben suficientes pulsaciones adicionales para que la representación tenga 4 pulsaciones) escribiendo manualmente las pulsaciones del último componente, en el orden en que se escribirían. Si hay demasiadas pulsaciones, se deben escribir tantas como sea posible, pero colocando la última al final (esto refleja la regla de componentes para caracteres con más de 4 componentes descrita anteriormente).
Una vez comprendido el algoritmo, con un poco de práctica se puede escribir casi cualquier carácter, incluso sin haberlo escrito antes. La memoria muscular garantiza que quienes escriben con frecuencia utilizando este método no tengan que pensar en cómo se construyen realmente los caracteres, del mismo modo que la gran mayoría de los mecanógrafos en inglés no se preocupan demasiado por la ortografía de las palabras al escribir.
Implementación de detalles específicos
Muchas implementaciones emplean optimizaciones adicionales de varias palabras. Por lo general, un dígrafo común (una palabra de dos caracteres) en el que ambos caracteres tienen representaciones abreviadas de dos pulsaciones de tecla se puede combinar en una única representación de cuatro pulsaciones que genera dos caracteres en lugar de uno. También existen algunos atajos de tres caracteres , e incluso uno bastante más largo con motivaciones políticas. Algunos ejemplos se proporcionan en la sección de ejemplos a continuación.
Otra característica común es el uso de la tecla 'z' como comodín. El método Wubi se diseñó precisamente teniendo en cuenta esta función; por eso no se asignan componentes a la tecla 'z'. Básicamente, se puede escribir 'az' cuando no se sabe cuál debería ser el componente, y el método de entrada ayudará a completarlo. Si se supiera, por ejemplo, que el carácter debería empezar con "kt", pero no se supiera cuál debería ser el siguiente componente, al escribir "ktz" se obtendría una lista de todos los caracteres que empiezan con "kt". Sin embargo, en la práctica, muchos motores de métodos de entrada utilizan un método de búsqueda tabular para todos los sistemas de entrada basados en tablas, incluido Wubi. Esto significa que simplemente tienen una tabla grande en memoria, asociando diferentes caracteres a sus respectivas representaciones. El método de entrada se convierte entonces simplemente en una búsqueda en la tabla. En dicha implementación, la tecla 'z' rompe el paradigma y, por lo tanto, no se encuentra en muchos programas generalizados (aunque el método de entrada Wubi, común en Windows en chino, implementa esta función). Por esta misma razón, la optimización de múltiples caracteres descrita en el párrafo anterior también es relativamente rara.
Algunos métodos de entrada, como xcin (presente en muchos sistemas tipo UNIX), ofrecen una funcionalidad genérica de comodín que se puede usar en todos los sistemas de entrada basados en tablas, incluyendo pinyin y prácticamente cualquier otro. Xcin usa '*' para autocompletar y '?' para una sola letra, siguiendo las convenciones establecidas en la expansión de comodines de archivos de UNIX. Otras implementaciones tienen sus propias convenciones.
Subdivisión del teclado
El teclado Wubi adopta una distribución tipo QWERTY , por lo que los usuarios de teclados con distribuciones nacionales o alternativas (como Dvorak o la francesa AZERTY ) probablemente tendrán que reasignar las teclas para que el sistema funcione correctamente. Wubi no coloca sus componentes de forma arbitraria: son demasiados, y solo con una metodología lógica el sistema resulta fácil de aprender.
Básicamente, el teclado está dividido en 5 zonas, cada una representando un tipo de trazo. Estos cinco trazos son: descendente a la izquierda, descendente a la derecha, horizontal, vertical y gancho, y las zonas que los representan son QWERT, YUIOP, ASDFG, HJKLM y XCVBN, respectivamente. Todas estas zonas están dispuestas horizontalmente, con la excepción de la M, que no está alineada con el resto de las letras de su zona.
En términos generales, el teclado puede considerarse dividido por la mitad entre T e Y, G y H, y N y M. Las teclas de cada zona se numeran alejándose de esta línea divisoria: así, en la zona QWERT, T es la primera letra, R la segunda y E la tercera; en la zona YUIOP, Y es la primera, U la segunda, I la tercera, etc. Para XCVBN, N es la primera, y así sucesivamente. En HJKLM, M se considera la última de la serie, aunque no esté sobre la línea divisoria.
Esto es importante porque los componentes en la primera posición tendrán una repetición del trazo en cuestión (el trazo asignado a la zona a la que pertenecen), los de la segunda, dos, y los de la tercera, tres. Los componentes que no se puedan clasificar fácilmente con este paradigma se colocarán en la última letra.
Por lo tanto, cabría esperar que 一 se ubicara en G, 二 en F y 三 en D, y de hecho, así es. Del mismo modo, cabría esperar que 丨 se ubicara en H, 刂 en J y 川 en K. Este patrón se mantiene en todas las zonas. Además, se extiende a la mayoría de los radicales que parecen estar formados por tres trazos de este tipo, aunque en realidad no lo estén. Un ejemplo de esto es 中 en K: si bien no tiene tres trazos descendentes (solo dos), parece tener tres. Además, se escribe a mano escribiendo primero un radical de boca, 口, y luego dividiéndolo con un trazo vertical descendente. El radical de boca se encuentra en 'K', por lo que esto hace que la asignación sea doblemente lógica. Y la romanización pinyin de 口, kou3, comienza con k, otra ayuda mnemotécnica codificada en el teclado Wubi.
Además, cada letra de cada zona tiene un componente asociado, su "componente principal". Estos suelen ser caracteres completos (con la excepción de la X). Este componente principal se puede escribir tecleando cuatro veces la letra en la que se encuentra. Por ejemplo, el componente principal de la H es 目, y se escribiría tecleando "hhhh".
Cada letra tiene asociado un carácter abreviado. En algunos casos, este carácter coincide con el componente asociado a la tecla en cuestión, y en otros, no. Este carácter abreviado se obtiene al teclear solo la letra; son caracteres muy comunes al escribir en chino.
Es muy posible que haya varios componentes que no figuren en la lista a continuación, ya sea por descuido, porque se utilizan con poca frecuencia o porque no existe una representación Unicode sencilla para el componente.
Zona QWERT (caída a la izquierda)
El componente principal de la tecla Q es 金 y su carácter de acceso directo es 我. Está asociada con los siguientes componentes: 金, 钅, 勹, 儿, 夕, así como el gancho en la parte superior de 饣 y 角, el radical 犭sin el trazo inferior izquierdo descendente (por lo que los caracteres con ese radical comienzan con "qt", no solo "q"), el entrecruzado (como en el centro de 区), la parte superior de 鱼 (es decir, sin el trazo horizontal en la parte inferior) y los tres "pies" (casi verticales) en la esquina inferior derecha de 流.
El componente principal y el carácter de acceso directo de la tecla W son ambos 人. Se asocia con los siguientes componentes: 人, 亻, 八 y la parte superior de 癸. Si bien 人 significa persona, Wubi lo usa a menudo para construir un radical de techo, como en 会, "wfc". 入 no se rige por la W, a pesar de su parecido, y aunque 餐 tiene una parte superior que se parece vagamente a la de 癸, no son lo mismo (de hecho, para escribir 餐, hay que escribir físicamente cada componente de la parte superior).
El componente principal de la tecla E es 月, y su carácter abreviado es 有. Está asociado con los siguientes componentes: 月, 用, 彡, 乃, la parte inferior de 衣 (es decir, sin 亠), la parte superior de 孚 (es decir, sin 子), 豕 (hog), la parte inferior de 良 (es decir, sin 白), y la parte inferior de 舟 (es decir, sin el pequeño punto en la parte superior). En este caso, el carácter abreviado de E ni siquiera comienza con un trazo descendente hacia la izquierda, sino que simplemente figura prominentemente un componente perteneciente a E. 彡 se presenta en este carácter, ya que es el tercer carácter en la zona (contando desde T, ver arriba). Una distorsión particular que aparece a menudo es el uso de E en 且 y en caracteres que lo contienen: Wubi piensa en este componente como 月 + 一.
El componente principal de la tecla R es 白, y su carácter de acceso directo es 的. Está asociada con los siguientes componentes: 白, 手, 扌, 斤 (tanto con como sin la T), 牛 ( sin el trazo vertical descendente), y por supuesto los dos trazos descendentes hacia la izquierda 𰀪 que se esperarían de la segunda tecla en la zona (ver más arriba para una explicación). Tenga cuidado con las variantes de 手 donde el gancho descendente central se reemplaza por un trazo descendente hacia la izquierda, como en 看.
El componente principal de la tecla T es 禾, y su carácter abreviado es 和. Se asocia con los siguientes componentes: 禾, 竹, 夂, 攵, 彳 y la parte superior de 乞 (es decir, sin 乙). 竹 también puede encontrarse en su forma más pequeña (⺮). 丿 también se encuentra en esta tecla, ya que T es la primera tecla en la zona (véase más arriba). Esto significa que si se escribe un componente o carácter trazo a trazo, generalmente se usaría T para representar un trazo descendente hacia la izquierda. Consulte la sección sobre trazos de desambiguación para obtener más información sobre las excepciones a esta regla.
Zona YUIOP (caída a la derecha)
Esta zona también podría denominarse zona de puntos, ya que su patrón de Y: 讠 U: 冫 I: 氵 y O: 灬 no necesariamente se compone de trazos descendentes hacia la derecha. De hecho, se podría argumentar que el primer trazo de 灬 cae hacia la izquierda . Se denomina zona descendente derecha porque las teclas de esta zona, cuando se utilizan para construir un carácter por trazo (en lugar de por componente), representan trazos descendentes hacia la derecha para alguna configuración de caracteres (véase la sección sobre trazos de desambiguación para más información).
El componente principal de la tecla Y es 言, y su carácter abreviado es 主. Se asocia con los siguientes componentes: 言, 讠, 亠, 亠 con 口 debajo, 广, 文, 方 y 丶. Todos estos componentes comienzan con un trazo descendente hacia la derecha. Generalmente, los puntos en los caracteres chinos son trazos descendentes hacia la izquierda , por lo que, en la mayoría de los casos, el uso de T es más apropiado que el de Y. Por supuesto, si alguien puede escribir caracteres chinos a mano, debería poder determinar cuál elegir recordando cómo se escriben.
El componente principal de la tecla U es 立, y su carácter de acceso directo es 产. Se asocia con los siguientes componentes: 立, 六, 辛, 门, 疒, 丬, 冫, las "antenas" en la parte superior de 单 (solo dos trazos: 丷), y las antenas más un trazo horizontal, como se encuentra en la parte superior de 兹. La mayoría de estos presentan dos trazos diagonales cortos (门 es la excepción obvia). Esto es consistente con la posición de U como la segunda letra en la zona (ver más arriba para una explicación).
El componente principal de la tecla I es 水, y su carácter de acceso directo es 不. Se asocia con los siguientes componentes: 水, 氵, 小, los tres trazos superiores de 学 y los tres trazos superiores de 当. Además, se asocia con un componente que podría describirse como dos 冫, uno detrás del otro.
El componente principal de la tecla O es 火, y su carácter abreviado es 为. Se asocia con los siguientes componentes: 火, 米, 灬 y 业sin el trazo horizontal inferior; esto permite la construcción de caracteres como 严. Esta es la cuarta tecla en la zona descendente derecha; de ahí la inclusión de 灬.
El componente principal de la tecla P es 之, y su carácter de acceso directo es 这. Está asociado con los siguientes componentes: 之, 辶, 廴, 冖, 宀 y 礻. Como los componentes de Wubi se escriben en el orden en que se escribirían a mano, los componentes 辶 y 廴 se suelen escribir al final .
Zona ASDFG (horizontal)
- El carácter de acceso directo a la tecla A es 工.
- El componente principal de la tecla S es 木, y su carácter de acceso directo es 要.
- El componente principal de la tecla D es 大, y su carácter de acceso directo es 在.
- El componente principal de la tecla F es 土, y su carácter de acceso directo es 地. El nombre del componente principal (tierra) se corresponde con el carácter de acceso directo que significa tierra.
- El componente principal de la tecla G es 王, y su carácter de acceso directo es 一.
Zona HJKLM (vertical)
- El componente principal de la tecla H es 目, y su carácter de acceso directo es 上.
- El componente principal de la tecla J es 日, y su carácter de acceso directo es 是.
- El componente principal de la tecla K es 口, y su carácter de acceso directo es 中.
- El componente principal de la tecla L es 田, y su carácter de acceso directo es 国.
- El componente principal de la tecla M es 山, y su carácter de acceso directo es 同.
Zona XCVBN (gancho)
- El componente principal de la tecla X es 纟, y su carácter de acceso directo es 经.
- El componente principal de la tecla C es 又, y su carácter de acceso directo es 以.
- El componente principal de la tecla V es 女, y su carácter de acceso directo es 发.
- El componente principal de la tecla B es 子, y su carácter de acceso directo es 了.
- El componente principal de la tecla N es 已, y su carácter de acceso directo es 民.
trazos de desambiguación
Las pulsaciones del teclado se dividen en 5 zonas.
Ejemplos
Caracteres con 4 componentes o menos (pero sin necesidad de trazos)
Ejemplo 1: 请 Consta de tres componentes: y (讠, radical #10), g (王*, radical 89), e (月, radical 118) → 请
Personajes con más de cuatro componentes
Ejemplo 2: 遗
Consta de cinco componentes: k (口), h (丨), g (一), m (贝), p (辶) → khgp → 遗 (no es necesario escribir m)
Caracteres con menos de 4 componentes (que necesitan trazos)
Ejemplo 3a: 文: Primero escribes la tecla con el símbolo, que resulta ser 'Y'. Luego escribes el primer componente, que también es 'Y' para el trazo 点, luego una 'G' para el trazo 横, y como ahora ya tienes tres trazos, escribes el último trazo, que también resulta ser un 捺, llegando al código de tecla 'YYGY' para el carácter completo.
Ejemplo 3b: 一: El código para este carácter es 'GGLL'. Como antes, primero se escribe la tecla del carácter, que es 'G', y luego el primer trazo de ese carácter, que también es una 'G'. Como toda esta información es necesaria, la L se usa como relleno hasta llegar a 4 letras. [ 2 ] Nótese que '一' también es el carácter abreviado para 'G' (lo que hace que en la práctica sea un solo trazo).
Ejemplo 3c: 广: El código para este carácter es 'YYGT'. Primero, pulsas la tecla donde se encuentra este carácter, que es una 'Y'. Luego, pulsas el trazo 点, que también se encuentra en la 'Y'. A continuación, pulsas el trazo 横 en la 'G', y por último, pulsas el trazo 捺 en la 'T'.
Caracteres que requieren trazos de desambiguación
Ejemplo 4:
Consta de tres componentes: t (竹), f (土), f (寸),
Trazos de desambiguación: El último trazo es 丶 y el carácter tiene una estructura de arriba a abajo (42,u) → 等
Entonces, el código de caracteres para 等 es 'TFFU'.
Poema
Se creó un poema como regla mnemotécnica para el teclado Wubi, asociando algunos caracteres a cada tecla. El primer carácter es el componente principal de la tecla correspondiente, mientras que los siguientes son componentes o caracteres asociados.
versión de 1986
G11王旁青头戋五一 F12土士二干十寸雨 D13大犬三羊古石厂 S14木丁西 A15工戈草头右框七 H21目具上止卜虎皮 J22日早两竖与虫依 K23口与川,字根稀 L24田甲方框四车力 M25山由贝,下框几 T31禾竹一撇双人立,反文条头共三一 R32白手看头三二斤 E 33月彡(衫)乃用家衣底 W34人和八,登祭头 Q35金勺缺点无尾鱼,犬旁留义儿一点夕,氏无七 Y41言文方广在四一,高头一捺谁人去 U42立辛两点六门疒(病) I43 水旁兴头小倒立 O44火业头,四点米 P45之宝盖,摘示衣 N51已半巳满不出己,左框折尸心和羽 B52子耳了也框向上 V53女刀九臼山朝西 C54又巴马,丢矢矣 X55慈母无心弓和匕,幼无力
versión de 1998
G11 王旁青头五夫一 F12 土干十寸未甘雨,不要忘了革字底 D13 大犬戊其古石厂 S14木丁西甫一四里 A15 工戈草头右框七 H21 目上卜止虎具头 J22 日早两竖与虫依 K23口流川,码元稀 L24 田甲方框四车里 M25 山由贝骨下框集 T31 禾竹反文双人立 R32 白斤气丘叉手提 E33月用力豸毛衣臼 W34 人八登头单人几 Q35 金夕鸟儿犭边鱼 Y41 言文方点谁人去 U42立辛六羊病门里 I43 水族三点鳖头小 O44 火业广鹿四点米 P45 之字宝盖补示衣 N51 已类左框心尸羽 B52子耳了也乃框皮 V53 女刀九良山西倒 C54 又巴牛入马失蹄 X55 幺母贯头弓和匕
Versión del nuevo siglo (tercera generación)
G11 王旁青头五一提 F12 土士二干十寸雨 D13 大三肆头古石厂 S14 木丁西边要无女 A15工戈草头右框七 H21 目止具头卜虎皮 J22 日曰两竖与虫依 K23 口中两川三个竖 L24田框四车甲单底 M25 山由贝骨下框里 T31 禾竹牛旁卧人立 R32 白斤气头叉手提 E33 月舟衣力豕豸臼 W34人八登祭风头几 Q35 金夕犭儿包头鱼 Y41 言文方点在四一 U42 立带两点病门里 I43水边一族三点小 O44 火变三态广二米 P45 之字宝盖补示衣 N51 已类左框心尸羽 B52 子耳了也乃齿底 V53女刀九巡录无水 C54 又巴甬矣马失蹄 X55 幺母绞丝弓三匕
En los medios
En 2020, la historia de Wubi fue presentada en un episodio de Radiolab titulado "El efecto Wubi". [ 3 ]
Notas y referencias
Enlaces externos
- Sitio web oficial
- Tablas completas de secuencias de Wubi
- Métodos de entrada CJK
- Métodos de entrada