La silabificación ( / s ɪ ˌ l æ b ɪ f ɪ ˈ k eɪ ʃ ən / ) o división silábica ( / s ɪ ˌ l æ b ɪ ˈ k eɪ ʃ ən / ), también conocida como guionización , es la separación de una palabra en sílabas , ya sea hablada, escrita [ 1 ] o signada. [ 2 ]
Descripción general
La separación escrita en sílabas se suele marcar con un guion cuando se utiliza la ortografía inglesa (p. ej., syl-la-ble) y con un punto cuando se transcriben las sílabas habladas en el Alfabeto Fonético Internacional (p. ej., [ˈsɪl.ə.bᵊɫ] ). Para fines de presentación, los tipógrafos pueden usar un punto medio ( carácter Unicode U+00B7, p. ej., syl·la·ble), un "punto de división silábica" especial (U+2027, p. ej., syl‧la‧ble) o un espacio (p. ej., syl la ble).
Al final de una línea, una palabra se divide en sílabas, si no cabe en la línea y si al pasarla a la siguiente la primera línea queda mucho más corta que las demás. Esto puede ser un problema, sobre todo con palabras muy largas y con columnas estrechas en los periódicos. El procesamiento de textos ha automatizado la justificación , lo que hace que la división silábica de palabras cortas sea a menudo innecesaria.
En algunos idiomas, las sílabas habladas también sirven de base para la división silábica en la escritura. Sin embargo, posiblemente debido a la débil correspondencia entre sonidos y letras en la ortografía del inglés moderno, la división silábica escrita en inglés se basa principalmente en principios etimológicos o morfológicos , en lugar de fonéticos . Por ejemplo, no es posible dividir "learning" en sílabas como lear-ning según la división silábica correcta de la lengua viva. Ver solo lear- al final de una línea podría llevar al lector a pronunciar la palabra incorrectamente, ya que el dígrafo ea puede tener muchos valores diferentes . La historia de la ortografía inglesa explica este fenómeno.
Por lo tanto, la división silábica escrita en inglés se ocupa de un concepto de "sílaba" que no se corresponde con el concepto lingüístico de unidad fonológica (en contraposición a la morfológica).
Como resultado, incluso la mayoría de los hablantes nativos de inglés son incapaces de dividir las palabras en sílabas según las reglas establecidas sin consultar un diccionario o usar un procesador de textos. Las escuelas generalmente no ofrecen mucha más información sobre el tema que la recomendación de consultar un diccionario. Además, existen diferencias entre la división silábica británica y la estadounidense, e incluso entre diccionarios de la misma variedad de inglés.
En finés , italiano , portugués , japonés ( romaji ), coreano ( romanizado ) y otras lenguas con ortografía casi fonética, los escritores pueden, en principio, dividir silábicamente cualquier palabra, ya sea existente o de nueva creación, utilizando únicamente reglas generales. En Finlandia, a los niños se les enseña primero a dividir cada palabra con guiones hasta que logran la división silábica correcta de forma fiable, tras lo cual se pueden omitir los guiones.
Algoritmo
Un algoritmo de división de palabras es un conjunto de reglas, especialmente uno codificado para su implementación en un programa informático, que decide en qué puntos una palabra puede dividirse en dos líneas con un guion. Por ejemplo, un algoritmo de división de palabras podría decidir que impeachment puede dividirse como impeach-ment o imp-peachment , pero no como impe-achment .
Una de las razones de la complejidad de las reglas de división de palabras es que los distintos dialectos del inglés tienden a diferir en la división silábica: el inglés americano tiende a basarse en el sonido, mientras que el inglés británico tiende a considerar primero el origen de la palabra y luego su sonido. [ 3 ] También existen numerosas excepciones, lo que complica aún más la situación. [ 3 ] Algunas directrices pueden encontrarse en el artículo de Major Keary «Sobre la división silábica: la anarquía de la pedantería». [ 3 ]
Entre los métodos algorítmicos para la división de palabras, el implementado en el sistema de composición tipográfica TeX es ampliamente utilizado. Está documentado exhaustivamente en los dos primeros volúmenes de Computers and Typesetting de Donald Knuth y en la tesis doctoral de Franklin Mark Liang. [ 4 ] El objetivo del trabajo de Liang era lograr que el algoritmo fuera lo más preciso posible y minimizar las excepciones.
Además de identificar patrones basados en reglas, los enfoques algorítmicos a menudo incluyen excepciones codificadas palabra por palabra para divisiones de palabras suficientemente importantes que los patrones no producen. [ 5 ] El algoritmo de división de palabras TeX original utilizaba una lista de excepciones de aproximadamente 300 palabras. [ 6 ] En TeX82 , se añadieron más de 1000 palabras a esta lista. [ 7 ] En los patrones de división de palabras de Plain TeX de Knuth para el inglés americano, la lista de excepciones contiene solo 14 palabras. [ 8 ] [ 9 ]
En TeX
Existen versiones del algoritmo de división de palabras de TeX disponibles como bibliotecas para varios lenguajes de programación, incluidos Haskell , JavaScript , Perl , PostScript , Python , Ruby , C# y TeX puede mostrar guiones en el registro mediante el comando \showhyphens.
En LaTeX , los usuarios pueden agregar corrección de guiones utilizando:
\hyphenation{palabras}El \hyphenationcomando declara los puntos de división silábica permitidos en los que palabras es una lista de palabras, separadas por espacios, en la que cada punto de división silábica está indicado por un -carácter. Por ejemplo,
\hyphenation{fortran er-go-no-mic}declara que en el trabajo actual "fortran" no debe ir con guion y que si "ergonomic" debe ir con guion, será en uno de los puntos indicados. [ 10 ]
Sin embargo, existen varias limitaciones. Por ejemplo, el \hyphenationcomando estándar solo acepta letras ASCII por defecto, por lo que no se puede usar para corregir la división de palabras con caracteres no ASCII (como ä , é , ç ), que son muy comunes en muchos idiomas. No obstante, existen soluciones sencillas. [ 11 ] [ 12 ]
Véase también
Notas
- ↑ El término también se usa para el proceso de una consonante que se convierte en silábica. Por ejemplo, en el inglés del centro norte de Estados Unidos , "can" puede pronunciarse [kən] o [kn̩] con una /n/ silábica.
- ↑ Baus, C.; Gutiérrez, E.; Carreiras, M. (13 de noviembre de 2014). "El papel de las sílabas en la producción del lenguaje de señas" . Frontiers in Psychology . 5 : 1254. doi : 10.3389/fpsyg.2014.01254 . PMC 4230165. PMID 25431562 .
- 1 2 3 Mayor Keary. "Sobre la guionización: anarquía de la pedantería" . PC Update . Grupo de usuarios de PC de Melbourne. Archivado del original el 10 de marzo de 2005. Recuperado el 6 de octubre de 2005 .
- ↑ Liang, Franklin Mark (agosto de 1983). División de palabras mediante computador (doctorado). Departamento de Ciencias de la Computación, Universidad de Stanford . STAN-CS-83-977.
- ↑ Liang, véanse sus comparaciones del estado de la técnica anterior.
- ^ Liang, pág. 3
- ^ Liang, pág. 29
- ↑ "Las tablas de división de palabras de Plain TeX" . Líneas 4454–4469 . Consultado el 23 de junio de 2009 .
\hyphenation{ % ¡NO realice ninguna modificación a esta lista! --- DEK asociado asociados declinación obligatorio filantrópico presente presenta proyecto proyectos reciprocidad reconocimiento reforma venganza mesa } - ↑ Donald E. Knuth, The TeXbook , "Apéndice H: Guionización".
TeX utiliza como entrada un archivo llamado hyphen.tex que configura el diccionario de patrones y el diccionario de excepciones inicial. [...] Las primeras trece excepciones impiden que TeX inserte guiones incorrectos; por ejemplo, «pro-ject» y «pre-sent» son palabras como «re-cord», que no pueden dividirse con guiones sin conocer el contexto. La otra excepción, «ta-ble», se incluye simplemente para cumplir con la afirmación de que TeX divide con guiones las aproximadamente 700 palabras más comunes del inglés.
- ↑ Green, Sheldon (5 de junio de 1995). "\hyphenation" . Ayuda de hipertexto con LaTeX . Grupo de procesamiento y análisis de imágenes de Yale. Archivado del original el 27 de noviembre de 2023.
- ↑ "Las palabras acentuadas no llevan guion" . Preguntas frecuentes de TeX . Archivado del original el 28 de noviembre de 2023.
- ↑ "¿Cómo funciona la división de palabras en TeX?" . Preguntas frecuentes de TeX . Archivado del original el 27 de noviembre de 2023.
Enlaces externos
- Divide las sílabas de las letras de las canciones en línea : divide el texto en inglés en sílabas.
- Herramienta de división de palabras para el idioma francés : divide palabras en francés con guiones y explicaciones.
- Fonotáctica