Articulo de referencia

brillo interlineal

En lingüística y pedagogía , una glosa interlineal es una glosa (una serie de explicaciones breves, como definiciones o pronunciaciones) colocada entre líneas, por ejemplo, entr...

En lingüística y pedagogía , una glosa interlineal es una glosa (una serie de explicaciones breves, como definiciones o pronunciaciones) colocada entre líneas, por ejemplo, entre una línea del texto original y su traducción a otro idioma . Al glosar, cada línea del texto original adquiere una o más líneas de transcripción correspondientes, conocidas como texto interlineal o texto interlineal glosado ( TIG ) , o simplemente interlineal . Estas glosas ayudan al lector a comprender la relación entre el texto fuente y su traducción, así como la estructura del idioma original. En su forma más simple, una glosa interlineal es una traducción literal, palabra por palabra, del texto fuente . 

Historia

Texto interlineal en Toussaint–Langenscheidt Spanisch , un libro de texto en español para hablantes de alemán , 1910

Las glosas interlineales se han utilizado con diversos fines durante mucho tiempo. Un uso común ha sido la anotación de libros de texto bilingües para la enseñanza de idiomas. Este tipo de interlinealización ayuda a explicitar el significado de un texto original sin intentar modelar formalmente las características estructurales de la lengua de origen.

Tales anotaciones se han expresado ocasionalmente no a través de una disposición interlineal, sino más bien a través de la enumeración de palabras en el objeto y el metalenguaje. Un ejemplo de ello es la anotación de Wilhelm von Humboldt del náhuatl clásico : [ 1 ]

1

ni-

1

ich

2

do-

3

mache

3

chihuí

2

es

4

-lia

4

pelo

5

en

5

del

6

No-

6

mi

7

pitzin

7

Hijo

8

ce

8

un

9

calli

9

Casa

1 2 3 4 5 6 7 8 9

ni- c- chihui -lia in no- piltzin ce calli

1 3 2 4 5 6 7 8 9

ich mache es für der mein Sohn ein Haus

Este estilo «en línea» permite incluir ejemplos dentro del flujo del texto y que el orden de las palabras del idioma de destino se escriba de forma que se aproxime a su sintaxis. (En la glosa, «mache es» se reordena respecto al orden original para que se ajuste mejor a la sintaxis alemana). Aun así, este enfoque exige que los lectores «reajusten» las correspondencias entre las formas de origen y de destino.

Los enfoques más modernos de los siglos XIX y XX adoptaron la glosa vertical, alineando el mismo tipo de contenido palabra por palabra de tal manera que los términos del metalenguaje se colocaban verticalmente debajo de los términos del idioma original. En este estilo, el ejemplo dado podría presentarse así (aquí la glosa en inglés):

ni-

I

do-

él

chihuí

hacer

-lia

para

en

hacia

No-

mi

pitzin

hijo

ce

a

calli

casa

ni- c- chihui -lia in no- piltzin ce calli

Lo hago para mi hijo una casa

"Le construí una casa a mi hijo."

Aquí, el orden de las palabras viene determinado por la sintaxis del lenguaje objeto.

Finalmente, los lingüistas modernos han adoptado la práctica de usar etiquetas abreviadas para las categorías gramaticales . Una publicación de 2008 que repite este ejemplo lo etiqueta de la siguiente manera: [ 2 ]

ni-c-chihui-lia

1SG . SUBJ - 3SG . OBJ -mach- APPL

en

DET

sin pitzin

1SG . POSS -Sohn

ce

un

calli

Casa

ni-c-chihui-lia en no-piltzin ce calli

1SG.SUBJ-3SG.OBJ-mach-APPL DET 1SG.POSS-Sohn ein Haus

Este enfoque es más denso y también requiere esfuerzo para su lectura, pero depende menos de la estructura gramatical del metalenguaje para expresar la semántica de las formas objetivo.

En informática, en el bloque Unicode de caracteres especiales se proporcionan marcadores de texto especiales para indicar el inicio y el final de las glosas interlineales.

Estructura

Aunque no existe una especificación formal para el formato IGT, las Reglas de glosado de Leipzig [ 3 ] son ​​un conjunto de directrices que pretenden estandarizar el formato tanto como sea posible.

Un texto interlineal para lingüística generalmente constará de algunos o todos los siguientes elementos, normalmente en este orden, de arriba a abajo:

  • La ortografía original (normalmente en cursiva o negrita cursiva ),
  • una transliteración convencional al alfabeto latino,
  • una transcripción fonética ,
  • una transliteración morfofonémica ,
  • una glosa palabra por palabra o morfema por morfema, donde los morfemas dentro de una palabra están separados por guiones u otros signos de puntuación,

y finalmente

  • una traducción libre, que puede colocarse en un párrafo aparte o en la página opuesta si las estructuras de los idiomas son demasiado diferentes como para seguir el texto línea por línea.

Como ejemplo, la siguiente cláusula del idioma minnan taiwanés se ha transcrito con cinco líneas de texto:

1. la transliteración estándar pe̍h-ōe-jī ,
2. un brillo que utiliza números de tono para los tonos de la superficie,
3. una glosa que muestra los tonos subyacentes en forma de cita (antes de someterse a sandhi tonal ),
4. una glosa morfema por morfema en inglés y
5. una traducción al inglés: [ 4 ]

(1.)

(2.)

(3.)

(4.)

goá

Goa 1

Goa 2

I

iáu-boē

iau 1 -boe 3

iau 2 -boe 7

aún no

koat-tēng

koat 2 -teng 3

koat 4 -teng 7

decidir

tang-sî

espiga 7 -si 5

espiga 1 -si 5

cuando

boeh

boeh 2

boeh 4

desear

tńg-khì

tng 1 -khi 3 .

tng 2 -khi 3 .

devolver.

(1.) goá iáu-boē koat-tēng tang-sî boeh tńg-khì

(2.) goa1 iau1-boe3 koat2-teng3 tang7-si5 boeh2 tng1-khi3.

(3.) goa2 iau2-boe7 koat4-teng7 tang1-si5 boeh4 tng2-khi3.

(4.) Todavía no he decidido cuándo quiero regresar.

(5.) "Aún no he decidido cuándo regresaré."

Alineación palabra por palabra . Según las Reglas de glosado de Leipzig, es estándar alinear a la izquierda las palabras en el idioma objeto con las palabras correspondientes en el metalenguaje; esta alineación se puede ver entre las líneas (1-3) y la línea (4).

Correspondencia morfema por morfema . A nivel de subpalabra, los morfemas segmentables se separan con guiones, tanto en el ejemplo como en la glosa. Debe haber el mismo número de guiones en el ejemplo y en la glosa, como se muestra en el siguiente ejemplo del lezgiano :

Gila

ahora

abur-un

ellos- OBL - GEN

ferma

granja

hamišaluǧ

para siempre

güǧüna

detrás

amuqʼ-da-č

quedarse- FUT - NEGATIVO

Gila abur-un ferma hamišaluǧ güǧüna amuqʼ-da-č

ahora ellos-OBL-GEN granja para siempre atrás quedarse-FUT-NEG

«Ahora su granja no se quedará atrás para siempre».

Etiquetas de categorías gramaticales . En amuqʼ-da-č , la raíz ( amuq ) se traduce al lexema inglés correspondiente ( stay ), mientras que los afijos flexivos ( da ) y ( č ) representan el tiempo futuro y la negación. Estos afijos flexivos se glosan como FUT y NEG ; una lista de abreviaturas estándar para categorías gramaticales de uso común en lingüística se puede encontrar en las Reglas de Glosado de Leipzig.

Correspondencias de uno a muchos . Cuando un único elemento del lenguaje objeto se corresponde con varios elementos del metalenguaje, estos se separan mediante puntos. [ 3 ] Por ejemplo,

çık-mak

salir- INF

çık-mak

salir-INF

'salir'

Elementos no explícitos . Si la glosa morfema por morfema (línea central) contiene un elemento que no corresponde a un elemento explícito en el ejemplo, una estrategia estándar es incluir un "∅" explícito en el texto del lenguaje objeto, [ 3 ] que se separa mediante un guion como lo haría un elemento explícito:

puer-∅

niño- NOM

puer-∅

niño-NOM

'chico'

La reduplicación se trata de forma similar a la afijación, pero con una tilde (en lugar del guion estándar) que conecta el elemento copiado con la raíz: [ 3 ]

bi~bili

IPFV ~comprar

bi~bili

IPFV~comprar

'está comprando'

Puntuación

En las glosas morfológicas interlineales, diversas formas de puntuación separan las glosas. Normalmente, las palabras se alinean con sus glosas; dentro de las palabras, se usa un guion cuando un límite se marca tanto en el texto como en su glosa, y un punto cuando el límite aparece solo en uno. Es decir, debe haber el mismo número de palabras separadas por espacios en el texto y en su glosa, así como el mismo número de morfemas con guion dentro de una palabra y en su glosa. Este es el sistema básico y puede aplicarse universalmente. Por ejemplo:

Odadan hızlı çıktım.

oda-dan

habitación- ABL

habitación-desde

hız-lı

velocidad- COM

velocidad con

çık-tı-m

go.out- PFV - 1sg

salir-perfectivo-yo

turco

 

 

oda-dan hız-lı çık-tı-m

habitación-ABL velocidad-COM go.out-PFV-1sg

habitación-de-velocidad-con-salir-perfectivo-yo

Salí de la habitación rápidamente.

Se puede usar un guion bajo en lugar de un punto, como en go_out- PFV , cuando una sola palabra en el idioma de origen corresponde a una frase en el idioma de glosado, aunque se seguiría usando un punto para otras situaciones, como en griego oikíais casa. FEM.PL.DAT 'a las casas'.

Sin embargo, a veces se pueden establecer distinciones más sutiles. Por ejemplo, los clíticos pueden separarse con un guion doble (o, para facilitar la escritura, con un signo de igual) en lugar de un guion. Un ejemplo en francés:

Te amo.

je⹀te⹀aime

Yo⹀te⹀amo

(Francés)

 

je⹀te⹀aime

Yo⹀te⹀amo

'Te amo.'

Los afijos que causan discontinuidad ( infijos , circunfijos , transfijos, etc.) pueden ir entre corchetes angulares, y la reduplicación con tildes, en lugar de con guiones:

sulat, susulat, sumulat, sumusulat (declinaciones verbales) (tagalo)

sulat

escribir

s um ulat

agente disparador .pasado⟩ escribir

s um u~sulat

 ⟨activador del agente⟩ contemplativo~escribir

sulat su~sulat s um ulat s um u~sulat

escribir estado de ánimo contemplativo ~escribir agente desencadenante .pasado escribir agente  desencadenante contemplativo~escribir

(Véase el afijo para otros ejemplos).

Los morfemas que no se pueden separar fácilmente, como la diéresis , pueden marcarse con una barra invertida en lugar de un punto:

nuestro-n

nuestro- DAT . PL

Padre

padre\ PL - DAT . PL

(Alemán)

 

nuestro Väter-n

nuestro-DAT.PL padre\PL-DAT.PL

'a nuestros padres' (el singular de Väter 'padres' es Vater )

Algunas otras convenciones que se observan ocasionalmente se ilustran en las Reglas de glosado de Leipzig. [ 3 ]

Recursos de glosado interlineal

Se han realizado esfuerzos para digitalizar las IGT para cientos de idiomas del mundo. [ 5 ]

Base de datos en línea de texto interlineal

La Base de Datos en Línea de Textos Interlineales (ODIN) es una base de datos con más de 200 000 ejemplos de glosas interlineales para más de 1500 idiomas, extraídas de investigaciones lingüísticas académicas. [ 6 ] La base de datos se construyó en dos fases: construcción automática seguida de corrección manual. La etapa de construcción automática se completó en tres pasos:

  1. En primer lugar, se consultaron motores de búsqueda (por ejemplo, Google, Bing) para recuperar documentos académicos que probablemente contuvieran glosas interlineales. Las consultas incluían términos relevantes para la investigación lingüística, como morfemas gramaticales (por ejemplo, "NOM", abreviatura de nominativo; "3SG", abreviatura de tercera persona del singular).
  2. En segundo lugar, cada línea de un documento extraído se etiquetó para indicar si pertenecía o no a una glosa interlineal, utilizando métodos de etiquetado de secuencias de aprendizaje automático.
  3. En tercer lugar, a cada instancia de glosa interlineal se le asignó un nombre de idioma (por ejemplo, tagalo) y un identificador de idioma ISO 693-3. Los nombres e identificadores de idioma se asignaron automáticamente a las glosas interlineales mediante modelos de resolución de correferencia del procesamiento del lenguaje natural, donde la instancia de glosa interlineal se etiquetó con el nombre de idioma (y el identificador) que aparece en el documento académico del que se extrajo la instancia de glosa interlineal. [ 6 ]

En la fase de corrección manual, los creadores de la base de datos corrigieron manualmente los límites de las instancias de glosa interlineales descubiertas mediante el método de etiquetado de secuencias en el paso 2 de la fase de construcción automática. Posteriormente, verificaron los nombres y códigos de los idiomas en una segunda y tercera revisión de los datos, respectivamente.

Procesamiento automático de instancias de glosario interlineal

Se han desarrollado modelos de procesamiento del lenguaje natural que aprovechan recursos de glosas interlineales, como la Base de Datos en Línea de Texto Interlineal. [ 7 ] [ 8 ]

Esmaltado automático

Por ejemplo, se han desarrollado sistemas de procesamiento del lenguaje natural para producir automáticamente glosas interlineales: [ 7 ]

mal

tú- GEN

ħumukuli

camello

elu-ab-ok'ek'-asi

nosotros. OBL - ERG . 1 . PL -robar- PRT

anu

ser. NEG

mi-s ħumukuli elu-ab-ok'ek'-asi anu

tú-GEN camello nosotros.OBL-ERG.1.PL-robar-PRT ser.NEG

«Nosotros no robamos tu camello».

Dada la línea segmentada de morfemas (primera línea arriba) y la línea de traducción libre (tercera línea arriba), la tarea consiste en producir la línea glosada central que comprende traducciones de raíces (por ejemplo, mi : you ) y las etiquetas de categoría gramatical correspondientes a los afijos (por ejemplo, a : ERG.1.PL ). Se han utilizado modelos de predicción de secuencias del procesamiento del lenguaje natural para realizar esta tarea. [ 7 ] Dos factores contribuyen a la dificultad de esta tarea:

  1. La traducción no necesariamente se alinea con la línea segmentada del morfema (por ejemplo, camello es la última palabra en la traducción, pero la segunda palabra en la línea segmentada del morfema).
  2. Algunas palabras en la línea segmentada del morfema tienen múltiples correspondencias en la glosa (por ejemplo, anu : be.NEG ).

Algunos lenguajes construidos, como el Ithkuil y el Lojban, cuentan con herramientas automatizadas que (en teoría) siempre generan glosas precisas debido a la naturaleza regularizada y lógica de estos lenguajes. A continuación, se muestran ejemplos de glosas del Ithkuil y el Lojban , respectivamente:

A'zvaţcaxüẓpöňḑeššaščëirktöňçogjahnói

S1 -“perro”-'lo que se infiere que es X'₁-'enorme'₁-'como resultado planificado de la acción humana'₁-'alguna u otra'₁- DDF -'como polvo'₁-'comido como merienda'₁-'fiabilidad de la fuente desconocida e información no verificable'₁-'conjetura/teoría/hipótesis que es comprobable/verificable'₁- COU - POT

nnţ

"Solo puede significar una cosa..."

A'zvaţcaxüẓpöňḑeššaščëirktöňçogjahnói nnţ

S1 -“perro”-'lo que  se  infiere  que  es  X'₁-'enorme'₁-'como  resultado  planificado de  la acción humana'₁ -'alguna u otra'₁- DDF -'como polvo'₁ -'comido como merienda'₁ -'fiabilidad de la fuente desconocida e información no verificable'₁-'conjetura/teoría/hipótesis que es comprobable/verificable'₁- COU - POT " Solo puede significar una cosa..."                          

Solo hay una explicación; no puedo probarlo y mi mente está algo confusa, pero sin duda habría sido una extraña fusión de esas dos enormes criaturas artificiales que parecen perros en forma de polvo servidos como merienda allá cerca de ti. Ah, y no me cites.

mi

I=x 1

lumci

lavar

el

DET

creka

camisa=x 2

el

DET

grasu

grasa=x 3

el

DET

rirxe

río=x 4

mi lumci le creka le grasu le rirxe

I=x 1 lavado DET camisa=x 2 DET grasa=x 3 DET río=x 4

'Lavo la grasa de la camisa en el río.'

Detección automática de la estructura morfológica a partir de glosas.

Los investigadores han utilizado glosas interlineales para obtener los paradigmas morfológicos del idioma objeto (es decir, el idioma que se está glosando). Para crear automáticamente paradigmas morfológicos a partir de glosas interlineales, los investigadores han creado tablas para cada raíz en la glosa y una ranura (posiblemente vacía) para cada categoría gramatical (p. ej., ERG) en la glosa. Por ejemplo, dada la oración glosada a continuación: [ 7 ]

Vecher-om

tarde- INS

ya

1. SG . NOM

pobeja-la

Ejecutar- PFV . PST . SG . FEM

v

en

revista

tienda. ACC

Vecher-om ya pobeja-la v magazin

tarde-INS 1.SG.NOM correr-PFV.PST.SG.FEM en tienda.ACC

'Por la tarde corrí a la tienda.'

Habría un paradigma para el tallo pobeja con ranuras para PFV.PST.SG.FEM y PFV.PST.SG.MASC :

El espacio para PFV.PST.SG.FEM estaría lleno (ya que se observó en los datos de glosa interlineal), pero el espacio para PFV.PST.SG.MASC estaría vacío (suponiendo que ninguna otra instancia de glosa interlineal contiene pobeja flexionada para la categoría gramatical PFV.PST.SG.MASC ). Se puede utilizar un modelo estadístico de aprendizaje automático para la flexión morfológica para completar las entradas faltantes. [ 8 ] [ 9 ] [ 10 ] [ 11 ] [ 12 ]

Véase también

Referencias

  1. ^ Lehmann, cristiano (23 de enero de 2004). "Instrucciones para traducciones morfémicas interlineales". En Geert Booij; Christian Lehmann; Joaquín Mugdan; Stavros Skopeteas (eds.). Morfología. Ein internationales Handbuch zur Flexion und Wortbildung . Handbücher der Sprach- und Kommunikationswissenschaft. vol.  2. Berlín: W. de Gruyter. págs. 1834-1857 . 
  2. Haspelmath, Martin (2008). Tipología lingüística y universales del lenguaje: un manual internacional . Walter de Gruyter. pág . 715. ISBN  978-3-11-011423-2.
  3. 1 2 3 4 5 Bickel, Balthasar; Bernard Comrie; Martin Haspelmath (febrero de 2008). "Las reglas de glosado de Leipzig. Convenciones para glosas interlineales morfema por morfema" . Departamento de Lingüística – Recursos – Reglas de glosado . Recuperado el 30 de junio de 2010 .
  4. Ejemplo de Vocabulario básico para principiantes en taiwanés por Ko Chek Hoan y Tan Pang Tin
  5. Georgi, Ryan (2016). De Aari a Zulú: creación masivamente multilingüe de herramientas lingüísticas mediante glosado interlineal de TeX (Tesis doctoral). Universidad de Washington.
  6. 1 2 Xia, Fei; Lewis, William; Wayne, Michael; Slayden, Glenn; Georgi, Ryan; Crowgey, Joshua; Bender, Emily (2016). "Enriquecimiento de una base de datos masivamente multilingüe de texto glosado interlineal" . Language Resources and Evaluation . 50 (2): 321– 349. doi : 10.1007/s10579-015-9325-4 . S2CID 2674996. Recuperado el 15 de diciembre de 2021 . 
  7. 1 2 3 4 Xingyuan, Zhao; Satoru, Ozaki; Anastasopoulos, Antonios; Neubig, Graham; Levin, Lori (2020). "Automatic Interlinear Glossing for Under-Resourced Languages ​​Leveraging Translations" . COLING . Actas de la 28.ª Conferencia Internacional sobre Lingüística Computacional: 5397–5408 . doi : 10.18653/v1/2020.coling-main.471 . S2CID 227231816. Recuperado el 15 de diciembre de 2021 . 
  8. 1 2 Moeller, Sarah; Liu, Ling; Yang, Changbing; Kann, Katharina; Hulden, Mans (2020). "IG2P: De textos glosados ​​interlineales a paradigmas" . EMNLP . Actas de la Conferencia de 2020 sobre métodos empíricos en procesamiento del lenguaje natural (EMNLP): 5251–5262 . doi : 10.18653/v1/2020.emnlp-main.424 . S2CID 226262296. Recuperado el 15 de diciembre de 2021 . 
  9. Silfverberg, Miikka; Hulden, Mans (2018). "Un enfoque codificador-decodificador para el problema del llenado de celdas de paradigma" . Actas de la Conferencia de 2018 sobre Métodos Empíricos en Procesamiento del Lenguaje Natural . Bruselas, Bélgica: Asociación de Lingüística Computacional. pp. 2883–2889 . doi : 10.18653/v1/D18-1315 . S2CID 53082616 .  
  10. Wu, Shijie; Cotterell, Ryan; Hulden, Mans (2021). "Aplicación del Transformer a la transducción a nivel de caracteres" . Actas de la 16.ª Conferencia del Capítulo Europeo de la Asociación de Lingüística Computacional: Volumen principal . En línea: Asociación de Lingüística Computacional. pp. 1901–1907 . arXiv : 2005.10213 . doi : 10.18653/v1/2021.eacl-main.163 . S2CID 218718982 .  
  11. Nicolai, Garrett; Cherry, Colin; Kondrak, Grzegorz (2015). "Generación de inflexión como transducción de cadenas discriminativa" . Actas de la Conferencia de 2015 del Capítulo Norteamericano de la Asociación de Lingüística Computacional: Tecnologías del Lenguaje Humano . Denver, Colorado: Asociación de Lingüística Computacional. pp. 922–931 . doi : 10.3115/v1/N15-1093 . S2CID 14929030 .  
  12. Bhargava, Aditya; Kondrak, Grzegorz (2012). "Aprovechamiento de representaciones suplementarias para la transducción secuencial" . Actas de la Conferencia de 2012 del Capítulo Norteamericano de la Asociación de Lingüística Computacional: Tecnologías del Lenguaje Humano . Montreal, Canadá: Asociación de Lingüística Computacional: 396–406 .
  • Las reglas de glosado de Leipzig: convenciones para glosas interlineales morfema por morfema
  • Estándares de texto interlineal glosado (E-MELD)
  • Niveles de texto interlineales glosados ​​(E-MELD)
  • Hacia un modelo general de texto interlineal (E-MELD)
  • Glosas morfológicas interlineales
  • Glosado de lenguas y textos antiguos . Un foro para recomendaciones sobre el glosado morfológico interlinar de lenguas antiguas, tal como se atestigua en manuscritos antiguos.
  • Texto interlineal en línea de las Escrituras Griegas Bíblicas (Nuevo Testamento)
  • ODIN - La base de datos en línea de textos interlineales
  • Página del método interlineal Latinum. Listado de textos interlineales y construidos más antiguos, principalmente del latín o del griego antiguo y en su mayoría traducidos al inglés.
  • Ernest Blum, "La nueva y vieja forma de aprender idiomas" , The American Scholar , otoño de 2008.