Articulo de referencia

Correferencia

En lingüística , la correferencia , a veces escrita como co-referencia , se produce cuando dos o más expresiones se refieren a la misma persona o cosa; tienen el mismo referente...

En lingüística , la correferencia , a veces escrita como co-referencia , se produce cuando dos o más expresiones se refieren a la misma persona o cosa; tienen el mismo referente . Por ejemplo, en «Bill dijo que Alice llegaría pronto, y llegó» , las palabras «Alice» y «she» se refieren a la misma persona. [ 1 ]

La correferencia suele ser difícil de determinar. Por ejemplo, en «Bill dijo que vendría» , la palabra «él» puede o no referirse a Bill. Determinar qué expresiones son correferencias es fundamental para analizar o comprender el significado, y a menudo requiere información del contexto, conocimiento del mundo real, como la tendencia de algunos nombres a asociarse con especies particulares («Rover»), tipos de artefactos («Titanic»), géneros gramaticales u otras propiedades.

Los lingüistas suelen usar índices para indicar correferencia, como en «Bill dijo que vendría » . Se dice que estas expresiones están coindexadas , lo que indica que deben interpretarse como correferenciales.

Cuando las expresiones son correferenciales, la primera en aparecer suele ser una forma completa o descriptiva (por ejemplo, un nombre propio completo, quizás con un título y un cargo), mientras que las posteriores utilizan formas más cortas (por ejemplo, solo un nombre de pila, un apellido o un pronombre). La primera aparición se conoce como antecedente y la otra como proforma , anáfora o referencia. Sin embargo, los pronombres a veces pueden referirse hacia adelante, como en «Cuando llegó a casa, Alice se durmió». En estos casos, la correferencia se denomina catafórica en lugar de anafórica.

La correferencia es importante para los fenómenos de vinculación en el campo de la sintaxis. La teoría de la vinculación explora la relación sintáctica que existe entre expresiones correferenciales en oraciones y textos.

Tipos

Al explorar la correferencia, se pueden hacer numerosas distinciones, por ejemplo, anáfora , catáfora , antecedentes divididos, frases nominales correferenciales, etc. [ 2 ] Varios de estos fenómenos más específicos se ilustran aquí:

Anáfora
a. La música estaba tan alta que no se podía disfrutar. –La anáfora sigue a la expresión a la que se refiere (su antecedente).
b. A nuestros vecinos no les gusta la música. Si se enojan , la policía aparecerá pronto. – La anáfora «ellos» sigue a la expresión a la que se refiere (su antecedente).
Catáfora
a. Si ellos están enojados por la música, los vecinos llamarán a la policía. – La catáfora ellos precede a la expresión a la que se refiere (su poscedente).
b. A pesar de su dificultad , Wilma llegó a comprender el punto. – La catáfora precede a la expresión a la que se refiere (su poscedente).
Antecedentes divididos
a. Carol le dijo a Bob que asistiera a la fiesta. Llegaron juntos. – La anáfora «ellos» tiene un antecedente dividido, refiriéndose tanto a Carol como a Bob .
b. Cuando Carol i ayuda a Bob i y Bob i ayuda a Carol i , ellos i pueden realizar cualquier tarea. – La anáfora ellos tiene un antecedente dividido, que se refiere tanto a Carol como a Bob .
Frases nominales de referencia cruzada
a. El líder del proyecto i se niega a ayudar. El idiota i solo piensa en sí mismo i . – Coreferring sintagmas nominales, donde el segundo sintagma nominal es una predicación sobre el primero.
b. Algunos de nuestros colegas 1 nos van a apoyar. Este tipo de personas 1 se ganarán nuestra gratitud. – Sintagmas nominales correferenciales, donde el segundo sintagma nominal es una predicación sobre el primero.

Relación con las variables ligadas

Los semánticos y lógicos a veces establecen una distinción entre correferencia y lo que se conoce como variable ligada . [ 3 ] Las variables ligadas ocurren cuando el antecedente de la proforma es una expresión cuantificada indefinida, por ejemplo [ 4 ]

  1. Cada estudiante i ha recibido su calificación i . – El pronombre his es un ejemplo de variable ligada.
  2. Ningún estudiante estaba molesto con su calificación . – El pronombre "his" es un ejemplo de variable ligada.

Las expresiones cuantificadas como «cada estudiante» y «ningún estudiante» no se consideran referenciales. Estas expresiones son gramaticalmente singulares, pero no señalan referentes únicos en el discurso o en el mundo real. Por lo tanto, los antecedentes de «his» en estos ejemplos no son propiamente referenciales, ni tampoco lo es «his» . En cambio, se considera una variable ligada a su antecedente. Su referencia varía según a cuál de los estudiantes del mundo discursivo se haga referencia. La existencia de variables ligadas es quizás más evidente con el siguiente ejemplo:

  1. Solo a Jack le gusta su calificación . – El pronombre " su" puede ser una variable ligada.

Esta oración es ambigua. Puede significar que a Jack le gusta su calificación, pero a todos los demás no; o que a nadie le gusta su propia calificación excepto a Jack. En el primer caso, " su" es correferencial; en el segundo, es una variable ligada porque su referencia varía en el conjunto de todos los estudiantes.

La notación de coindexación se usa comúnmente en ambos casos. Es decir, cuando dos o más expresiones se coindexan, no indica si se trata de una correferencia o de una variable ligada (o, como en el último ejemplo, si depende de la interpretación).

Resolución de correferencia

En lingüística computacional , la resolución de correferencias es un problema ampliamente estudiado en el discurso . Para obtener la interpretación correcta de un texto, o incluso para estimar la importancia relativa de varios sujetos mencionados, los pronombres y otras expresiones referenciales deben conectarse con los individuos adecuados. Los algoritmos destinados a resolver correferencias suelen buscar primero al individuo precedente más cercano que sea compatible con la expresión referencial. Por ejemplo, " ella" podría adjuntarse a una expresión precedente como " la mujer" o "Anne" , pero no tan probablemente a "Bill" . Los pronombres como " él mismo" tienen restricciones mucho más estrictas. Como en muchas tareas lingüísticas, existe una compensación entre precisión y exhaustividad . Las métricas de calidad de clúster comúnmente utilizadas para evaluar los algoritmos de resolución de correferencias incluyen el índice de Rand , el índice de Rand ajustado y diferentes métodos basados ​​en información mutua .

Un problema particular para la resolución de correferencias en inglés es el pronombre «it» , que tiene muchos usos. Puede referirse de forma muy similar a «he» y «she» , excepto que generalmente se refiere a objetos inanimados (las reglas son en realidad más complejas: los animales pueden ser cualquiera de ellos : «it» , «he » o «she» ; los barcos tradicionalmente son «she» ; los huracanes suelen ser «it» a pesar de tener nombres con género). También puede referirse a abstracciones en lugar de seres, por ejemplo: « Le pagaron el salario mínimo, pero no pareció importarle». Finalmente, también tiene usos pleonásticos , que no se refieren a nada específico:

  1. Está lloviendo.
  2. Es una verdadera lástima.
  3. Se necesita mucho trabajo para tener éxito.
  4. A veces, los que más gritan son los que más influencia tienen.

Los usos pleonásticos no se consideran referenciales y, por lo tanto, no forman parte de la correferencia. [ 5 ]

Los enfoques para la resolución de correferencias se pueden dividir, a grandes rasgos, en algoritmos basados ​​en pares de menciones, en clasificación de menciones o en entidades. Los algoritmos de pares de menciones implican decisiones binarias sobre si un par de menciones dadas pertenecen a la misma entidad. No se consideran restricciones a nivel de entidad, como el género , lo que conduce a la propagación de errores . Por ejemplo, los pronombres " él" o "ella" pueden tener una alta probabilidad de correferencia con " el profesor" , pero no pueden ser correferenciales entre sí. Los algoritmos de clasificación de menciones amplían esta idea, pero estipulan que una mención solo puede ser correferencial con una mención (anterior). Como resultado, a cada mención anterior se le debe asignar una puntuación y se enlaza la mención con la puntuación más alta (o ninguna mención). Finalmente, en los métodos basados ​​en entidades, las menciones se enlazan en función de la información de toda la cadena de correferencias en lugar de las menciones individuales. La representación de una cadena de ancho variable es más compleja y computacionalmente costosa que los métodos basados ​​en menciones, lo que hace que estos algoritmos se basen principalmente en arquitecturas de redes neuronales .

Véase también

Notas

  1. Para definiciones de correferencia, véanse, por ejemplo, Crystal (1997:94) y Radford (2004:332).
  2. Estas distinciones (anáfora, catáfora, antecedentes divididos, frases nominales correferenciales, etc.) se discuten en Jurafsky y Martin (2000:669 y ss.).
  3. Para discusiones sobre variables ligadas, véase, por ejemplo, Portner (2005:102 y ss.).
  4. Véase Jurafsky y Martin (2000:701) para un ejemplo de una variable ligada como las que se dan aquí.
  5. Li et al. (2009) han demostrado una alta precisión en la clasificación de it pleonástico , y este éxito promete mejorar la precisión de la resolución de correferencia en general.

Referencias

  • Crystal, D. 1997. Diccionario de lingüística y fonética. 4.ª edición. Cambridge, MA: Blackwell Publishing.
  • Jurafsky, D. y H. Martin 2000. Procesamiento del habla y del lenguaje: Introducción al procesamiento del lenguaje natural, la lingüística computacional y el reconocimiento del habla. Nueva Delhi, India: Pearson Education.
  • Portner, P. 2005. ¿Qué es la semántica?: Fundamentos de la semántica formal. Malden, MA: Blackwell Publishing.
  • Radford, A. 2004. Sintaxis inglesa: Una introducción . Cambridge, Reino Unido: Cambridge University Press.
  • Li, Y., P. Musilek, M. Reformat y L. Wyard-Scott 2009. Identificación de it pleonástico usando la web Archivado el 26-10-2022 en Wayback Machine . Journal of Artificial Intelligence Research 34, 339–389.