Articulo de referencia

Lexicoestadística

La lexicoestadística es un método de lingüística comparativa que consiste en comparar el porcentaje de cognados léxicos entre lenguas para determinar su parentesco. Si bien está...

La lexicoestadística es un método de lingüística comparativa que consiste en comparar el porcentaje de cognados léxicos entre lenguas para determinar su parentesco. Si bien está relacionada con el método comparativo , no reconstruye una protolengua . Se distingue de la glotocronología , que intenta utilizar métodos lexicoestadísticos para estimar el tiempo transcurrido desde que dos o más lenguas divergieron de una protolengua común anterior. Sin embargo, esta es solo una aplicación de la lexicoestadística; otras aplicaciones pueden no compartir el supuesto de una tasa de cambio constante para los elementos léxicos básicos.

El término «lexicoestadística» puede resultar engañoso, ya que utiliza ecuaciones matemáticas, pero no estadística. Si bien es poco común, también se pueden utilizar otras características del idioma además del léxico. Mientras que el método comparativo utiliza innovaciones compartidas e identificadas para determinar subgrupos, la lexicoestadística no las identifica. La lexicoestadística es un método basado en la distancia, mientras que el método comparativo considera directamente los caracteres del idioma. El método lexicoestadístico es una técnica sencilla y rápida en comparación con el método comparativo, pero presenta limitaciones (que se describen más adelante). Puede validarse mediante la comparación de los árboles generados por ambos métodos.

Historia

La lexicoestadística fue desarrollada por Morris Swadesh en una serie de artículos en la década de 1950, basándose en ideas anteriores. [ 1 ] [ 2 ] [ 3 ] El primer uso conocido del concepto fue por Dumont d'Urville en 1834, quien comparó varias lenguas "oceánicas" y propuso un método para calcular un coeficiente de relación. Hymes (1960) y Embleton (1986) revisan la historia de la lexicoestadística. [ 4 ] [ 5 ]

Método

Crear lista de palabras

El objetivo es generar una lista de significados de uso universal (mano, boca, cielo, yo). A continuación, se recopilan palabras para estos espacios de significado en cada idioma considerado. Swadesh redujo inicialmente un conjunto mayor de significados a 200. Posteriormente, descubrió que era necesario reducirlo aún más, pero que podía incluir algunos significados que no estaban en su lista original, dando como resultado su lista posterior de 100 elementos. La lista de Swadesh en Wikcionario ofrece un total de 207 significados en varios idiomas. Se han generado listas alternativas que aplican criterios más rigurosos, por ejemplo, la lista de Dolgopolsky y la lista de Leipzig-Yakarta , así como listas con un alcance más específico; por ejemplo, Dyen , Kruskal y Black tienen 200 significados para 84 lenguas indoeuropeas en formato digital. [ 6 ]

Determinar cognaciones

Se necesita un lingüista capacitado y con experiencia para tomar decisiones sobre la cognación. Sin embargo, estas decisiones podrían necesitar ser refinadas a medida que aumenta el conocimiento. No obstante, la lexicoestadística no se basa en que todas las decisiones sean correctas. Para cada par de palabras (en diferentes idiomas) en esta lista, la cognación de una forma podría ser positiva, negativa o indeterminada. A veces, un idioma tiene varias palabras para un mismo significado, por ejemplo, small y little para not big .

Calcular porcentajes lexicostatísticos

Este porcentaje se relaciona con la proporción de significados cognados para un par de idiomas específico, es decir, en relación con el total sin indeterminación. Este valor se introduce en una tabla de distancias N × N , donde N es el número de idiomas que se comparan. Una vez completada, esta tabla se llena hasta la mitad y tiene forma triangular . Cuanto mayor sea la proporción de cognados, mayor será la relación entre los idiomas.

Crear árbol genealógico

La creación del árbol lingüístico se basa únicamente en la tabla que se encuentra arriba. Se pueden utilizar varios métodos de subagrupación, pero el adoptado por Dyen, Kruskal y Black fue:

  • Todas las listas se colocan en un grupo.
  • Los dos miembros más cercanos se retiran y forman un núcleo que se coloca en la piscina.
  • Este paso se repite
  • bajo ciertas condiciones un núcleo se convierte en un grupo
  • Esto se repite hasta que el grupo contenga un solo grupo.

Los cálculos deben basarse en porcentajes léxicos de núcleo y de grupo.

Aplicaciones

Un exponente destacado de la aplicación de la lexicoestadística ha sido Isidore Dyen . [ 7 ] [ 8 ] [ 9 ] [ 10 ] Utilizó la lexicoestadística para clasificar las lenguas austronesias [ 11 ] así como las indoeuropeas . [ 6 ] Un estudio importante de estas últimas fue publicado por Dyen, Kruskal y Black (1992). [ 6 ] También se han realizado estudios sobre lenguas amerindias y africanas .

Pama-Nyungan

El problema de la ramificación interna dentro de la familia lingüística pama-nyungan ha sido un tema recurrente para la lingüística australiana, y el consenso general sostenía que las conexiones internas entre los más de 25 subgrupos diferentes de pama-nyungan eran imposibles de reconstruir o que los subgrupos no estaban relacionados genéticamente en absoluto. [ 12 ] En 2012, Claire Bowern y Quentin Atkinson publicaron los resultados de su aplicación de métodos filogenéticos computacionales a 194 documentos que representan todos los subgrupos y aislados principales de pama-nyungan. [ 13 ] Su modelo "recuperó" muchas de las ramas y divisiones que habían sido propuestas y aceptadas por muchos otros australianos, al tiempo que proporcionó algunas ideas sobre las ramas más problemáticas, como paman (que se complica por la falta de datos) y ngumpin-yapa (donde el panorama genético está oscurecido por tasas muy altas de préstamos entre lenguas). Su conjunto de datos constituye el mayor de su tipo para una familia de lenguas de cazadores-recolectores , y el segundo más grande en general después del austronesio ( Greenhill et al. 2008, archivado el 19 de diciembre de 2018 en Wayback Machine ). Concluyen que las lenguas pama-nyungan no son, de hecho, una excepción a los métodos lexicoestadísticos, que se han aplicado con éxito a otras familias lingüísticas del mundo.

Críticas

Personas como Hoijer (1956) han demostrado que hubo dificultades para encontrar equivalentes a los elementos de significado, mientras que muchos han considerado necesario modificar las listas de Swadesh. [ 14 ] Gudschinsky (1956) cuestionó si era posible obtener una lista universal. [ 15 ]

Factores como los préstamos , la tradición y los tabúes pueden distorsionar los resultados, al igual que con otros métodos. En ocasiones, se ha utilizado la lexicostatística empleando la similitud léxica en lugar de la cognación para encontrar semejanzas. Esto equivale entonces a una comparación masiva .

La elección de los espacios de significado es subjetiva, al igual que la elección de los sinónimos .

Métodos mejorados

Algunos de los métodos modernos de prueba de hipótesis estadísticas computacionales pueden considerarse mejoras de la lexicoestadística, ya que utilizan listas de palabras y medidas de distancia similares.

Véase también

Referencias

  1. Swadesh, Morris (1955). "Hacia una mayor precisión en la datación lexicoestadística" . International Journal of American Linguistics . 21 (2): 121– 137. doi : 10.1086/464321 . S2CID 144581963 . 
  2. Swadesh, Morris (1952). "Datación lexicoestadística de contactos étnicos prehistóricos". Actas de la Sociedad Filosófica Americana . 96 : 452–463 .
  3. Swadesh, Morris (1950). "Relaciones internas salish". Revista Internacional de Lingüística Americana . 16 (4): 157– 167. doi : 10.1086/464084 . S2CID 145122561 . 
  4. Hymes, Dell (1960). "Lexicostatistics so far". Current Anthropology . 1 (1): 3– 44. doi : 10.1086/200074 . S2CID 144569209 . 
  5. Embleton, Sheila (1986). Estadística en lingüística histórica . Bochum.
  6. 1 2 3 Dyen, Isidore; Kruskal, Joseph; Black, Paul (1992). "Una clasificación indoeuropea, un experimento lexicoestadístico". Transactions of the American Philosophical Society . 82 (5): iii–132. doi : 10.2307/1006517 . JSTOR 1006517 . 
  7. Dyen, Isidore (1962). "La relación determinada lexicoestadísticamente de un grupo lingüístico". International Journal of American Linguistics . 28 (3): 153– 161. doi : 10.1086/464687 . S2CID 143070513 . 
  8. Dyen, Isidore (1963). "Préstamo y tabú determinados lexicostatísticamente". Language . 39 (1): 60– 66. doi : 10.2307/410762 . JSTOR 410762 . 
  9. Dyen, Isidore, ed. (1973). Lexicoestadística en lingüística genética . La Haya: Mouton.
  10. Dyen, Isidore (1975). Subagrupación lingüística y lexicostatística . La Haya: Mouton.
  11. Dyen, Isidore (1965). "Una clasificación lexicoestadística de las lenguas austronesias". Revista Internacional de Lingüística Americana . 19 .
  12. Dixon, Robert MW (2002). Lenguas australianas: su naturaleza y desarrollo . Cambridge University Press. pp. 48, 53. Australia proporciona un ejemplo prototípico de un área lingüística. Tiene una considerable profundidad temporal, un terreno bastante uniforme que facilita la interacción y la comunicación, una proporción considerable de matrimonios exogámicos recíprocos, un multilingüismo desenfrenado y una actitud abierta al préstamo... Hay una uniformidad básica en las lenguas australianas que es el resultado natural de un largo período de difusión. Aunque no se había proporcionado ninguna justificación para 'Pama-Nyungan', llegó a ser aceptado. La gente lo aceptó porque era aceptado, como una especie de creencia. ... Está claro que 'Pama-Nyungan' no puede ser sostenido como un grupo genético. Tampoco es una agrupación tipológica útil. 
  13. Bowern, Claire; Atkinson, Quentin (2012). "Filogenética computacional y la estructura interna del pama-nyungan". Language . 88 (4): 817– 845. doi : 10.1353/lan.2012.0081 . hdl : 1885/61360 . S2CID 4375648 . 
  14. Hoijer, Harry (1956). "Lexicoestadística: una crítica". Language . 32 (1): 49– 60. doi : 10.2307/410652 . JSTOR 410652 . 
  15. Gudschinsky, Sarah (1956). "Los ABC de la lexicoestadística (glotocronología)" . Word . 12 (2): 175– 210. doi : 10.1080/00437956.1956.11659599 .

Lecturas adicionales

  • Dobson, Annette (1969). Agrupación lexicoestadística. Lingüística antropológica 7, 216-221.
  • Dobson, Annette y Black, Paul (1979). Escalamiento multidimensional de algunos datos lexicostatísticos. Mathematical Scientist 1979/4, 55-61.
  • McMahon, April y McMahon, Robert (2005). Clasificación de lenguas mediante números. Oxford University Press.
  • Sankoff, David (1970). "Sobre la tasa de reemplazo de las relaciones de significado de las palabras." Language 46.564-569.
  • Wittmann, Henri (1969). "Una investigación léxico-estadística sobre la diacronía del hitita". Indogermanische Forschungen 74.1-10.
  • Wittmann, Henri (1973). «Clasificación lexicoestadística de las lenguas criollas de base francesa». Lexicoestadística en lingüística genética: Actas de la conferencia de Yale, 3-4 de abril de 1971 , dir. Isidore Dyen, 89-99. La Haya: Mouton.
  • La Base de Datos Lexicoestadística Global , parte del proyecto Evolución de las Lenguas Humanas
  • Base de datos IE
  • Una explicación simplificada de la diferencia entre glotocronología y lexicoestadística.
Obtenido de " https://en.wikipedia.org/w/index.php?title=Lexicostatistics&oldid=1349830570 "