Articulo de referencia

Base de datos de habla no nativa

Una base de datos de habla no nativa es una base de datos de habla con pronunciaciones no nativas del inglés . Estas bases de datos se utilizan en el desarrollo de: sistemas de ...

Una base de datos de habla no nativa es una base de datos de habla con pronunciaciones no nativas del inglés . Estas bases de datos se utilizan en el desarrollo de: sistemas de reconocimiento automático de voz multilingües, sistemas de conversión de texto a voz , entrenadores de pronunciación y sistemas de aprendizaje de segundas lenguas . [ 1 ]

Lista

La tabla con información sobre las diferentes bases de datos se muestra en la Tabla 2.

Leyenda

En la tabla de bases de datos no nativas se utilizan algunas abreviaturas para los nombres de los idiomas. Se enumeran en la Tabla 1. La Tabla 2 proporciona la siguiente información sobre cada corpus: el nombre del corpus, la institución donde se puede obtener el corpus, o al menos donde debería estar disponible más información, el idioma que realmente hablaron los hablantes, el número de hablantes, la lengua materna de los hablantes, la cantidad total de enunciados no nativos que contiene el corpus, la duración en horas de la parte no nativa, la fecha de la primera referencia pública a este corpus, un texto libre que resalta aspectos especiales de esta base de datos y una referencia a otra publicación. La referencia en el último campo es, en la mayoría de los casos, al artículo que está específicamente dedicado a describir este corpus por los recolectores originales. En algunos casos no fue posible identificar dicho artículo. En estos casos, se hace referencia a un artículo que está utilizando este corpus.

Algunas entradas se dejan en blanco y otras se marcan como desconocidas. La diferencia radica en que las entradas en blanco se refieren a atributos cuyo valor simplemente se desconoce. Las entradas desconocidas, en cambio, indican que no hay información disponible sobre dicho atributo en la base de datos. Por ejemplo, en la base de datos meteorológica de Júpiter [ 46 ] no se proporciona información sobre el origen de los hablantes. Por lo tanto, estos datos serían menos útiles para verificar la detección de acentos o problemas similares.

Siempre que fue posible, se utilizó el nombre estándar del corpus. Sin embargo, para algunos de los corpus más pequeños, no existía un nombre establecido, por lo que fue necesario crear un identificador. En estos casos, se utilizó una combinación del nombre de la institución y del responsable de la recopilación de datos.

En los casos en que las bases de datos contienen habla nativa y no nativa, solo se enumeran los atributos de la parte no nativa del corpus. La mayoría de los corpus son colecciones de habla leída. Si el corpus consta, parcial o totalmente, de enunciados espontáneos, esto se indica en la columna de "Especiales".

Referencias

  1. M. Raab, R. Gruhn y E. Noeth, Bases de datos de habla no nativa , en Proc. ASRU, Kioto, Japón, 2007.
  2. ^ Proyecto AMI, "Corpus de reuniones de AMI".
  3. R. Gruhn, T. Cincarek y S. Nakamura, "Una base de datos de inglés no nativo con múltiples acentos", en ASJ, 2004.
  4. Ludwig-Maximilians-Universität München, "Archivo bávaro de corpus extraño de señales de voz",.
  5. Jurafsky et al., "El proyecto del restaurante de Berkeley", Actas del ICSLP 1994.
  6. L. Tomokiyo, Reconocimiento del habla no nativa: caracterización y adaptación al uso no nativo en el reconocimiento del habla , tesis doctoral, Universidad Carnegie Mellon, Pensilvania, 2001.
  7. S. Witt, Uso del reconocimiento de voz en el aprendizaje de idiomas asistido por computadora , tesis doctoral, Departamento de Ingeniería de la Universidad de Cambridge, Reino Unido, 1999.
  8. H. Ye y S. Young, Mejora del rendimiento del reconocimiento de voz de principiantes en la interacción conversacional hablada para el aprendizaje de idiomas , en Proc. Interspeech, Lisboa, Portugal, 2005.
  9. L. Tomokiyo, Reconocimiento del habla no nativa: caracterización y adaptación al uso no nativo en el reconocimiento del habla , tesis doctoral, Universidad Carnegie Mellon, Pensilvania, 2001.
  10. TP Tan y L. Besacier, Un corpus francés no nativo para el reconocimiento automático del habla , en LREC, Génova, Italia, 2006.
  11. T. Lander, CSLU: Versión 1.2 del inglés con acento extranjero , Informe técnico, LDC, Filadelfia, Pensilvania, 2007.
  12. Z. Wang, T. Schultz y A. Waibel, Comparación de técnicas de adaptación de modelos acústicos en habla no nativa , en Proc. ICASSP , 2003.
  13. S. Schaden, Regelbasierte Modellierung fremdsprachlich akzentbehafteter Aussprachevarianten , Ph.D. tesis, Universidad Duisburg-Essen, 2006.
  14. LM Arslan y JH Hansen, Características de frecuencia del habla con acento extranjero , en Actas de ICASSP , Múnich, Alemania, 1997, págs. 1123-1126.
  15. N. Minematsu et al., Desarrollo de una base de datos de voz en inglés leída por japoneses para apoyar la investigación en CALL , en ICA, Kioto, Japón, 2004, págs. 577-560.
  16. Christopher Cieri, David Miller, Kevin Walker, El corpus Fisher: un recurso para las próximas generaciones de conversión de voz a texto , Actas de LREC 2004
  17. S. Fitt, La pronunciación de nombres de pueblos nativos y no nativos poco familiares , en Proc. de Eurospeech, 1995, pp. 2227-2230.
  18. G. Stemmer, E. Noeth y H. Niemann, Modelado acústico de palabras extranjeras en un sistema de reconocimiento de voz alemán , en Proc. Eurospeech, P. Dalsgaard, B. Lindberg y H. Benner, Eds., 2001, vol. 4, pp. 2745-2748.
  19. W. Byrne, E. Knodt, S. Khudanpur y J. Bernstein, ¿Está el reconocimiento automático del habla preparado para el habla no nativa? Un esfuerzo de recopilación de datos y experimentos iniciales en el modelado del inglés hispanohablante conversacional , en STiLL, Marholmen, Suecia, 1998, pp. 37-40.
  20. Y. Li, P. Fung, P. Xu y Y. Liu, Modelado acústico asimétrico para el reconocimiento de voz en idiomas mixtos , en ICASSP, Praga, República Checa, 2011, pp. 37-40.
  21. V. Fischer, E. Janke y S. Kunzmann, Avances recientes en la decodificación del habla no nativa con modelos acústicos multilingües , en Actas de Eurospeech, 2003, págs. 3105-3108.
  22. Nancy F. Chen, Rong Tong, Darren Wee, Peixuan Lee, Bin Ma, Haizhou Li, iCALL Corpus: Mandarin Chinese Spoken by Non-Native Speakers of European Descent , en Proc. de Interspeech, 2015.
  23. Nancy F. Chen, Vivaek Shivakumar, Mahesh Harikumar, Bin Ma, Haizhou Li. Caracterización a gran escala de los errores de pronunciación del mandarín cometidos por hablantes nativos de lenguas europeas , en Actas de Interspeech, 2013.
  24. W. Menzel, E. Atwell, P. Bonaventura, D. Herron, P. Howarth, R. Morton y C. Souter, El corpus ISLE de inglés hablado por hablantes no nativos , en LREC, Atenas, Grecia, 2000, págs. 957-963.
  25. K. Livescu , Análisis y modelado del habla no nativa para el reconocimiento automático del habla , tesis de maestría, Instituto Tecnológico de Massachusetts, Cambridge, MA, 1999.
  26. SC. Rhee y SH. Lee y SK. Kang y YJ. Lee, Diseño y construcción del corpus de inglés hablado coreano (K-SEC) , Actas del ICSLP 2004
  27. L. Tomokiyo, Reconocimiento del habla no nativa: caracterización y adaptación al uso no nativo en el reconocimiento del habla , tesis doctoral, Universidad Carnegie Mellon, Pensilvania, 2001.
  28. Gut, U., Habla no nativa. Un análisis basado en corpus de las propiedades fonológicas y fonéticas del inglés y el alemán como segunda lengua , Frankfurt am Main: Peter Lang, 2009.
  29. Instituto de Investigación de Factores Humanos de TNO, Interoperabilidad multilingüe Mist en la base de datos de tecnología del habla , Informe técnico, ELRA, París, Francia, 2007, Referencia del catálogo ELRA S0238.
  30. JC Segura et al., La base de datos HIWIRE, un corpus de habla en inglés no nativo y ruidoso para la comunicación en cabina , 2007,.
  31. S. Pigeon, W. Shen y D. van Leeuwen, Diseño y caracterización de la base de datos de comunicaciones de tráfico aéreo militar no nativa , en ICSLP, Amberes, Bélgica, 2007.
  32. L. Benarousse et al., El corpus de habla nativa y no nativa (n4) de la OTAN , en Actas del taller MIST (ESCA-NATO), Leusden, septiembre de 1999.
  33. Consorcio Onomastica, El léxico de pronunciación interlingüística ONOMASTICA , en Actas de Eurospeech, Madrid, España, 1995, pp. 829-832.
  34. C. Hacker, T. Cincarek, A. Maier, A. Hessler y E. Noeth, Mejora de las características prosódicas y de pronunciación para detectar pronunciaciones erróneas de niños no nativos , en Actas de ICASSP, Honolulu, Hawái, 2007, págs. 197-200.
  35. C. Teixeira, I. Trancoso y A. Serralheiro, Reconocimiento de acentos no nativos , en Proc. Eurospeech, Rodas, Grecia, 1997, págs. 2375-2378.
  36. H. Heuvel, K. Choukri, C. Gollan, A. Moreno y D. Mostefa, TC-STAR: Nuevos recursos lingüísticos para fines ASR y SLT , en LREC, Génova, 2006, págs.
  37. LF Lamel , F. Schiel, A. Fourcin, J. Mariani y H. Tillmann, La base de datos translingüística en inglés TED , en ICSLP, Yokohama, Japón, septiembre de 1994.
  38. N. Mote, L. Johnson, A. Sethy, J. Silva y S. Narayanan, Detección y modelado de errores del habla de aprendices en lenguaje táctico: El caso del entrenamiento en lenguaje táctico árabe para hablantes de inglés americano , en Proc. de InSTIL, junio de 2004.
  39. K. Nishina, Desarrollo de una base de datos de voz japonesa leída por hablantes no nativos para la construcción de un sistema CALL , en ICA, Kioto, Japón, 2004, págs. 561-564.
  40. Universidad Ludwig-Maximilians de Múnich, El proyecto Verbmobil ,.
  41. I. Trancoso, C. Viana, I. Mascarenhas y C. Teixeira, Sobre la derivación de reglas para la pronunciación nativizada en consultas de navegación , en Proc. Eurospeech, 1999.
  42. A. LaRocca y R. Chouairi, Corpus de habla árabe de West Point , Informe técnico, LDC, Filadelfia, Pensilvania, 2002.
  43. A. LaRocca y C. Tomei, Corpus de habla rusa de West Point , Informe técnico, LDC, Filadelfia, Pensilvania, 2003.
  44. J. Morgan, Discurso en español sobre el heroísmo de West Point , Informe técnico, LDC, Filadelfia, Pensilvania, 2006.
  45. I. Amdal, F. Korkmazskiy y AC Surendran, Modelado conjunto de la pronunciación de hablantes no nativos mediante métodos basados ​​en datos , en ICSLP, Pekín, China, 2000, págs. 622-625.
  46. K. Livescu, Análisis y modelado del habla no nativa para el reconocimiento automático del habla , tesis de maestría, Instituto Tecnológico de Massachusetts, Cambridge, MA, 1999.