La traducción automática interactiva ( IMT ) es un subcampo específico de la traducción asistida por ordenador . En este paradigma de traducción , el software informático que asiste al traductor humano intenta predecir el texto que el usuario va a introducir teniendo en cuenta toda la información de la que dispone. Cuando dicha predicción es errónea y el usuario proporciona información al sistema, se realiza una nueva predicción teniendo en cuenta la nueva información disponible. Dicho proceso se repite hasta que la traducción proporcionada coincida con las expectativas del usuario.
La traducción automática interactiva es especialmente interesante cuando se traducen textos en ámbitos en los que no es admisible generar una traducción que contenga errores, por lo que se requiere que un usuario humano corrija las traducciones proporcionadas por el sistema. En tales casos, se ha demostrado que la traducción automática interactiva brinda beneficios a los usuarios potenciales. [1] [2] [3] Sin embargo, hay pocos programas comerciales que implementen la traducción automática interactiva y el trabajo realizado en este campo se limita principalmente a la investigación académica .
Historia
Históricamente, la traducción automática interactiva nació como una evolución del paradigma de la traducción asistida por ordenador , donde el traductor humano y el sistema de traducción automática estaban destinados a trabajar como un tándem . [4] Este primer trabajo se amplió dentro del proyecto de investigación TransType, financiado por el gobierno canadiense. En este proyecto, la interacción humana estaba destinada a producir el texto de destino por primera vez mediante la incorporación de técnicas de traducción automática basadas en datos dentro del entorno de traducción interactiva con el objetivo de lograr lo mejor de ambos actores: la eficiencia del sistema automático y la confiabilidad de los traductores humanos.
Posteriormente, un proyecto de investigación de mayor escala, TransType2, [1] [3] financiado por la Comisión Europea , amplió dicho trabajo analizando la incorporación de un sistema completo de traducción automática al proceso, con el objetivo de producir una hipótesis de traducción completa, que el usuario humano puede modificar o aceptar. Si el usuario decide modificar la hipótesis, el sistema intenta aprovechar al máximo esa retroalimentación para producir una nueva hipótesis de traducción que tenga en cuenta las modificaciones introducidas por el usuario.
Más recientemente, CASMACAT [5] , también financiado por la Comisión Europea , se propuso desarrollar nuevos tipos de asistencia a los traductores humanos y los integró en un nuevo entorno de trabajo, que consta de un editor, un servidor y herramientas de análisis y visualización. El entorno de trabajo se diseñó de forma modular y se puede combinar con las herramientas de traducción asistida por ordenador existentes. Además, el entorno de trabajo de CASMACAT puede aprender de la interacción con el traductor humano actualizando y adaptando sus modelos instantáneamente en función de las opciones de traducción del usuario. [6] [7]
Un trabajo reciente que incluyó una evaluación exhaustiva con usuarios humanos [8] reveló el hecho de que la traducción automática interactiva puede ser utilizada incluso por usuarios que no hablan el idioma de origen para lograr una calidad de traducción cercana a la profesional. Además, también aclaró el hecho de que un escenario interactivo es más beneficioso que un escenario clásico de posedición.
Los enfoques descritos anteriormente se basan en un sistema de traducción automática subyacente basado en corpus estrechamente acoplado (normalmente, un sistema de traducción automática estadística ) que se utiliza como una caja de cristal , heredando así las deficiencias de los sistemas de traducción y limitando el uso de la traducción automática interactiva para algunos escenarios. Por este motivo, se desarrolló un enfoque que utiliza cualquier tipo de recurso bilingüe (no limitado a la traducción automática) como una caja negra para proporcionar traducción automática interactiva. [9] Este enfoque no puede extraer tanta información de los recursos bilingües utilizados, debido a la naturaleza de caja negra de la interacción, pero puede utilizar cualquier recurso disponible para el usuario. Forecat es una implementación de traducción automática interactiva de caja negra que está disponible tanto como una aplicación web (que incluye una página web y una interfaz de servicios web) como un complemento para OmegaT (Forecat-OmegaT).
Proceso
El proceso de traducción automática interactiva comienza con la propuesta por parte del sistema de una hipótesis de traducción al usuario, que puede aceptar la frase completa como correcta o modificarla si considera que hay algún error. Normalmente, al modificar una palabra dada, se asume que el prefijo hasta esa palabra es correcto, lo que da lugar a un esquema de interacción de izquierda a derecha. Una vez que el usuario ha cambiado la palabra considerada incorrecta, el sistema propone entonces un nuevo sufijo, es decir, el resto de la frase. Este proceso continúa hasta que la traducción proporcionada satisface al usuario.
Aunque se explica a nivel de palabra, el proceso anterior también puede implementarse a nivel de carácter, y por lo tanto el sistema proporciona un sufijo cada vez que el traductor humano escribe un solo carácter. Además, hay un esfuerzo continuo por cambiar el esquema típico de interacción de izquierda a derecha para facilitar la interacción entre humanos y máquinas . [10] [11]
Se utiliza un enfoque similar en la herramienta de traducción Caitra .
Evaluación
La evaluación es un tema difícil en la traducción automática interactiva. Lo ideal sería que la evaluación se llevara a cabo en experimentos con usuarios humanos. Sin embargo, dado el alto coste económico que esto implicaría, esto rara vez sucede. Además, incluso cuando se consideran traductores humanos para realizar una verdadera evaluación de las técnicas de traducción automática interactiva, no está claro qué se debe medir en dichos experimentos, ya que hay muchas variables diferentes que se deben tener en cuenta y que no se pueden controlar, como por ejemplo el tiempo que tarda el usuario en acostumbrarse al proceso. En el proyecto CASMACAT, se han realizado algunos ensayos de campo para estudiar algunas de estas variables. [12] [13] [14]
Para evaluaciones rápidas en condiciones de laboratorio, la traducción automática interactiva se mide utilizando la proporción de pulsaciones de teclas o la proporción de pulsaciones de palabras . Estos criterios intentan medir cuántas pulsaciones de teclas o palabras tuvo que introducir el usuario antes de producir el documento traducido final. [3]
Diferencias con la traducción asistida por ordenador clásica
Aunque la traducción automática interactiva es un subcampo de la traducción asistida por ordenador , el principal atractivo de la primera con respecto a la segunda es la interactividad. En la traducción asistida por ordenador clásica, el sistema de traducción puede sugerir una hipótesis de traducción en el mejor de los casos, y luego se le pide al usuario que edite dicha hipótesis posteriormente. Por el contrario, en la traducción automática interactiva el sistema produce una nueva hipótesis de traducción cada vez que el usuario interactúa con el sistema, es decir, después de que se haya introducido cada palabra (o letra).
Véase también
- Traducción automática
- Traducción automática estadística
- Traducción asistida por ordenador
- Lingüística computacional
- Postedición
- Traducción
Referencias
- ^ ab Casacuberta, Francisco; Civera, Jorge; Cubel, Elsa; Lagarda, Antonio L.; Lapalme, Guy; Macklovitch, Elliott; Vidal, Enrique (2009). "Interacción humana para una traducción automática de alta calidad" (PDF) . Communications of the ACM . 52 (10): 135– 138. doi :10.1145/1562764.1562798. Archivado desde el original (PDF) el 2011-07-06.
- ^ Herbig, Nico; Pal, Santanú; van Genabith, Josef; Krüger, Antonio (2019). "Integración de la inteligencia artificial y humana para una traducción eficiente". arXiv : 1903.02978 [cs.HC].
- ^ abc Barrachina, Sergio; Bender, Oliver; Casacuberta, Francisco; Civera, Jorge; Cubel, Elsa; Jadivi, Shahram; Lagarda, Antonio L.; Ney, Hermann; Tomás, Jesús; Vidal, Enrique (2009). "Enfoques estadísticos de la traducción asistida por ordenador" (PDF) . Lingüística Computacional . 25 (1): 3– 28. doi : 10.1162/coli.2008.07-055-r2-06-29 .
- ^ Foster, George; Isabelle, Pierre; Plamondon, Pierre (1997). "Traducción automática interactiva mediada por el texto de destino". Traducción automática . 12 (1): 175– 194. doi :10.1023/a:1007999327580.
- ^ Alabau, Vicent; Dólar, cristiano; carl, miguel; Casacuberta, Francisco; García-Martínez, Mercedes; Germann, Ulrich; González-Rubio, Jesús; Colina, Robin; Koehn, Philipp; Leiva, Luis; Mesa-Lao, Barto; Ortíz, Daniel; Saint-Amand, Hervé; Sanchís, alemán; Tsoukala, Chara (abril de 2014). «CASMACAT: Un banco de trabajo de traducción asistida por ordenador» (PDF) . Actas de la 14ª Conferencia del Capítulo Europeo de la Asociación de Lingüística Computacional . Los Ángeles, California: Asociación de Lingüística Computacional. págs. 25 a 28.
- ^ Ortiz-Martínez, Daniel; García-Varea, Ismael; Casacuberta, Francisco (junio de 2010). "Aprendizaje en línea para traducción automática estadística interactiva" (PDF) . Tecnologías del lenguaje humano: Conferencia anual de 2010 del Capítulo norteamericano de la ACL . Asociación de Lingüística Computacional. págs. 546– 554.
- ^ Martinez-Gomez, Pascual; Sanchis-Trilles, German; Casacuberta, Francisco (septiembre de 2012). "Estrategias de adaptación en línea para traducción automática estadística en escenarios de posedición". Reconocimiento de patrones . 45 (9). Elsevier: 3193– 3203. Bibcode :2012PatRe..45.3193M. doi :10.1016/j.patcog.2012.01.011. hdl : 10251/37324 .
- ^ Koehn, Philipp (junio de 2010). "Habilitación de traductores monolingües: posedición frente a opciones" (PDF) . Human Language Technologies: The 2010 Annual Conference of the North American Chapter of the Association for Computational Linguistics (HLT/NAACL) . Los Ángeles, California: Association for Computational Linguistics. págs. 537– 545.
- ^ Juan Antonio, Pérez-Ortiz; Torregrosa, Daniel; Forcada, Mikel (2014). "Integración de recursos bilingües heterogéneos en un sistema de traducción interactivo". Actas del taller de EACL 2014 sobre traducción asistida por humanos y ordenadores . Los Ángeles, California: Association for Computational Linguistics. págs. 57– 65.
- ^ Sanchis-Trilles, Germán; Ortiz-Martínez, Daniel; Civera, Jorge; Casacuberta, Francisco; Vidal, Enrique; Hoang, Hieu (octubre de 2008). "Mejora de la traducción automática interactiva mediante acciones del ratón" (PDF) . Actas de la Conferencia de 2008 sobre métodos empíricos en el procesamiento del lenguaje natural (EMNLP) . Honolulu, Hawái: Asociación de Lingüística Computacional. págs. 485– 494.
- ^ González-Rubio, Jesús; Ortiz-Martínez, Daniel; Casacuberta, Francisco (julio de 2010). "Balancing User Effort and Translation Error in Interactive Machine Translation via Confidence Measures" (PDF) . Actas de la conferencia ACL 2010 Short Papers (ACL) . Uppsala, Suecia: Association for Computational Linguistics. pp. 173– 177.
- ^ Underwood, Nancy; Mesa-Lao, Bartolomé; García-Martínez, Mercedes; carl, miguel; Alabau, Vicent; González-Rubio, Jesús; Leiva, Luis; Sanchis-Trilles, Germán; Ortiz-Martínez, Daniel; Casacuberta, Francisco (mayo de 2014). "Evaluación de los efectos de la interactividad en un banco de trabajo de posedición" (PDF) . Actas de la 29ª edición de la Conferencia de Evaluación y Recursos Lingüísticos (LREC) . Reikiavik, Islandia. págs. 553-559 .
- ^ Ortiz-Martínez, Daniel; González-Rubio, Jesús; Alabau, Vicent; Sanchis-Trilles, Germán; Casacuberta, Francisco (agosto de 2015). "Integración del aprendizaje activo y en línea en un entorno de trabajo de traducción asistida por ordenador". Nuevas direcciones en la investigación empírica del proceso de traducción: exploración de la base de datos TPR-DB de CRITT . Springer. págs. 54– 73.
- ^ Alabau, Vicent; carl, miguel; Casacuberta, Francisco; García-Martínez, Mercedes; Mesa-Lao, Bartolomé; Ortiz-Martínez, Daniel; González-Rubio, Jesús; Sanchis-Trilles, Germán; Schaeffer, Moritz (agosto de 2015). "Aprendizaje de la posedición avanzada". Nuevas direcciones en la investigación del proceso de traducción empírica: exploración de CRITT TPR-DB . Saltador. págs. 95-111 .
Enlaces externos
- Demostración de traducción automática interactiva de Lilt
- Demostración de traducción automática interactiva
- Página web del proyecto TransType
- Página web del proyecto TransType2
- Página web del proyecto MIPRCV
- Pronóstico
- Pronóstico OmegaT