En el ámbito del software , un corrector ortográfico (o corrector de ortografía ) es una función que revisa si hay errores ortográficos en un texto . Las funciones de corrección ortográfica suelen estar integradas en programas o servicios como procesadores de texto , clientes de correo electrónico , diccionarios electrónicos o motores de búsqueda .
Tengo un corrector ortográfico, vino con mi Pea Sea. Simplemente marca mi revisión Miss Steaks que no puedo ver. Golpeo los muelles y escribo un zumbido y peso para que diga si estoy escribiendo mal, me dice directamente el peso. Pasé este poema por él, tu orilla realmente se alegra de no. Es muy pulido en su peso. Mi corrector me dijo coser. Un corrector es una cosa bendita, congela los montones de tomillo. Me ayuda a corregir todos los estilos de corrección, y me ayuda cuando rimo. Cada fleys viene colocado en mi pantalla, estoy atado a ser un joule. El corrector vierte sobre cada palabra Dos reglas de comprobación de ortografía.

Diseño
Un corrector ortográfico básico realiza los siguientes procesos:
- Analiza el texto y extrae las palabras que contiene.
- A continuación, compara cada palabra con una lista conocida de palabras escritas correctamente (es decir, un diccionario). Esta lista puede contener solo palabras o información adicional, como puntos de división silábica o atributos léxicos y gramaticales.
- Un paso adicional consiste en un algoritmo que depende del idioma para el manejo de la morfología . Incluso para un idioma con poca flexión como el inglés , el corrector ortográfico deberá considerar diferentes formas de una misma palabra, como plurales, formas verbales, contracciones y posesivos . Para muchos otros idiomas, como aquellos con aglutinación y una declinación y conjugación más complejas, esta parte del proceso es más complicada.
No está claro si el análisis morfológico —que permite muchas formas de una palabra dependiendo de su función gramatical— proporciona un beneficio significativo para el inglés, aunque sus beneficios para lenguas altamente sintéticas como el alemán, el húngaro o el turco son evidentes.
Como complemento a estos componentes, la interfaz de usuario del programa permite a los usuarios aprobar o rechazar reemplazos y modificar el funcionamiento del programa.
Los correctores ortográficos pueden usar algoritmos de coincidencia aproximada de cadenas, como la distancia de Levenshtein, para encontrar la ortografía correcta de las palabras mal escritas. [ 1 ] Un tipo alternativo de corrector ortográfico utiliza únicamente información estadística, como n-gramas , para reconocer errores en lugar de palabras correctamente escritas. Este enfoque generalmente requiere mucho esfuerzo para obtener suficiente información estadística. Las ventajas clave incluyen una menor necesidad de almacenamiento en tiempo de ejecución y la capacidad de corregir errores en palabras que no están incluidas en un diccionario. [ 2 ]
En algunos casos, los correctores ortográficos utilizan una lista fija de errores ortográficos y sugerencias para corregirlos; este enfoque menos flexible se usa a menudo en métodos de corrección en papel, como las entradas de " véase también" de las enciclopedias.
Los algoritmos de agrupamiento también se han utilizado para la corrección ortográfica [ 3 ] combinados con información fonética. [ 4 ]
Historia
Pre-PC
En 1961, Les Earnest , quien dirigía la investigación sobre esta tecnología incipiente, consideró necesario incluir el primer corrector ortográfico que accedía a una lista de 10 000 palabras aceptables. [ 5 ] Ralph Gorin, estudiante de posgrado bajo la tutela de Earnest en ese momento, creó el primer programa corrector ortográfico verdadero escrito como un programa de aplicación (en lugar de investigación) para texto en inglés general: SPELL para el DEC PDP-10 en el Laboratorio de Inteligencia Artificial de la Universidad de Stanford, en febrero de 1971. [ 6 ] Gorin escribió SPELL en lenguaje ensamblador , para una acción más rápida; creó el primer corrector ortográfico buscando en la lista de palabras posibles grafías correctas que difirieran en una sola letra o transposiciones de letras adyacentes y presentándolas al usuario. Gorin hizo que SPELL fuera accesible públicamente, como se hizo con la mayoría de los programas de SAIL (Laboratorio de Inteligencia Artificial de Stanford), y pronto se extendió por todo el mundo a través de la nueva ARPAnet, unos diez años antes de que las computadoras personales se generalizaran. [ 7 ] SPELL, sus algoritmos y estructuras de datos inspiraron el programa ispell de Unix .
Los primeros correctores ortográficos estuvieron ampliamente disponibles en las computadoras centrales a finales de la década de 1970. Un grupo de seis lingüistas de la Universidad de Georgetown desarrolló el primer sistema de corrección ortográfica para la corporación IBM. [ 8 ]
Henry Kučera inventó uno para las máquinas VAX de Digital Equipment Corp en 1981. [ 9 ]
Unix
El programa internacional Ispell, comúnmente utilizado en Unix, se basa en SPELL de RE Gorin. Fue convertido a C por Pace Willisson en el MIT. [ 10 ]
El proyecto GNU tiene su corrector ortográfico GNU Aspell . La principal mejora de Aspell es que puede sugerir con mayor precisión alternativas correctas para palabras en inglés mal escritas. [ 11 ]
Debido a la incapacidad de los correctores ortográficos tradicionales para revisar palabras en lenguas flexivas complejas, el húngaro László Németh desarrolló Hunspell , un corrector ortográfico que admite lenguas aglutinantes y palabras compuestas complejas. Hunspell también utiliza Unicode en sus diccionarios. [ 12 ] Hunspell reemplazó al anterior MySpell en OpenOffice.org en la versión 2.0.2.
Enchant es otro corrector ortográfico general, derivado de AbiWord . Su objetivo es combinar programas que admiten diferentes idiomas como Aspell, Hunspell, Nuspell, Hspell (hebreo), Voikko (finlandés), Zemberek (turco) y AppleSpell bajo una misma interfaz. [ 13 ]
PCs
Los primeros correctores ortográficos para ordenadores personales aparecieron en 1980, como "WordCheck" para sistemas Commodore, que se lanzó a finales de 1980 a tiempo para que los anuncios se imprimieran en enero de 1981. [ 14 ] Desarrolladores como Maria Mariani [ 8 ] y Random House [ 15 ] lanzaron rápidamente paquetes OEM o productos para el usuario final al mercado de software en rápida expansión. En los PC anteriores a Windows, estos correctores ortográficos eran programas independientes, muchos de los cuales podían ejecutarse en modo de terminación y permanencia residente desde dentro de los paquetes de procesamiento de texto en PC con suficiente memoria.
Sin embargo, el mercado de paquetes independientes tuvo una vida corta, ya que a mediados de la década de 1980, los desarrolladores de populares procesadores de texto como WordStar y WordPerfect incorporaron correctores ortográficos en sus programas, en su mayoría con licencia de las empresas mencionadas anteriormente, que rápidamente ampliaron la compatibilidad del inglés a muchos idiomas europeos e incluso asiáticos . No obstante, esto requirió una mayor sofisticación en las rutinas morfológicas del software, especialmente en lo que respecta a idiomas con alta aglutinación como el húngaro y el finlandés . Si bien el tamaño del mercado de procesadores de texto en un país como Islandia podría no haber justificado la inversión de implementar un corrector ortográfico, empresas como WordPerfect se esforzaron por adaptar su software al mayor número posible de mercados nacionales como parte de su estrategia de marketing global .
Cuando Apple desarrolló un corrector ortográfico para todo el sistema en Mac OS X, de modo que el sistema operativo se encargara de las correcciones ortográficas, [ 16 ] fue una primicia: ya no era necesario mantener un corrector ortográfico independiente para cada programa. [ 17 ] La cobertura del corrector ortográfico de Mac OS X incluye prácticamente todas las aplicaciones incluidas y de terceros.
VT Speller de Visual Tools , presentado en 1994, fue "diseñado para desarrolladores de aplicaciones que admiten Windows". [ 18 ] [ 19 ] Venía con un diccionario, pero podía crear e incorporar el uso de diccionarios secundarios. [ 20 ]
Navegadores
Los navegadores web como Firefox y Google Chrome ofrecen soporte para la corrección ortográfica, utilizando Hunspell . Antes de usar Hunspell, Firefox y Chrome utilizaban MySpell y GNU Aspell , respectivamente. [ 21 ]
Especialidades
Algunos correctores ortográficos tienen soporte independiente para diccionarios médicos para ayudar a prevenir errores médicos. [ 22 ] [ 23 ] [ 24 ]
Funcionalidad
Los primeros correctores ortográficos eran "verificadores" en lugar de "correctores". No ofrecían sugerencias para las palabras mal escritas. Esto era útil para las erratas , pero no tanto para los errores lógicos o fonéticos. El reto al que se enfrentaron los desarrolladores fue la dificultad de ofrecer sugerencias útiles para las palabras mal escritas. Esto requiere reducir las palabras a su forma básica y aplicar algoritmos de reconocimiento de patrones.
Podría parecer lógico que, en lo que respecta a los diccionarios con corrector ortográfico, «cuanto más grande, mejor», para que las palabras correctas no se marquen como incorrectas. Sin embargo, en la práctica, un tamaño óptimo para el inglés parece rondar las 90 000 entradas. Si hay más, las palabras mal escritas pueden omitirse por confundirse con otras. Por ejemplo, un lingüista podría determinar, basándose en la lingüística de corpus, que la palabra «baht» es más frecuentemente una errata de «bath » o «bat» que una referencia a la moneda tailandesa. Por lo tanto, normalmente sería más útil que algunas personas que escriben sobre la moneda tailandesa se vieran ligeramente perjudicadas que si se pasaran por alto los errores ortográficos de muchas más personas que hablan de «bath».

Los primeros correctores ortográficos de MS-DOS se utilizaban principalmente en modo de revisión dentro de los paquetes de procesamiento de texto. Tras preparar un documento, el usuario escaneaba el texto en busca de errores ortográficos. [ 25 ] Posteriormente, sin embargo, se ofreció el procesamiento por lotes en paquetes como el efímero CoAuthor de Oracle , que permitía al usuario ver los resultados después de procesar un documento y corregir solo las palabras que se sabía que estaban mal. Cuando la memoria y la capacidad de procesamiento se volvieron abundantes, la corrección ortográfica se realizaba en segundo plano de forma interactiva, como ha sido el caso del programa Spellbound de Sector Software, lanzado en 1987, y de Microsoft Word desde Word 95.
Los correctores ortográficos se han vuelto cada vez más sofisticados; ahora son capaces de reconocer errores gramaticales . Sin embargo, incluso en su mejor versión, rara vez detectan todos los errores de un texto (como los homófonos ) y marcan los neologismos y las palabras extranjeras como faltas de ortografía. No obstante, los correctores ortográficos pueden considerarse una herramienta de apoyo a la escritura en lenguas extranjeras en la que los estudiantes no nativos pueden confiar para detectar y corregir sus errores ortográficos en la lengua meta. [ 26 ]
Corrección ortográfica para idiomas distintos del inglés
El inglés es singular porque la mayoría de las palabras utilizadas en la escritura formal tienen una única grafía que se puede encontrar en un diccionario común, salvo algunas expresiones coloquiales y variantes. En muchos idiomas, las palabras se suelen concatenar para formar nuevas combinaciones. En alemán, los sustantivos compuestos se crean frecuentemente a partir de otros sustantivos ya existentes. Algunos sistemas de escritura no distinguen claramente una palabra de otra, lo que requiere algoritmos de segmentación. Cada uno de estos casos plantea desafíos únicos para los correctores ortográficos de idiomas distintos del inglés.
Correctores ortográficos sensibles al contexto
Se han realizado investigaciones para desarrollar algoritmos capaces de reconocer palabras mal escritas, incluso si la palabra en sí pertenece al vocabulario, basándose en el contexto de las palabras circundantes. Esto no solo permite detectar palabras como las del poema anterior, sino que también mitiga el efecto perjudicial de ampliar los diccionarios, permitiendo el reconocimiento de más palabras. Por ejemplo, la palabra "baht" en el mismo párrafo que "Thai" o "Tailandia" no se reconocería como una falta de ortografía de "bath" . El ejemplo más común de errores detectados por dicho sistema son los errores homófonos , como las palabras en negrita de la siguiente oración:
- Su llegada al mar si es carrete .
El algoritmo más exitoso hasta la fecha es el " Algoritmo de corrección ortográfica basado en Winnow " de Andrew Golding y Dan Roth, [ 27 ] publicado en 1999, que puede reconocer aproximadamente el 96% de los errores ortográficos sensibles al contexto, además de los errores ortográficos comunes que no son palabras. Los correctores ortográficos sensibles al contexto aparecieron en las aplicaciones ya desaparecidas Microsoft Office 2007 [ 28 ] y Google Wave . [ 29 ]
Los correctores gramaticales intentan solucionar problemas gramaticales que van más allá de los errores ortográficos, incluyendo la elección incorrecta de palabras.
Véase también
Referencias
- ↑ Perner, Petra (5 de julio de 2010). Avances en minería de datos: aplicaciones y aspectos teóricos: 10.ª Conferencia Industrial, ICDM 2010, Berlín, Alemania, 12-14 de julio de 2010. Actas . Springer Science & Business Media. ISBN 978-3-642-14399-1.
- ↑ Patente estadounidense 6618697, Método para la corrección de errores ortográficos y gramaticales basada en reglas
- ↑ de Amorim, RC; Zampieri, M. (2013) Métodos eficaces de corrección ortográfica mediante algoritmos de agrupamiento. Archivado el 17 de agosto de 2017 en Wayback Machine. Actas de los Avances Recientes en el Procesamiento del Lenguaje Natural (RANLP2013). Hissar, Bulgaria. págs. 172-178.
- ↑ Zampieri, M.; de Amorim, RC (2014) Entre el sonido y la ortografía: Combinación de fonética y algoritmos de agrupamiento para mejorar la recuperación de palabras objetivo. Actas de la 9.ª Conferencia Internacional sobre Procesamiento del Lenguaje Natural (PolTAL). Lecture Notes in Computer Science (LNCS). Springer. págs. 438-449.
- ↑ Earnest, Les. "Los tres primeros correctores ortográficos" (PDF) . Universidad de Stanford. Archivado del original (PDF) el 22 de octubre de 2012. Recuperado el 10 de octubre de 2011 .
- ↑ Peterson, James (diciembre de 1980). Programas informáticos para detectar y corregir errores ortográficos (PDF) . Consultado el 18 de febrero de 2011 .
- ↑ Earnest, Les. Legados visibles del efecto 3000 (PDF) . Archivado del original (PDF) el 20 de julio de 2011. Consultado el 18 de febrero de 2011 .
- 1 2 "Profesorado y personal de la Universidad de Georgetown: El Centro para el Lenguaje, la Educación y el Desarrollo" . Archivado del original el 5 de febrero de 2009. Consultado el 18 de diciembre de 2008 ., cita: "Maria Mariani... fue una de un grupo de seis lingüistas de la Universidad de Georgetown que desarrollaron el primer sistema de corrección ortográfica para la corporación IBM."
- ↑ Harvey, Charlotte Bruce (mayo-junio de 2010). "Enseñar a las computadoras a deletrear (obituario de Henry Kučera)" . Revista de exalumnos de Brown . pág. 79.
- ↑ "Ispell Internacional" . www.cs.hmc.edu . Consultado el 19 de febrero de 2023 .
- ↑ "GNU Aspell" . aspell.net . Consultado el 19 de febrero de 2023 .
- ↑ «Hunspell: Acerca de» . hunspell.github.io . Consultado el 19 de febrero de 2023 .
- ↑ AbiWord/enchant , AbiWord, 13 de febrero de 2023 , consultado el 19 de febrero de 2023
- ↑ Anuncio (enero de 1981). "Micro Computer Industries, Ltd" (PDF) . Revista Compute!, número 8, vol. 3, n.° 1 , pág. 119.
- ↑ Anuncio (noviembre de 1982). "Se acabó el concurso de ortografía" . Revista PC . pág. 165. Consultado el 21 de octubre de 2013 .
- ↑ David Pogue (2009). Mac OS X Snow Leopard: El manual que faltaba .
- ↑ David Pogue (2015). Cambiar a Mac: El manual que faltaba . O'Reilly Media, Inc. ISBN 9781491948125.
- ↑ "VisualTools VT-Speller". Computerworld . 21 de febrero de 1994. pág. 68.
- ↑ "Consultar el 27 de septiembre de 1993" .
VT-SPELLER
- ↑ Peter G. Aitken (8 de noviembre de 1994). "Corrección ortográfica para tus aplicaciones". PC Magazine . pág. 299.
- ↑ "Aspell y Hunspell: Una historia de dos correctores ortográficos" . battlepenguin.com .
- ↑ "Corrector ortográfico médico para Firefox y Thunderbird" . e-MedTools. 2017. Archivado del original el 4 de mayo de 2019. Consultado el 29 de agosto de 2018 .
- ↑ Quathamer, Dr. Tobias (2016). "Términos del diccionario médico alemán" . Dr. Tobias Quathamer . Consultado el 29 de agosto de 2018 .
- ↑ Friedman, Richard A.; D, M (2003). "CASOS; ¿Cuentan la ortografía y la caligrafía? En medicina, sin duda" . The New York Times . Recuperado el 29 de agosto de 2018 .
- ↑ Chen, Raymond (22 de junio de 2026). "En memoria del hombre que puso garabatos rojos y verdes debajo de las palabras" . The Old New Thing . Archivado del original el 22 de junio de 2026. Recuperado el 22 de junio de 2026 .
- ↑ Banks, T. (2008). Dificultades en el aprendizaje de lenguas extranjeras y estrategias de enseñanza . (pág. 29). Tesis de maestría, Universidad Dominicana de California. Recuperado el 19 de marzo de 2012.
- ↑ Golding, Andrew R.; Roth, Dan (1999). "Artículo de revista". Machine Learning . 34. SpringerLink: 107–130 . doi : 10.1023/A:1007545901558 . S2CID 12283016 .
- ↑ Walt Mossberg (4 de enero de 2007). "Reseña" . Wall Street Journal . Consultado el 24 de septiembre de 2010 .
- ↑ "Sistema Operativo de Google" . googlesystem.blogspot.com. 29 de mayo de 2009. Consultado el 25 de septiembre de 2010 ."Corrector ortográfico contextual de Google" . 29 de mayo de 2009. Consultado el 25 de septiembre de 2010 .
Enlaces externos
- Norvig.com , "Cómo escribir un corrector ortográfico", por Peter Norvig
- BBK.ac.uk , "Corrección ortográfica por ordenador", por Roger Mitton
- CBSNews.com , El uso excesivo de correctores ortográficos limita la precisión, por Lloyd de Vries
- Historia y texto de "Candidato a una sorpresa de pollita" de Mark Eckman y Jerrold H. Zar
- Correctores ortográficos
- Características del editor de texto
- Procesamiento del lenguaje natural