Articulo de referencia

Reconocimiento inteligente de caracteres

El reconocimiento inteligente de caracteres ( ICR ) es un método para extraer texto manuscrito de imágenes. Es un tipo de tecnología OCR más sofisticada que reconoce diferentes ...

El reconocimiento inteligente de caracteres ( ICR ) es un método para extraer texto manuscrito de imágenes. Es un tipo de tecnología OCR más sofisticada que reconoce diferentes estilos de escritura y fuentes para interpretar de forma inteligente los datos de documentos físicos. [ 1 ]

El ICR se utiliza para organizar datos no estructurados en papel mediante el escaneo de documentos, la extracción de información y la adaptación de los datos extraídos para su almacenamiento en bases de datos . Los algoritmos ICR colaboran con el OCR para automatizar la entrada de datos en formularios, eliminando la necesidad de teclear. Ofrece un alto grado de precisión y es un método fiable para procesar rápidamente diversos documentos manuscritos. [ 1 ]

Capacidades

La mayoría del software ICR utiliza algoritmos basados ​​en redes neuronales de autoaprendizaje , que actualizan automáticamente la base de datos de reconocimiento para nuevos patrones de escritura a mano. Esto amplía la utilidad de los dispositivos de escaneo para el procesamiento de documentos, desde el reconocimiento de caracteres impresos (una función del OCR) hasta el reconocimiento de texto manuscrito. Dado que este proceso implica el reconocimiento de escritura a mano, los niveles de precisión pueden no ser muy altos en algunos casos, pero pueden alcanzar tasas de precisión superiores al 97 % en la lectura de escritura a mano en formatos estructurados. A menudo, para lograr estas altas tasas de reconocimiento, se utilizan varios motores de lectura dentro del software, cada uno con derecho a voto para determinar la lectura correcta de los caracteres. En campos numéricos, los motores diseñados para leer números tienen preferencia, mientras que en campos alfanuméricos, los motores diseñados para leer letras manuscritas tienen mayor prioridad. Cuando se utiliza junto con una interfaz personalizada, los datos manuscritos se pueden introducir automáticamente en un sistema administrativo , evitando la laboriosa introducción manual de datos y logrando una mayor precisión que la entrada manual tradicional.

Procesamiento automatizado de formularios

Un avance importante del reconocimiento automático de documentos (ICR) fue la invención del procesamiento automatizado de formularios en 1993 por Joseph Corcoran, a quien se le otorgó una patente por dicha invención. Este proceso constaba de tres etapas: primero, se capturaba la imagen del formulario que iba a ser procesado por el ICR y se preparaba para que el motor del ICR ofreciera los mejores resultados; luego, se capturaba la información utilizando el motor del ICR; y finalmente, se procesaban los resultados para validar automáticamente la salida del motor del ICR.

Esta aplicación del ICR aumentó la utilidad de la tecnología y la hizo aplicable a formularios reales en aplicaciones comerciales habituales. Las aplicaciones de software modernas utilizan el ICR como tecnología para reconocer texto en formularios rellenados a mano (impresos a mano).

Diferencias entre ICR y OCR

LOC

El reconocimiento óptico de caracteres (OCR) se aplica comúnmente a cualquier técnica de reconocimiento que lea texto impreso. Un ejemplo de uso tradicional del OCR sería traducir los caracteres de la imagen de un documento impreso, como la página de un libro, un recorte de periódico o un contrato legal, a un archivo independiente que pueda buscarse y actualizarse con un procesador de texto o un visor de documentos. También resulta muy útil para automatizar el procesamiento de formularios. La información se puede extraer rápidamente de los campos del formulario e introducirse en otra aplicación, como una hoja de cálculo o una base de datos, aplicando el motor OCR por zonas a dichos campos.

Sin embargo, los datos suelen introducirse manualmente en lugar de teclearse en campos de formulario. La identificación de caracteres se vuelve aún más difícil al leer material manuscrito. La diversidad de más de 700 000 variantes de fuentes impresas es minúscula en comparación con las variaciones casi ilimitadas de los caracteres manuscritos. El programa de reconocimiento debe tener en cuenta no solo las diferencias estilísticas, sino también el tipo de instrumento de escritura utilizado, la calidad del papel, los errores, la estabilidad de la mano y las manchas o la tinta corrida. [ 2 ]

ICR

El reconocimiento inteligente de caracteres (RIC) utiliza algoritmos en constante mejora para recopilar más información sobre las variaciones en los caracteres escritos a mano e identificarlos con mayor precisión. El RIC, creado a principios de la década de 1990 para automatizar el procesamiento de formularios , permite convertir datos introducidos manualmente en texto fácil de leer, buscar y modificar. Su mejor rendimiento se obtiene al leer caracteres claramente divididos en áreas o zonas diferenciadas, como los campos fijos presentes en muchos formularios estructurados. [ 2 ]

Tanto el OCR como el ICR pueden configurarse para leer diversos idiomas; sin embargo, limitar el conjunto de caracteres esperado a un número menor de idiomas producirá mejores resultados de reconocimiento. El ICR no puede leer escritura cursiva, ya que debe poder evaluar cada carácter individualmente. Al escribir en cursiva, puede resultar difícil distinguir dónde termina un carácter y comienza otro, y existen más diferencias entre muestras que al escribir texto a mano. Un método más reciente, denominado reconocimiento inteligente de palabras (IWR), se centra en leer una palabra en contexto en lugar de reconocer caracteres individuales. [ 2 ]

Reconocimiento inteligente de palabras

El reconocimiento inteligente de palabras (RIP) puede reconocer y extraer no solo información manuscrita impresa, sino también escritura cursiva. El reconocimiento de caracteres individuales (RCI) reconoce caracteres, mientras que el RIP trabaja con palabras o frases completas. Capaz de capturar información no estructurada de páginas cotidianas, se considera que el RIP está más avanzado que el RCI de huellas dactilares.

IWR no pretende reemplazar los sistemas ICR y OCR convencionales, sino que está optimizado para procesar documentos reales que contienen principalmente campos de datos de formato libre, difíciles de reconocer y que, por naturaleza, no son adecuados para ICR. Esto significa que el mejor uso de IWR consiste en eliminar un alto porcentaje de la entrada manual de datos manuscritos y campos de texto escrito a mano en documentos que, de otro modo, solo podrían ser introducidos manualmente por personas.

Véase también

Lista de referencias

  1. 1 2 "¿Qué es el reconocimiento inteligente de caracteres? - Una introducción al OCR inteligente" . www.docsumo.com . Consultado el 19 de marzo de 2023 .
  2. 1 2 3 "OCR vs ICR: ¿Cuál es la diferencia?" . Accusoft . Consultado el 19-03-2023 .