.TRAINEDDATA Extensión de archivo
Modelo de OCR de Tesseract
| Desarrollador | Tesseract OCR Community |
| Popularidad |
4.2 | 5 Votos |
¿Qué es un archivo TRAINEDDATA?
Un archivo TRAINEDDATA es un modelo de reconocimiento óptico de caracteres (OCR) creado por Tesseract, un motor de OCR multiplataforma y de código abierto. Contiene datos que se utilizan para reconocer y registrar automáticamente el texto incluido en imágenes. Cada archivo TRAINEDDATA normalmente se utiliza para reconocer texto escrito en un solo idioma y recibe el nombre de ese idioma (por ejemplo, eng.traineddata se utiliza para reconocer texto en inglés).
Más información
El reconocimiento óptico de caracteres es el proceso de convertir el texto encontrado en imágenes en texto codificado para máquinas. Tesseract es un motor de OCR desarrollado originalmente por Hewlett-Packard, pero que ahora se mantiene como un proyecto de código abierto patrocinado por Google. Los desarrolladores pueden utilizar Tesseract para crear modelos de OCR, que luego se utilizan para reconocer y convertir el texto encontrado en imágenes. Estos modelos se guardan como archivos TRAINEDDATA.
Cada archivo TRAINEDDATA se ha "entrenado" utilizando una serie de imágenes que contienen texto relevante. Tesseract incluye muchos archivos TRAINEDDATA predeterminados, y los desarrolladores pueden crear sus propios archivos TRAINEDDATA. Estos archivos normalmente se almacenan en el directorio ~/Tessearct-OCR/tessdata.
Cómo abrir un archivo TRAINEDDATA
Los archivos TRAINEDDATA no están diseñados para abrirse. Los desarrolladores hacen referencia a los archivos TRAINEDDATA en el código que llama a Tesseract y lo utiliza para analizar el texto incluido en imágenes.