.TRAINEDDATA Extensão de arquivo
Modelo de OCR do Tesseract
| Desenvolvedor | Tesseract OCR Community |
| Popularidade |
4,2 | 5 Votos |
O que é um arquivo TRAINEDDATA?
Um arquivo TRAINEDDATA é um modelo de reconhecimento óptico de caracteres (OCR) criado pelo Tesseract, um mecanismo de OCR de código aberto e multiplataforma. Ele contém dados usados para reconhecer e registrar automaticamente o texto contido em imagens. Cada arquivo TRAINEDDATA geralmente é usado para reconhecer textos escritos em apenas um idioma e recebe o nome desse idioma (por exemplo, eng.traineddata é usado para reconhecer textos em inglês).
Mais informações
O reconhecimento óptico de caracteres é o processo de converter textos encontrados em imagens em textos codificados por máquina. O Tesseract é um mecanismo de OCR originalmente desenvolvido pela Hewlett-Packard, mas que agora é mantido como um projeto de código aberto patrocinado pelo Google. Os desenvolvedores podem usar o Tesseract para criar modelos de OCR, que são usados para reconhecer e converter textos encontrados em imagens. Esses modelos são salvos como arquivos TRAINEDDATA.
Cada arquivo TRAINEDDATA é "treinado" usando uma série de imagens que contêm textos relevantes. O Tesseract inclui muitos arquivos TRAINEDDATA padrão, e os desenvolvedores podem criar seus próprios arquivos TRAINEDDATA. Esses arquivos geralmente são armazenados no diretório ~/Tessearct-OCR/tessdata.
Como abrir um arquivo TRAINEDDATA
Os arquivos TRAINEDDATA não foram feitos para serem abertos. Os desenvolvedores fazem referência aos arquivos TRAINEDDATA em códigos que chamam o Tesseract e o usam para analisar textos incluídos em imagens.