.TRAINEDDATA Estensione file
Modello OCR di Tesseract
| Sviluppatore | Tesseract OCR Community |
| Popolarità |
4,2 | 5 Voti |
Che cos'è un file TRAINEDDATA?
Un file TRAINEDDATA è un modello di riconoscimento ottico dei caratteri (OCR) creato da Tesseract, un motore OCR open source multipiattaforma. Contiene dati utilizzati per riconoscere e registrare automaticamente il testo contenuto nelle immagini. Ogni file TRAINEDDATA viene in genere utilizzato per riconoscere il testo scritto in una sola lingua e prende il nome da quella lingua (ad esempio, eng.traineddata viene utilizzato per riconoscere il testo in inglese).
Maggiori informazioni
Il riconoscimento ottico dei caratteri è il processo di conversione del testo presente nelle immagini in testo codificato dalla macchina. Tesseract è un motore OCR originariamente sviluppato da Hewlett-Packard, ma ora mantenuto come progetto open source sponsorizzato da Google. Gli sviluppatori possono utilizzare Tesseract per creare modelli OCR, che vengono poi utilizzati per riconoscere e convertire il testo presente nelle immagini. Questi modelli vengono salvati come file TRAINEDDATA.
Ogni file TRAINEDDATA è stato sottoposto a "addestramento" utilizzando una serie di immagini contenenti testo pertinente. Tesseract include molti file TRAINEDDATA predefiniti e gli sviluppatori possono crearne di propri. Questi file vengono in genere archiviati nella directory ~/Tessearct-OCR/tessdata.
Come aprire un file TRAINEDDATA
I file TRAINEDDATA non sono destinati all'apertura. Gli sviluppatori fanno riferimento ai file TRAINEDDATA nel codice che richiama Tesseract e lo utilizza per analizzare il testo incluso nelle immagini.