.TRAINEDDATA Dateiendung
Tesseract-OCR-Modell
| Entwickler | Tesseract OCR Community |
| Beliebtheit |
4,2 | 5 Stimmen |
Was ist eine TRAINEDDATA-Datei?
Eine TRAINEDDATA-Datei ist ein Modell für die optische Zeichenerkennung (OCR), das von Tesseract, einer plattformübergreifenden Open-Source-OCR-Engine, erstellt wurde. Sie enthält Daten, die dazu verwendet werden, in Bildern enthaltenen Text automatisch zu erkennen und zu erfassen. Jede TRAINEDDATA-Datei wird typischerweise dazu verwendet, Text in nur einer Sprache zu erkennen, und ist nach dieser Sprache benannt (z. B. wird eng.traineddata zur Erkennung englischen Textes verwendet).
Weitere Informationen
Optische Zeichenerkennung ist der Prozess, bei dem in Bildern gefundener Text in maschinenlesbaren Text umgewandelt wird. Tesseract ist eine OCR-Engine, die ursprünglich von Hewlett-Packard entwickelt wurde, heute jedoch als von Google unterstütztes Open-Source-Projekt betreut wird. Entwickler können Tesseract verwenden, um OCR-Modelle zu erstellen, die anschließend zur Erkennung und Umwandlung von in Bildern gefundenem Text verwendet werden. Diese Modelle werden als TRAINEDDATA-Dateien gespeichert.
Jede TRAINEDDATA-Datei wurde anhand einer Reihe von Bildern, die relevanten Text enthalten, „trainiert“. Tesseract enthält viele standardmäßige TRAINEDDATA-Dateien, und Entwickler können eigene TRAINEDDATA-Dateien erstellen. Diese Dateien werden typischerweise im Verzeichnis ~/Tessearct-OCR/tessdata gespeichert.
So öffnen Sie eine TRAINEDDATA-Datei
TRAINEDDATA-Dateien sind nicht zum Öffnen vorgesehen. Entwickler verweisen in Code, der Tesseract aufruft und zur Analyse von in Bildern enthaltenem Text verwendet, auf TRAINEDDATA-Dateien.