.TRAINEDDATA Rozszerzenie pliku
Model OCR Tesseract
| Deweloper | Tesseract OCR Community |
| Popularność |
4,2 | 5 Głosów |
Czym jest plik TRAINEDDATA?
Plik TRAINEDDATA to model optycznego rozpoznawania znaków (OCR) utworzony przez Tesseract, wieloplatformowy silnik OCR o otwartym kodzie źródłowym. Zawiera dane używane do automatycznego rozpoznawania i zapisywania tekstu znajdującego się na obrazach. Każdy plik TRAINEDDATA jest zazwyczaj używany do rozpoznawania tekstu zapisanego tylko w jednym języku i nosi nazwę tego języka (np. eng.traineddata służy do rozpoznawania tekstu w języku angielskim).
Więcej informacji
Optyczne rozpoznawanie znaków to proces przekształcania tekstu znajdującego się na obrazach w tekst zakodowany maszynowo. Tesseract to silnik OCR, który został pierwotnie opracowany przez Hewlett-Packard, ale obecnie jest rozwijany jako projekt o otwartym kodzie źródłowym sponsorowany przez Google. Programiści mogą używać Tesseract do tworzenia modeli OCR, które następnie służą do rozpoznawania i przekształcania tekstu znajdującego się na obrazach. Modele te są zapisywane jako pliki TRAINEDDATA.
Każdy plik TRAINEDDATA został „wytrenowany” za pomocą serii obrazów zawierających odpowiedni tekst. Tesseract zawiera wiele domyślnych plików TRAINEDDATA, a programiści mogą tworzyć własne pliki TRAINEDDATA. Pliki te są zazwyczaj przechowywane w katalogu ~/Tessearct-OCR/tessdata.
Jak otworzyć plik TRAINEDDATA
Pliki TRAINEDDATA nie są przeznaczone do otwierania. Programiści odwołują się do plików TRAINEDDATA w kodzie, który wywołuje Tesseract i używa go do analizowania tekstu zawartego na obrazach.