.TRAINEDDATA 파일 확장자
Tesseract OCR 모델
| 개발사 | Tesseract OCR Community |
| 인기도 |
4.2 | 5 표 |
TRAINEDDATA 파일이란 무엇인가요?
TRAINEDDATA 파일은 멀티플랫폼 오픈 소스 OCR 엔진인 Tesseract가 만든 광학 문자 인식(OCR) 모델입니다. 이미지에 포함된 텍스트를 자동으로 인식하고 기록하는 데 사용되는 데이터가 들어 있습니다. 각 TRAINEDDATA 파일은 일반적으로 한 언어로 작성된 텍스트만 인식하는 데 사용되며, 해당 언어의 이름을 따서 지정됩니다(예: eng.traineddata는 영어 텍스트를 인식하는 데 사용됩니다).
추가 정보
광학 문자 인식은 이미지에서 찾은 텍스트를 기계가 인코딩할 수 있는 텍스트로 변환하는 과정입니다. Tesseract는 원래 Hewlett-Packard가 개발했지만, 현재는 Google이 후원하는 오픈 소스 프로젝트로 유지 관리되는 OCR 엔진입니다. 개발자는 Tesseract를 사용하여 OCR 모델을 만들 수 있으며, 이렇게 만든 모델은 이미지에서 찾은 텍스트를 인식하고 변환하는 데 사용됩니다. 이러한 모델은 TRAINEDDATA 파일로 저장됩니다.
각 TRAINEDDATA 파일은 관련 텍스트가 포함된 일련의 이미지를 사용하여 "훈련"됩니다. Tesseract에는 기본 TRAINEDDATA 파일이 여러 개 포함되어 있으며, 개발자는 자체 TRAINEDDATA 파일을 만들 수 있습니다. 이러한 파일은 일반적으로 ~/Tessearct-OCR/tessdata 디렉터리에 저장됩니다.
TRAINEDDATA 파일을 여는 방법
TRAINEDDATA 파일은 열도록 만들어진 파일이 아닙니다. 개발자는 Tesseract를 호출하고 이미지에 포함된 텍스트를 분석하는 코드에서 TRAINEDDATA 파일을 참조합니다.