.TRAINEDDATA 文件扩展名
Tesseract OCR模型
| 开发者 | Tesseract OCR Community |
| 受欢迎程度 |
4.2 | 5 票 |
什么是 TRAINEDDATA 文件?
TRAINEDDATA文件是由Tesseract创建的光学字符识别(OCR)模型。Tesseract是一款跨平台的开源OCR引擎。它包含用于自动识别和记录图像中所含文本的数据。每个TRAINEDDATA文件通常用于识别仅使用一种语言书写的文本,并以该语言命名(例如,eng.traineddata用于识别英文文本)。
更多信息
光学字符识别是将图像中的文本转换为机器编码文本的过程。Tesseract是一款OCR引擎,最初由Hewlett-Packard开发,目前由Google赞助的开源项目维护。开发人员可以使用Tesseract创建OCR模型,然后使用这些模型识别和转换图像中的文本。这些模型会保存为TRAINEDDATA文件。
每个TRAINEDDATA文件都使用一系列包含相关文本的图像进行“训练”。Tesseract包含许多默认的TRAINEDDATA文件,开发人员也可以创建自己的TRAINEDDATA文件。这些文件通常存储在~/Tessearct-OCR/tessdata目录中。
如何打开 TRAINEDDATA 文件
TRAINEDDATA文件不是用来打开的。开发人员会在调用Tesseract并使用它分析图像中所含文本的代码中引用TRAINEDDATA文件。