.TRAINEDDATA 文件扩展名

Tesseract OCR模型

开发者 Tesseract OCR Community
受欢迎程度
4.2  |  5 票
 

什么是 TRAINEDDATA 文件?

TRAINEDDATA文件是由Tesseract创建的光学字符识别(OCR)模型。Tesseract是一款跨平台的开源OCR引擎。它包含用于自动识别和记录图像中所含文本的数据。每个TRAINEDDATA文件通常用于识别仅使用一种语言书写的文本,并以该语言命名(例如,eng.traineddata用于识别英文文本)。

更多信息

光学字符识别是将图像中的文本转换为机器编码文本的过程。Tesseract是一款OCR引擎,最初由Hewlett-Packard开发,目前由Google赞助的开源项目维护。开发人员可以使用Tesseract创建OCR模型,然后使用这些模型识别和转换图像中的文本。这些模型会保存为TRAINEDDATA文件。

每个TRAINEDDATA文件都使用一系列包含相关文本的图像进行“训练”。Tesseract包含许多默认的TRAINEDDATA文件,开发人员也可以创建自己的TRAINEDDATA文件。这些文件通常存储在~/​Tessearct-OCR/​tessdata目录中。

如何打开 TRAINEDDATA 文件

TRAINEDDATA文件不是用来打开的。开发人员会在调用Tesseract并使用它分析图像中所含文本的代码中引用TRAINEDDATA文件。

使用File Viewer Plus打开 400 多种文件格式。免费下载

可打开或引用 TRAINEDDATA 文件的程序

Windows
免费
Mac
免费
Linux
免费
分类:开发者
更新时间:2022年3月14日

经 FileInfo.com 验证

FileInfo.com 团队独立研究了本页面列出的 Tesseract OCR模型文件格式和 Mac、Windows 和 Linux 应用。我们的目标是达到 100% 的准确率,并且仅发布我们已验证过的文件类型信息。

如果您想为此页面提出新增或更新建议,请告诉我们。