【发布时间】:2014-04-14 16:37:26
【问题描述】:
我们正在使用 tessereact 从 tiff 扫描文档中提取文本,我们使用 tesseract 命令行选项启动它,但是我们希望使用 Tesseract V3.0 将此 tiff 扫描文档转换为具有可搜索文本的 PDF,并且我们需要使用命令行来获取它。
我们的系统是一个 Ubuntu 12 服务器,关于如何获得它有什么想法吗?我们一直在 Tesseract V3.0 数据表中进行搜索,但一直无法正确理解。
你们中有人有类似的吗?
提前非常感谢!!!
【问题讨论】:
标签: linux command-line ocr tesseract