【问题标题】:use tesseract v3 to create pdf documents with searcheable text command line使用 tesseract v3 创建带有可搜索文本命令行的 pdf 文档
【发布时间】:2014-04-14 16:37:26
【问题描述】:

我们正在使用 tessereact 从 tiff 扫描文档中提取文本,我们使用 tesseract 命令行选项启动它,但是我们希望使用 Tesseract V3.0 将此 tiff 扫描文档转换为具有可搜索文本的 PDF,并且我们需要使用命令行来获取它。

我们的系统是一个 Ubuntu 12 服务器,关于如何获得它有什么想法吗?我们一直在 Tesseract V3.0 数据表中进行搜索,但一直无法正确理解。

你们中有人有类似的吗?

提前非常感谢!!!

【问题讨论】:

    标签: linux command-line ocr tesseract


    【解决方案1】:

    您将需要Tesseract v3.03 来生成可搜索的 PDF。

    【讨论】:

    • 您好 非常感谢您的澄清,但是我在哪里可以下载要安装在我们的 ubuntu 服务器中的版本,我们在哪里可以找到手册或用户指南?我一直在检查 tesseract 网站,但没有找到该版本。非常感谢!!
    • 它将在 Ubuntu 14.04 中发布。或者您可以从source 构建。命令是:tesseract yourimage outfile pdf
    猜你喜欢
    • 2012-06-15
    • 1970-01-01
    • 2014-03-10
    • 1970-01-01
    • 1970-01-01
    • 2020-10-31
    • 1970-01-01
    • 2021-03-13
    • 2011-05-26
    相关资源
    最近更新 更多