【问题标题】:Semi-Automatic Text Highlighting in Images?图像中的半自动文本突出显示?
【发布时间】:2011-03-11 03:03:09
【问题描述】:

问候溢出者,

鉴于:

  • 我有包含混合语言文本的文档图像
  • 我需要让最终用户(逐字)突出显示此文本
  • 我已经有了纯数字格式的文本
  • 我将帮助我的程序找出单词的位置
  • 我不希望我的帮助对我来说很乏味
  • 我还将在我的程序之后手动修复小错误

为了让我的程序能够在选定的单词周围绘制矩形,我能提供的最简单的帮助是什么?你会为这个程序使用什么算法?我尝试过像 OmniPage Pro 这样的 OCR 工具,但它们不提供此功能。

问候

【问题讨论】:

    标签: image-processing automation ocr


    【解决方案1】:

    几年前,我在我的应用程序中实现了一个单词边界框并突出显示了单词。你说“我有纯数字格式的文本”。一个关键组件是具有字符或单词的坐标,以便将它们映射到适当的图像区域。就像在可搜索的 PDF 中一样,当您选择文本时,它会在内部映射到图像层,而图像上的相反选择会选择匹配的文本。但我相信即使从 PDF 中也无法导出这些坐标。如果您的文本中当前不存在此类坐标信息,最简单的方法可能是使用高质量引擎重新 OCR 图像,该引擎可以生成坐标作为输出的一部分。如果您使用 WiseTREND OCR Cloud 2.0,那么 XML 输出将生成所有详细的元数据。如果坐标信息存在,那么所有主要组件都在那里,它只是围绕着高效的 UI 设计工作。

    【讨论】:

    • 您知道您应该在您的个人资料中以及在任何提及您的产品的答案中披露您的从属关系,对吧?此外,您确实了解人们讨厌垃圾邮件,如果您看起来是垃圾邮件,他们会做出负面反应,对吧?
    • 您好。上面的答案已经有一年多了,如果我按照极客的要求去做,即使在今天,这也是我完成任务的方式。
    • 披露:我曾经参与过 WiseTREND OCR Cloud 2.0 的开发,我用它来开发与 geeko 要求的功能相似的应用程序。据我所知,当时没有其他选择。
    猜你喜欢
    • 1970-01-01
    • 2013-05-25
    • 2010-10-18
    • 2011-01-10
    • 1970-01-01
    • 1970-01-01
    • 2016-11-25
    • 1970-01-01
    • 2017-01-10
    相关资源
    最近更新 更多