【问题标题】:Tesseract improvements and image pre-processing stepsTesseract 改进和图像预处理步骤
【发布时间】:2014-09-04 14:33:50
【问题描述】:

我正在研究 Tesseract 库,下面是 Tesseract 的输入,

在实施的初始步骤中,我只使用了身份证的“MRZ”区域。 但实际意图是扫描整个文档,得到身份证中的所有文字。

我已经通过this document 并且为了提高 Tesseract 的质量,第一步是图像应该是 300 dpi。

1) 如何将ios中拍摄的相机图像转换为300 dpi?

2) Tesseract 提供最佳输出的最佳对比度和亮度级别应该是多少?

3) 是否有任何其他预处理步骤可以应用于图像以获得良好的准确性?

4) 为了获得更好的精度,推荐的图像分辨率是多少?

5) 我使用"int tesseract::TESSDLL_API::MeanTextConf" 来获得置信度分数。有了每个字符的置信度分数,我是否有可能确定置信度分数是否高于某个百分比,那么识别的字符是否准确?如果我错了,你能解释一下“MeanTextConf”方法的使用吗?

【问题讨论】:

  • 您是否成功地让 Tessact 像您的样本一样处理来自 ID 文档的图像?
  • 您好,如果最终用户使用相机,则无法控制 DPI。在此处查看 DPI 信息:en.wikipedia.org/wiki/DPI 但是,这并不意味着您无法获得良好的 OCR 结果。用户提供图像后,您可以在将图像输入 OCR 引擎之前执行自动对比度和噪声去除以提高图像质量。您附上的图片实际上质量很好,我可以使用我们的商业包Asprise OCR SDK 识别机读区部分
  • <block type="text" subtype="line" x="44" y="93" width="490" height="16" words="1" confidence="69"><![CDATA[IDFRAREUVRE<<<<<<<<<<<<<<<<<<<782112]]></block> <block type="text" subtype="line" x="42" y="59" width="493" height="17" words="1" confidence="63"><![CDATA[0905782001557CHRISTOPHE<<TH9006142M8]]></block>

标签: ios ios5 ocr tesseract


【解决方案1】:

前段时间,我写了几篇关于图像预处理和“OCR 如何发挥最佳作用”的通用 OCR 博客文章。请在此处找到它们:http://www.ocr-it.com/user-scenario-process-digital-camera-pictures-and-ocr-to-extract-specific-numbers

一般来说,获得足够高的分辨率应该是第一步。低分辨率根本没有足够的每个字母的信息来可靠地读取字符。然后我进行自适应二值化,使用阈值将图像转换为黑白,其中背景应该是药房,字符应该保持非常清晰,没有额外的噪音或孔洞。然后,可选地,可以对各个字段进行分段,并通过特定的设置分别处理每个字段,例如数字为“仅数字”,性别字段为“M|F”等。

【讨论】:

  • 看起来你所有的旧帖子现在都不见了。
  • 是的 @Ilya 如果你重新上传它会很好
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2014-10-30
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2019-01-12
  • 2014-03-30
  • 2015-05-10
相关资源
最近更新 更多