【发布时间】:2014-09-04 14:33:50
【问题描述】:
我正在研究 Tesseract 库,下面是 Tesseract 的输入,
在实施的初始步骤中,我只使用了身份证的“MRZ”区域。 但实际意图是扫描整个文档,得到身份证中的所有文字。
我已经通过this document 并且为了提高 Tesseract 的质量,第一步是图像应该是 300 dpi。
1) 如何将ios中拍摄的相机图像转换为300 dpi?
2) Tesseract 提供最佳输出的最佳对比度和亮度级别应该是多少?
3) 是否有任何其他预处理步骤可以应用于图像以获得良好的准确性?
4) 为了获得更好的精度,推荐的图像分辨率是多少?
5) 我使用"int tesseract::TESSDLL_API::MeanTextConf" 来获得置信度分数。有了每个字符的置信度分数,我是否有可能确定置信度分数是否高于某个百分比,那么识别的字符是否准确?如果我错了,你能解释一下“MeanTextConf”方法的使用吗?
【问题讨论】:
-
您是否成功地让 Tessact 像您的样本一样处理来自 ID 文档的图像?
-
您好,如果最终用户使用相机,则无法控制 DPI。在此处查看 DPI 信息:en.wikipedia.org/wiki/DPI 但是,这并不意味着您无法获得良好的 OCR 结果。用户提供图像后,您可以在将图像输入 OCR 引擎之前执行自动对比度和噪声去除以提高图像质量。您附上的图片实际上质量很好,我可以使用我们的商业包Asprise OCR SDK 识别机读区部分
-
<block type="text" subtype="line" x="44" y="93" width="490" height="16" words="1" confidence="69"><![CDATA[IDFRAREUVRE<<<<<<<<<<<<<<<<<<<782112]]></block> <block type="text" subtype="line" x="42" y="59" width="493" height="17" words="1" confidence="63"><![CDATA[0905782001557CHRISTOPHE<<TH9006142M8]]></block>