【问题标题】:How to fetch data out of an scanned image of a form?如何从表单的扫描图像中获取数据?
【发布时间】:2017-07-22 09:00:33
【问题描述】:

我有一些扫描表格的数据。表单的格式是预定义的,我也有空表单的图像。我想针对表单中的每个值提取该信息。 R 或 python 中用于图像处理的任何已知解决方案或库以实现这些值都可以提供帮助。我已经在 python 中尝试过 openCv,但无法成功。有什么解决办法吗?

PFA 我拥有的这两种图像的屏幕截图。

空表格图片:- 填写好的表格图片:-

【问题讨论】:

  • 此过程称为optical character recognition 或“OCR”。尝试结合“python”搜索它。虽然我认为你会发现这很困难,尤其是如果表格是由不同的人填写的。
  • 我尝试过 OCR,但是当我尝试使用 teseract 选择数据时,它也会将这些框视为字母“I”,我无法对其进行排序。我只需要从图像中获取这些值。休息的东西我已经想通了,使用 teseract。现在的问题在于,如何从这些图像中取出这些字符,以便我可以将其传递给下一个有助于 ocr 的程序。基本上问题归结为从图像中提取字符。字符识别我已经想通了。所以为此尝试了openCv。但仍然没有成功。
  • 这将是添加到问题中的好信息。如果表单有一些识别标记或矩形边界,您可能能够对齐/扭曲/缩放不同的图像,以便每个表单的所有框都位于相同的位置。然后,您需要手动定义一次所有框的位置并从所有表单中删除它们。也许this 和/或this 会有所帮助。

标签: python r opencv image-processing


【解决方案1】:

是OCR(Optical Character Recognition)问题,opencv不擅长,可以试试tesseracthttps://github.com/tesseract-ocr

【讨论】:

  • 这是 - 充其量 - 评论,而不是答案
猜你喜欢
  • 1970-01-01
  • 2013-03-17
  • 2010-09-19
  • 2015-05-02
  • 2012-07-06
  • 1970-01-01
  • 2018-04-18
  • 1970-01-01
  • 2012-05-26
相关资源
最近更新 更多