【发布时间】:2017-07-22 09:00:33
【问题描述】:
我有一些扫描表格的数据。表单的格式是预定义的,我也有空表单的图像。我想针对表单中的每个值提取该信息。 R 或 python 中用于图像处理的任何已知解决方案或库以实现这些值都可以提供帮助。我已经在 python 中尝试过 openCv,但无法成功。有什么解决办法吗?
PFA 我拥有的这两种图像的屏幕截图。
【问题讨论】:
-
此过程称为optical character recognition 或“OCR”。尝试结合“python”搜索它。虽然我认为你会发现这很困难,尤其是如果表格是由不同的人填写的。
-
我尝试过 OCR,但是当我尝试使用 teseract 选择数据时,它也会将这些框视为字母“I”,我无法对其进行排序。我只需要从图像中获取这些值。休息的东西我已经想通了,使用 teseract。现在的问题在于,如何从这些图像中取出这些字符,以便我可以将其传递给下一个有助于 ocr 的程序。基本上问题归结为从图像中提取字符。字符识别我已经想通了。所以为此尝试了openCv。但仍然没有成功。
标签: python r opencv image-processing