【发布时间】:2014-09-28 23:16:01
【问题描述】:
我正在一个网站上执行 ocr,特别是在这两个图像上:
我是 OCR 的新手,我使用以下内容:
from PIL import Image
import pytesseract
my_image = '....png'
text = pytesseract.image_to_string(Image.open(my_image))
在第二张图片中,它可以识别除单个数字 3、4、5、6 之外的所有内容。
在第一张图片中,它也无法识别单个数字。
我通过调整图像大小、反转图像和使用阈值来预处理图像。
这是一种标准字体,所以我知道还有其他方法可以做到这一点,但在一定程度上它对我有用,所以我想在进入更高级的东西之前保持简单。
【问题讨论】:
-
澄清一下,它不能识别 only 第二张图片中的 3、4、5、6 - 第一张,它不能识别 any个位数对吗?
-
是的,任何图像中都没有单个数字。
-
数字似乎使用 psm 6 显示。
-
个位数也出现了?
-
尝试使用 ImageMagick 将图像转换为 tiff,然后在终端上测试:tesseract yourimag.tiff output.txt
标签: python ocr tesseract python-tesseract