【发布时间】:2020-08-25 04:56:23
【问题描述】:
我有这张桌子的图片
我正在尝试使用 PyTesseract 解析它。使用这段代码我已经非常接近了:
from PIL import Image, ImageOps
import pytesseract
og_image = Image.open('og_image.png')
grayscale = ImageOps.grayscale(og_image)
inverted = ImageOps.invert(grayscale.convert('RGB'))
print(pytesseract.image_to_string(inverted))
这似乎非常准确,只是倒数第二列中的个位数为空白。我需要做一些不同的事情来获取这些数字吗?
【问题讨论】:
-
也有同样的问题。就我而言,如果所有数字都是个位数,它就可以工作。这不是一个理想的解决方案,但如果您可以删除所有多位数字并重新处理图像,它可能会起作用。 (注意:我不知道为什么。)
标签: python python-imaging-library ocr tesseract python-tesseract