【发布时间】:2018-03-23 18:13:33
【问题描述】:
我有很多像下面这样的图像,我需要使用 pytesseract 来抓取白色文本:
我使用下面的代码,但结果并不令人印象深刻:
import pytesseract
from PIL import Image
pytesseract.pytesseract.tesseract_cmd = 'C:/Program Files (x86)/Tesseract-OCR/tesseract'
im = Image.open('topLine.png')
print pytesseract.image_to_string(im)
结果:
Rouse Services | Renta Dastbonrd | Blei Rental
RJ |G | B (mmm @
所以我认为原因是图像中的非文本。我裁剪了图像中对我来说最重要的文本部分,并针对它运行了相同的代码:
但是,我得到的只是空白。 Pytesseract 根本没有找到任何文本。我做错了什么?
【问题讨论】:
标签: python python-2.7 ocr tesseract