【发布时间】:2019-09-25 16:26:36
【问题描述】:
我正在尝试使用 pytesseract 识别一些文本,但在此之前我必须将我拥有的图片转换为二进制图片。 请注意,我首先调整了图片的大小,以便 pytesseract 更易于阅读。
请看下面的原始图片,调整大小的图片,我的代码和我得到的结果,这样你就可以理解我的问题了..
image = cv2.imread('original.png',0)
image = cv2.resize(image,None,fx=2,fy=2,interpolation=cv2.INTER_CUBIC)
cv2.imwrite("resized.png", image)
thresh = cv2.threshold(image, 0, 255, cv2.THRESH_BINARY + cv2.THRESH_OTSU)[1]
result = 255 - thresh
cv2.imwrite("after_threshold.png", result)
感谢您的帮助:)
【问题讨论】:
标签: python opencv tesseract python-tesseract threshold