【问题标题】:Tesseract-OCR not recognizing digitsTesseract-OCR 无法识别数字
【发布时间】:2021-03-11 15:51:55
【问题描述】:

我使用 Tesseract OCR 来识别下面的图片(它是一个电动图像计),但它不起作用。 我不允许使用机器学习或深度学习。有没有人有其他技术可以用来解决我的问题?请给我一个指导。感谢您的阅读。

这是我的根图片:

我处理的这张图片必须能识别数字

这是我的代码:

import cv2
import pytesseract as pts
pts.pytesseract.tesseract_cmd = r'C:\Users\Thep Ho\AppData\Local\Programs\Tesseract-OCR\tesseract.exe'

img = cv2.imread("images/text1.jpg")
text = pts.image_to_string(img)
print(text)

【问题讨论】:

  • 您是否已经检查过thisthis

标签: python opencv image-processing ocr division


【解决方案1】:
  • 如果将adaptive-thresholding 应用于输入图像:

  • 现在,如果您应用 regular-expression 从提取的文本中删除所有非数字变量:

    • 99951
      

代码:


import re
import cv2
import pytesseract

img = cv2.imread("Eadxj.png")
gry = cv2.cvtColor(img, cv2.COLOR_BGR2GRAY)
flt = cv2.adaptiveThreshold(gry,
                            252, cv2.ADAPTIVE_THRESH_MEAN_C,
                            cv2.THRESH_BINARY_INV, 31, 7)
txt = pytesseract.image_to_string(flt)
txt_int = re.sub("[^0-9]", "", txt)
print(txt_int)

但如果你被允许使用deep-learning,结果将是:

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2011-07-25
    • 1970-01-01
    • 1970-01-01
    • 2017-08-27
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多