【发布时间】:2017-12-08 12:49:24
【问题描述】:
您好,我正在尝试使用 OCR tesseract 来识别图像中的某些字母。
我使用 imagemagick 进行了转换,图像看起来不错,但还不够
原图:
imagemagick 用来转换的命令
convert input.jpg -fuzz 50% -fill black -opaque black -bordercolor white -border 2 -fill black -draw "color 0,0 floodfill" -alpha off -negate -units pixelsperinch -density 72 output.jpg
结果图片:
OCR tesseract 命令:
$ tesseract output.jpg out -psm 7
输出/结果:
文字:AUGU -> AUOU
Tesseract 开源 OCR 引擎 v4.00.00alpha 与 Leptonica 第 1 页
文本:VEGU -> VOR-OU
Tesseract 开源 OCR 引擎 v4.00.00alpha 与 Leptonica 第 1 页
文本:EGUV -> E6UV
Tesseract 开源 OCR 引擎 v4.00.00alpha 与 Leptonica 第 1 页
文本:USEA -> USSOEA
【问题讨论】:
-
您的问题很可能是由字母和数字旋转引起的。我的理解是 OCR 通常不喜欢旋转的字符。它期望字符正确定向以获得最佳识别。但我不是 OCR 专家。所以我会听从其他可能知道更多的人的意见。
-
续:尝试一个包含未旋转字母的示例。这行得通吗?
-
我开始使用其他版本的 tesseract,谢谢!
标签: imagemagick ocr tesseract captcha leptonica