【问题标题】:Tesseract simple image with text recognition, Help wanted to convert/transform image带有文本识别的 Tesseract 简单图像,帮助想要转换/转换图像
【发布时间】:2017-12-08 12:49:24
【问题描述】:

您好,我正在尝试使用 OCR tesseract 来识别图像中的某些字母。

我使用 imagemagick 进行了转换,图像看起来不错,但还不够

原图:

imagemagick 用来转换的命令

convert input.jpg -fuzz 50% -fill black -opaque black -bordercolor white -border 2 -fill black -draw "color 0,0 floodfill" -alpha off -negate -units pixelsperinch -density 72 output.jpg

结果图片:

OCR tesseract 命令:

$ tesseract output.jpg out -psm 7

输出/结果:

文字:AUGU -> AUOU

Tesseract 开源 OCR 引擎 v4.00.00alpha 与 Leptonica 第 1 页

文本:VEGU -> VOR-OU

Tesseract 开源 OCR 引擎 v4.00.00alpha 与 Leptonica 第 1 页

文本:EGUV -> E6UV

Tesseract 开源 OCR 引擎 v4.00.00alpha 与 Leptonica 第 1 页

文本:USEA -> USSOEA

【问题讨论】:

  • 您的问题很可能是由字母和数字旋转引起的。我的理解是 OCR 通常不喜欢旋转的字符。它期望字符正确定向以获得最佳识别。但我不是 OCR 专家。所以我会听从其他可能知道更多的人的意见。
  • 续:尝试一个包含未旋转字母的示例。这行得通吗?
  • 我开始使用其他版本的 tesseract,谢谢!

标签: imagemagick ocr tesseract captcha leptonica


【解决方案1】:

不确定这是否纯粹是运气,因为您只提供了一张图片进行测试,但我注意到您使用的是嘈杂/模糊的 JPEG 而不是干净的 PNG,所以我将您的图片阈值设置为 50% 并且制作了一个 PNG,它可以正确识别所有四个字母:

convert yourImage.jpeg -threshold 50% clean.png
tesseract -psm 7 clean.png out

【讨论】:

  • 试过了,没有成功,你用的是什么版本的tesseract?结果是u s o: A
  • $ convert image_test.jpg -threshold 50% clean.png $ tesseract clean.png out -psm 7 && cat out.txt Tesseract 开源 OCR 引擎 v4.00.00alpha,带有 Leptonica 警告。无效的分辨率 0 dpi。改为使用 70。 u s o: A`
  • 我的是 v3.05.01 和 leptonica 1.74.1
  • 谢谢,这个版本运行良好,我能认出 15 张图片中的 13 张!
猜你喜欢
  • 1970-01-01
  • 2012-04-24
  • 1970-01-01
  • 2021-05-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2016-10-03
  • 1970-01-01
相关资源
最近更新 更多