【发布时间】:2019-06-11 09:59:50
【问题描述】:
我正在使用 Tess-Two 为 Android 创建 OCR。我使用相同的图像进行转换,但结果与桌面的 tesseract 非常不同。
tesseract 的桌面版本提供了更好的结果。
我在 Android 上使用以下行:
val baseApi = TessBaseAPI()
baseApi.init(dirPath, "eng")
baseApi.setImage(mustOpen)
val recognizedText = baseApi.utF8Text
在桌面上,我只使用这个简单的命令
tesseract image.png result
示例图片为:
使用 tesseract for Desktop 的图像输出是:
VEGETABLE OF, RIVET een Sra) SUGAR, EDIBLE
VEGETABLE OIL, INVERT SUGAR S' SUGAR, CITRIC
RAISING 503 (ii), BAKING }, SALT,
SOLIDS (0.6 % [ DL-ACETYL TARTARIC
ACID ESTERS OF ‘AND
而且,使用 tess-two for android 的输出是这样的:
'm mm W7 ' ' iii-E:
mmmmfiwgmb Ian»: came
a” ( om | mmmfiéu
mmormuguomws _
Won mm .. . . ml
mumm I'm‘n
( .
这是非常胡言乱语。请帮忙。
【问题讨论】:
-
你有没有想过?我面临同样的问题,不明白如何解决 100%。我已经通过使用 2 种语言(osd+eng)进行了改进,但结果仍然不同。我的理解是,tesseract 做了一些预处理,也许 Tess 2 中缺少这个。 github.com/tesseract-ocr/tesseract/wiki/… 这帮助我走到了现在
标签: android image-processing ocr tesseract tess-two