【发布时间】:2018-02-25 16:03:16
【问题描述】:
我试图识别的最简单的例子:
我使用DOCUMENT_TEXT_DETECTION,但在答案中我得到了象形文字。
如果我在ImageContext 参数中为addAllLanguageHints 方法使用Eng,那么我的结果是111。更好,但仍然很糟糕。
有什么方法可以表明数字被识别或以某种方式改善结果?
另外,ImageContext 中的setRepeatedField 选项是如何使用的?我找不到任何使用它的例子。
提前致谢。
【问题讨论】:
-
同样的问题。我在这里找到了一些预处理代码:github.com/arturaugusto/display_ocr 但在使用 Google Cloud Vision 时似乎没有多大帮助(例如,当您从该存储库中截取“22”的屏幕截图并将其发送到 Vision API 时,它不是正确识别)。我一直在玩各种 OpenCV 预处理技术 - 但运气不佳。
标签: google-vision