【问题标题】:Cloud Vision API poorly recognizes 7-segment numbersCloud Vision API 无法识别 7 段数字
【发布时间】:2018-02-25 16:03:16
【问题描述】:

我试图识别的最简单的例子:

我使用DOCUMENT_TEXT_DETECTION,但在答案中我得到了象形文字。

如果我在ImageContext 参数中为addAllLanguageHints 方法使用Eng,那么我的结果是111。更好,但仍然很糟糕。

有什么方法可以表明数字被识别或以某种方式改善结果?

另外,ImageContext 中的setRepeatedField 选项是如何使用的?我找不到任何使用它的例子。

提前致谢。

【问题讨论】:

  • 同样的问题。我在这里找到了一些预处理代码:github.com/arturaugusto/display_ocr 但在使用 Google Cloud Vision 时似乎没有多大帮助(例如,当您从该存储库中截取“22”的屏幕截图并将其发送到 Vision API 时,它不是正确识别)。我一直在玩各种 OpenCV 预处理技术 - 但运气不佳。

标签: google-vision


【解决方案1】:

即使它不能开箱即用......您需要使用自定义标签对图像进行分类,而默认标签还不够用。 Cloud Auto ML Vision(从蓝色下拉菜单中选择 Vision)让您训练自定义模型,该模型可用于识别该字体。而且由于 7 段显示器可能的形状数量非常有限,因此训练它应该不会太难。如果你得到一个显示更好的计算器,它也可能会更好。上面的 LCD 看起来有点便宜,有那些巨大的空间和截止的结尾——但尽管如此,我们可以训练它来阅读。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2018-08-29
    • 1970-01-01
    • 1970-01-01
    • 2019-11-25
    • 2017-06-07
    • 2019-09-09
    • 1970-01-01
    相关资源
    最近更新 更多