【问题标题】:MLKit giving less accurate results than Google VisionMLKit 提供的结果不如 Google Vision 准确
【发布时间】:2022-08-08 13:28:00
【问题描述】:

一直在测试 MLKit,发现与 Google Vision 相比,结果不太准确。我启用的一件事是 Google Vision 的语言提示,例如

                    image: {
                        content: base64String
                    },

                    features: [
                        {
                            type: \"TEXT_DETECTION\"
                        }
                    ],
                    imageContext:
                    {
                        languageHints: [\'en\']
                    }

我在想也许我需要为 MLKit 启用语言提示,但不确定如何。我正在Android和IOS上进行测试。

对于 MLKit,我使用的版本是最新的 v2 beta:

  pod \'GoogleMLKit/TextRecognition\', \'3.1.0\'

对于 Android,我正在使用:

    implementation \'com.google.mlkit:text-recognition:16.0.0-beta4\'

    标签: google-vision google-mlkit


    【解决方案1】:
    • 3.1.0 是文本识别的 beta 版本,我们支持除拉丁语以外的 4 种其他语言,所以如果您 create instances of these 4 languages,它将返回指定语言的结果。否则,它只会返回拉丁文本的结果。

    • 如果您只比较en 的结果,那么没有其他输入参数可以改进 ML Kit 的结果。

    • 你有 ML Kit 用法的代码 sn-p 吗?

    • 如果有数据点可以显示 ML Kit 和 Google 视觉结果之间的差异,那就太好了,我们可以从那里进行更多调查。谢谢!

    【讨论】:

    • 是否有我可以将信息发送到的电子邮件或其他位置?
    • 您可以将其压缩并在此处上传。
    • 另外@Julie 我注意到 MLKit 和 Google Lens 应用程序之间的差异。这也是您感兴趣的事情还是预期的这些差异?
    • 谢谢,我们将进一步查看代码。预期的不同之处在于:ML Kit 是仅在设备上的 SDK,而 Google Len 正在与云一起工作。通常服务器模型会获得更好的结果,SDK的选择取决于您的使用案例。
    【解决方案2】:

    我也注意到了这一点,MLKit 文本提取工具要求文本图片正确对齐,就像垂直 90 度一样。而使用 Google Vision API,它甚至可以在反转文本时提取文本。

    附图是轮胎的序列号,即使倒置也可以被谷歌视觉检测到,它不适用于 MLKit。

    在现实世界的应用中,并不总是能够以 MLKit 要求的完美对齐方式拍摄照片。

    【讨论】:

      猜你喜欢
      • 2017-09-27
      • 1970-01-01
      • 2021-09-15
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2015-10-30
      • 1970-01-01
      • 2022-07-29
      相关资源
      最近更新 更多