【发布时间】:2021-11-29 20:03:33
【问题描述】:
因为 FR v3.0 仍然是预览模式,所以我去了 v2.1 Quickstarts,“Analyze using a Prebuilt model”,导航到 @987654322 @。 使用 Form Type = "Invoice" 测试了很多大小和文字,包括手写,结果很满意,尤其是返回的 JSON 文件结构:
...
"analyzeResult":
{
...
readResults:[...],
pageResults:[...]
...
}
对于大/复杂的图像/文档,使用基于rowIndex 和columnIndex 的pageResults.tables[0].cells,我可以轻松地将每一行文本拼凑成整个文档。对于小/简单的图像/文档或pageResults.tables.length==0,使用readResults.lines 实现相同的 OCR 结果,如一刀切,完美!
接下来是我自己动手操作的相同图像,示例,JavaScript。因为我一直只使用 Invoice,所以我选择了 identifyInvoice.js,很好的示例,简单易懂。即使它是 v3 并且缺少 readResults 和 pageResutls,我仍然可以使用 invoice.pages[0].tables[0].cells 为大型/复杂图像/文档实现相同的结果。对于小/简单的图像发现 2 个问题:
-
invoice.pages[0].tables.length = 0,所以没有文本值。 - 只有文本值是
NRT LLC.的invoice.fields.VendorName.value,其他所有v2.1 返回的打印文本和手写都没有了!
我相信上述变化在MS方面一定有一些原因,对我们来说这意味着v3不向后兼容。更重要的是,我们无法知道图像是否适合模型和/或在提交之前是否会返回某些内容,即使我们提供了模型选择列表,用户可能会因额外的手动工作而感到沮丧。目前我们所能做的就是切换回谷歌。所以,
- v2.x 示例代码在哪里,MS 何时停止使用 v2.x?
- v2.x 如何过渡到 v3?
下面是我的导航路线。谢谢您,非常感谢您的出色工作!
【问题讨论】:
标签: form-recognizer