【发布时间】:2021-02-09 01:56:24
【问题描述】:
只是在这里寻找指导,甚至是关于方法的一般概述。
我正在使用 azure 搜索对一批 pdf 进行 OCR。我已经打开了点击突出显示,并且我成功地获得了结果,我正在为最终用户循环/显示在我的视图中。我正在考虑扩展该功能以显示 pdf 图像,并在图像本身上突出显示,就像在 JFK azure 示例中一样。我不擅长反应,似乎迷路了。
我假设我需要使用创建的 normalized_images 将 OCR 图像保存到数据存储以供参考?我在本地确实有可以加载的 pdf,但假设 OCR 图像可能不同。已打开 GeneratedNormalizedImagesPerPage 并打开了在我的存储帐户中创建文件的缓存。
然后我假设我需要拉出关联的图像,显示它,使用突出显示结果并拉出检测到短语的相应边界框?这种方法的问题在于,我看不到高光命中与命中位置(边界框)之间的任何关联,也看不到命中所在的关联图像文件。
这里的方法可能还有一段路要走,但感谢任何指导。
编辑 1 我确实注意到了 JFK 示例中此页面上的项目:https://github.com/microsoft/AzureSearch_JFK_Files/tree/master/JfkWebApiSkills/JfkWebApiSkills 尝试将 ImageStore(因此它们存储在我的存储帐户中)和 HocrGenerator(似乎处理文档中的点)复制到我的技能集以用于我的索引是方法吗?
【问题讨论】:
标签: azure location highlight azure-cognitive-search