【发布时间】:2018-08-13 22:44:51
【问题描述】:
我有一个如下图所示的表格,我想提取所有信息,包括印刷文本(书籍、ID)和数字手写文本(订单数)作为 txt 文件。 有谁可以建议我什么是最好的解决方案? 我目前的想法是:
- 使用深度学习从每一列中获取对象的位置。
- 应用 Tesseract 从这些对象中提取文本。 (有更好的库吗?)
- 使用深度学习来识别手写文本
【问题讨论】:
标签: machine-learning computer-vision deep-learning
我有一个如下图所示的表格,我想提取所有信息,包括印刷文本(书籍、ID)和数字手写文本(订单数)作为 txt 文件。 有谁可以建议我什么是最好的解决方案? 我目前的想法是:
【问题讨论】:
标签: machine-learning computer-vision deep-learning
您可以使用称为 EAST 的文本本地化模型从图像中提取文本。 https://github.com/argman/EAST
然后您可以使用其中一种 OCR 模型来转录文本。
【讨论】: