【发布时间】:2020-01-10 23:54:25
【问题描述】:
我想教 AI 从 PDF 中提取特定短语。 例如,产品名称在文档中的某个地方进行了描述,人工智能必须找到并提取它。 我的问题是,如果将 PDF 作为图像或提取的字符串提供更好,因为文档的结构很粗略。 我希望我的问题可以理解。
也许有人对我也有一些想法或关键词:)
编辑: 感谢 lsimmons 的提示,我找到了一种方法: https://appliedmachinelearning.blog/2019/04/01/training-deep-learning-based-named-entity-recognition-from-scratch-disease-extraction-hackathon/
我会试试这个代码,当然只是使用产品名称而不是疾病。 这被称为“命名实体识别”,适用于遇到相同问题的每个人。 我希望这行得通。
【问题讨论】:
标签: keras deep-learning