【问题标题】:Extract personal information about a person from a list of documents and summarize it从文档列表中提取有关某人的个人信息并进行汇总
【发布时间】:2019-07-29 09:56:18
【问题描述】:

我需要从文档列表中提取有关某人的个人信息并将其汇总给用户。如果有 2 个人同名,则应确定正确的人。如果这个人有一个昵称,那也需要被识别。程序的输入可以是人名、地址、组织名称等。我使用 NLTK 库从文本中提取了命名实体,例如人、组织、位置等。提取命名实体后的输出如下,

[('Michael', 'NNP', 'B-PERSON'), ('Joseph', 'NNP', 'B-PERSON'), ('Jackson', 'NNP', 'I-PERSON' ), ('was', 'VBD', 'O'), ('born', 'VBN', 'O'), ('in', 'IN', 'O'), ('Gary', ' NNP', 'B-GPE'), (',', ',', 'O'), ('Indiana', 'NNP', 'B-GPE')....

现在,我想提取这些实体之间的关系。

【问题讨论】:

    标签: nlp nltk


    【解决方案1】:

    您的任务确实与 NLP 信息提取有关。看看这里以获得一个概述会更好。 Stanford Information extraction.

    另外,如果有重复的名称,一个名为实体链接的技术可以解决它。

    当您想要输出更准确的结果时,文档的标题也可以作为条件提供帮助。

    这是 NLP 中信息提取的示例。 希望这会有所帮助!

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2021-11-27
      • 1970-01-01
      相关资源
      最近更新 更多