【发布时间】:2019-11-24 17:59:38
【问题描述】:
我们已经准备好一个模型,它可以识别一个自定义命名实体。问题是如果给出了整个文档,那么如果只给出几个句子,模型就不能按预期工作,它会给出惊人的结果。
我想选择一个标记实体前后的两个句子。
例如。如果文档的一部分有世界科伦坡(标记为 GPE),我需要在标记之前选择两个句子,在标记之后选择 2 个句子。我尝试了几种方法,但复杂度太高了。
spacy 中是否有一种内置方法可以解决这个问题?
我正在使用 python 和 spacy。
我尝试通过识别标签的索引来解析文档。但这种方法真的很慢。
【问题讨论】:
标签: machine-learning nlp spacy