【问题标题】:Stanford CoreNLP Classifier: NER training context斯坦福 CoreNLP 分类器:NER 训练上下文
【发布时间】:2018-12-04 06:11:18
【问题描述】:

在斯坦福的 CoreNLP 分类器中,我看到的所有示例都包含不想识别的单词(用 O 表示)。例如,下面的“确定”和“之前”不被识别为资产:

certain O       O
Apple   ASSET   ASSET
products       ASSET   ASSET
macOS   ASSET   ASSET
before  O       O

1) 我需要提供诸如“确定”和“之前”之类的上下文的词吗?

2) 顺序重要吗?我可以代替“某些,Apple,产品,macOS,之前”的顺序,而不是“之前,某些,Apple,macOS,产品”吗?

3) 如果需要上下文,一旦我添加了足够的训练数据,我是否可以在没有上下文的情况下添加更多资产?

【问题讨论】:

    标签: stanford-nlp


    【解决方案1】:

    广告 1. 如果您的分类取决于上下文,则上下文很有帮助。

    广告 2. 在斯坦福 CoreNLP 分类器的底层使用 CRF (Conditional Random Field) 算法,该算法也使用单词的顺序来正确分类。

    广告 3。见 pt。 1. - 必要性取决于您的问题和您的数据。您可以重用以前的上下文,看看这是否会提高或降低分类准确性。

    【讨论】:

      猜你喜欢
      • 2017-11-27
      • 2020-08-30
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2019-03-17
      • 1970-01-01
      • 2023-03-22
      • 1970-01-01
      相关资源
      最近更新 更多