【问题标题】:Best way to handle OOV words when using pretrained embeddings in PyTorch在 PyTorch 中使用预训练嵌入时处理 OOV 单词的最佳方法
【发布时间】:2019-05-11 21:43:09
【问题描述】:

我在 PyTorch 中使用 word2vec 预训练嵌入(遵循代码 here)。但是,它似乎无法处理看不见的单词。有什么好办法解决吗?

【问题讨论】:

    标签: deep-learning nlp pytorch


    【解决方案1】:

    FastText 构建字符 ngram 向量作为模型训练的一部分。当它找到一个 OOV 单词时,它会将单词中的字符 ngram 向量求和以生成该单词的向量。您可以找到更多详细信息here

    【讨论】:

      猜你喜欢
      • 2021-09-26
      • 2018-10-30
      • 2018-03-12
      • 1970-01-01
      • 2019-04-18
      • 2019-07-11
      • 1970-01-01
      • 2019-10-27
      • 2018-07-19
      相关资源
      最近更新 更多