【发布时间】:2018-07-02 09:40:22
【问题描述】:
我在一个大型语料库上训练了一个 w2v 模型,我想用一个更小的带有新句子(和新单词)的模型来更新它。
在第一次大训练中,我采用了 alpha 的默认参数(0.025 with lin.decay to 0.0001)
现在,我想使用model.train 来更新它。但是从文档中我不明白在这次培训更新期间将使用哪个(初始和最终)学习率。
从一方面来说,如果你也使用 0.025 和 lin。衰减到 0.0001,对于在第一个大语料库中出现很多的已经存在的单词来说它太强了,并且会发生很大的变化,但是从另一方面来说新单词(添加了 model.build_vocab(sentences, update = True) ) 0.0001 的低学习率太小了。
所以我的问题是:
- API 中
model.train对新句子的学习率的默认行为是什么? 我应该如何选择学习率来考虑这个新旧词的问题?
[旁白问题] 为什么当我在同一个句子上使用 2 次 model.train 时,第二次它不会更新向量?
【问题讨论】:
标签: python machine-learning word2vec gensim