【问题标题】:Why are multiple model files created in gensim word2vec?为什么在 gensim word2vec 中会创建多个模型文件?
【发布时间】:2018-04-20 18:37:32
【问题描述】:

当我尝试创建 word2vec 模型(带负采样的跳过图)时,我收到了 3 个文件,输出如下。

word2vec (File)
word2vec.syn1nef.npy (NPY file)
word2vec.wv.syn0.npy (NPY file)

我只是担心为什么会发生这种情况,因为我之前在 word2vec 中的测试示例我只收到了一个模型(没有 npy 文件)。

请帮帮我。

【问题讨论】:

    标签: python word2vec gensim word-embedding


    【解决方案1】:

    具有较大内部向量数组的模型无法通过 Python 'pickle' 保存到单个文件中,因此超过一定阈值时,gensim save() 方法会将辅助数组存储在单独的文件中,使用更高效numpy 数组的原始格式(.npy 格式)。

    您仍然可以load() 模型,只需指定根模型文件名即可;当需要辅助数组时,加载代码会找到边文件——只要它们保存在根文件旁边。因此,在将模型移动到其他地方时,请确保将所有具有相同根文件名的文件放在一起。

    【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2019-05-26
    • 2014-04-02
    • 1970-01-01
    • 1970-01-01
    • 2018-11-01
    • 1970-01-01
    • 2018-06-09
    相关资源
    最近更新 更多