【发布时间】:2016-09-19 02:42:13
【问题描述】:
我是 NLP 的新人,我正在尝试做文本分类工作。在做这项工作之前,我知道我们应该做词嵌入。 我的问题是我应该只对训练数据进行词嵌入工作(以便测试数据仅从训练数据的预训练 vec 模型获取向量),还是同时在训练数据和测试数据上进行?
【问题讨论】:
标签: machine-learning nlp text-classification word2vec word-embedding
我是 NLP 的新人,我正在尝试做文本分类工作。在做这项工作之前,我知道我们应该做词嵌入。 我的问题是我应该只对训练数据进行词嵌入工作(以便测试数据仅从训练数据的预训练 vec 模型获取向量),还是同时在训练数据和测试数据上进行?
【问题讨论】:
标签: machine-learning nlp text-classification word2vec word-embedding
这是一个非常重要的问题。在 NN 社区中,人们通常做的是在训练集中使用一个阈值(即频率
【讨论】: