【发布时间】:2018-05-03 11:52:55
【问题描述】:
我正在尝试使用 CNN 为药物-药物相互作用构建关系提取系统,并且需要为我的句子中的单词进行嵌入。该计划是将句子中的每个单词表示为 3 个嵌入的组合: (w2v,dist1,dist2) 其中 w2v 是预训练的 word2vec 嵌入,dist1 和 dist2 是句子中每个单词与两种药物之间的相对距离可能是相关的。
我对如何处理填充问题感到困惑,以便每个句子的长度相等。我应该用一些字符串(什么字符串?)填充标记化的句子以在任何嵌入之前均衡它们的长度吗?
【问题讨论】:
标签: python nlp keras word2vec word-embedding