【发布时间】:2020-02-28 07:33:03
【问题描述】:
我有一个用于字符级英语拼写校正的编码器-解码器模型,这是非常基本的东西,有两个 LSTM 编码器和另一个 LSTM 解码器。
然而,到目前为止,我一直在预先填充编码器输入序列,如下所示:
abc -> -abc
defg -> defg
ad -> --ad
接下来我将数据分成几个具有相同解码器输入长度的组,例如
train_data = {'15': [...], '16': [...], ...}
其中关键是解码器输入数据的长度,我一直在为循环中的每个长度训练一次模型。
但是,必须有更好的方法来做到这一点,例如在 EOS 之后或 SOS 字符之前进行填充等。但如果是这种情况,我将如何更改损失函数以便不计算此填充陷入损失?
【问题讨论】:
标签: python keras sequence seq2seq encoder-decoder