【发布时间】:2020-09-22 23:16:24
【问题描述】:
我的问题是解码器和编码器的 H。
在一个实现中,我看到一个 h 编码器,其尺寸为:[max source Len, batch size, hidden size]
和一个具有以下维度的 h 解码器:[#lstm 层、批量大小、隐藏的暗淡]
如果 W 矩阵的维度必须相同,我如何计算加法: https://blog.floydhub.com/attention-mechanism/#bahdanau-att-step1
感谢您的帮助
【问题讨论】:
标签: deep-learning lstm attention-model seq2seq