【发布时间】:2018-01-07 22:35:43
【问题描述】:
我正在使用 fast_align https://github.com/clab/fast_align 来获得 1000 个德语句子和这些句子的 1000 个英语翻译之间的单词对齐。到目前为止,质量不是那么好。
在流程中加入更多句子是否有助于 fast_align 更准确?假设我使用 100k 对齐的句子对获取一些 OPUS 数据,然后将我的 1000 个句子添加到它的末尾,并将其提供给 fast_align。那会有帮助吗?我似乎找不到任何关于这是否有意义的信息。
【问题讨论】:
-
你拥有什么数据集,领域和内容类型是什么,你的目标是什么?
标签: nlp translation machine-translation