【发布时间】:2021-06-09 11:20:31
【问题描述】:
我目前正在为我的语言实施 DeepSpeech。我有 2 个目录:训练和测试。 Train 大约有 15000 个 wav,测试大约 3000 个。我面临的问题是在训练过程中损失很大,而测试部分的损失很大。
您能给我一些提示吗? 谢谢!
【问题讨论】:
我目前正在为我的语言实施 DeepSpeech。我有 2 个目录:训练和测试。 Train 大约有 15000 个 wav,测试大约 3000 个。我面临的问题是在训练过程中损失很大,而测试部分的损失很大。
您能给我一些提示吗? 谢谢!
【问题讨论】:
新的DeepSpeech PlayBook 在training 和testing 上都有部分,可以在此处提供一些指导。
立即突出的一件事是您没有验证集。这将是我要更改的第一件事 - 确保您有一个验证集。有关测试、验证和训练集之间差异的更多信息,请参阅this article。
您正在使用自定义的 alphabet.txt 文件,这很棒 - 我假设它包含罗马尼亚字母表的所有字符?
接下来要做的是降低高原学习率 - 这在 PlayBook 中有介绍。
多诺洛克。
【讨论】: