【发布时间】:2019-05-15 03:58:44
【问题描述】:
我按照教程 https://cmusphinx.github.io/wiki/tutorialam/ 为我的越南语训练了一个新的声学模型。简单地说,我记录了从 0 到 9 的数字进行训练,并使用这些训练数据进行测试。因此,准确率应该是预期的 100%。然而,它只有大约 20%(只认 2 和 3)。我重新录制了很多次,但它没有改变。我可以确保我完全满足所有要求,例如 16k 采样率、16 位深度……
谁能给我一些解释和改进我的模型的方法?谢谢大家
【问题讨论】:
标签: speech-recognition speech-to-text cmusphinx