【问题标题】:CMUSphinx Training acoustic model very low accuracyCMUSphinx 训练声学模型精度非常低
【发布时间】:2019-05-15 03:58:44
【问题描述】:

我按照教程 https://cmusphinx.github.io/wiki/tutorialam/ 为我的越南语训练了一个新的声学模型。简单地说,我记录了从 0 到 9 的数字进行训练,并使用这些训练数据进行测试。因此,准确率应该是预期的 100%。然而,它只有大约 20%(只认 2 和 3)。我重新录制了很多次,但它没有改变。我可以确保我完全满足所有要求,例如 16k 采样率、16 位深度……

谁能给我一些解释和改进我的模型的方法?谢谢大家

这是我的项目:https://github.com/legiaquy/test

【问题讨论】:

    标签: speech-recognition speech-to-text cmusphinx


    【解决方案1】:

    训练数据不足。根据tutorial你需要:

    • 1 小时录音,用于单个扬声器的指挥和控制
    • 5 小时的 200 个扬声器的录音,用于对许多扬声器进行指挥和控制
    • 10 小时单人听写录音
    • 50 小时的 200 位演讲者的录音,用于许多演讲者的听写

    您可以从https://github.com/undertheseanlp/automatic_speech_recognition获取越南语数据

    【讨论】:

      猜你喜欢
      • 2020-04-07
      • 2021-05-26
      • 2018-01-25
      • 1970-01-01
      • 1970-01-01
      • 2020-08-06
      • 2014-04-04
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多