【问题标题】:Voice dependent speech recognition语音依赖语音识别
【发布时间】:2012-12-04 09:18:13
【问题描述】:

我正在为嵌入式设备寻找依赖语音的语音识别解决方案。我看过pocketsphinx,但因为我仍然不熟悉它,我想也许更有经验的人可能知道。是否可以使用pocketsphinx 来实现这样的语音识别。它应该记录音频,提取其特征,然后将其与所说的任何内容相匹配,而不是使用声学和语言模型。是否可以使用 pocketsphinx 来实现这个流程?如果不是,有人可以为我指出这样一个解决方案的正确方向吗? 谢谢。

【问题讨论】:

    标签: voice-recognition speech cmusphinx


    【解决方案1】:

    是否可以使用pocketsphinx 来实现这样的语音识别。

    pocketsphinx API 中没有这样的功能

    你可以做的是先用sphinxbase提取MFC系数,例如看sphinx_fe源码。

    然后您可以应用 DTW 算法来比较记录。 DTW的实现很简单,就50行代码:

    http://en.wikipedia.org/wiki/Dynamic_time_warping

    很少有库也实现了DTW,您可以在维基百科页面上找到链接。

    很高兴看到一个演示 DTW 实现的 pocketsphinx 补丁。

    【讨论】:

      猜你喜欢
      • 2011-11-01
      • 2018-02-23
      • 1970-01-01
      • 2018-04-17
      • 1970-01-01
      • 1970-01-01
      • 2021-07-15
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多