【问题标题】:Difference between the MFCC feature used in speaker recognition and speech recognition?说话人识别和语音识别中使用的 MFCC 特征有什么区别?
【发布时间】:2017-04-22 12:49:43
【问题描述】:

我有一个概念问题。

我知道什么是 MFCC。但我无法找到用于说话人识别和语音识别的 mfcc 特征向量之间的区别,即 mfcc 特征的哪一部分被用作两者之间的区分因素? 还有我们如何根据 mfcc 向量区分两个说话者?

【问题讨论】:

    标签: speech-recognition voice-recognition mfcc


    【解决方案1】:

    功能非常相似。不同之处在于系数的数量、窗口大小、归一化......等等。看看this thread

    使用 mfcc 功能,您可以通过多种方式区分扬声器。两种最著名的技术是:

    • GMM/UBM 技术:您可以为每个说话者创建一个 GMM,并将另一个 GMM 作为背景模型,然后对输入话语进行评分。
    • i-vector 技术:这是对 mfcc 的一种后处理,以生成表示扬声器声学模型的新向量。此技术在Microsoft Speaker Recognition Servicehere's a description 中使用,了解其工作原理。

    【讨论】:

      猜你喜欢
      • 2016-09-23
      • 1970-01-01
      • 2019-05-05
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2012-07-28
      相关资源
      最近更新 更多