【问题标题】:System.Speech.Recognition; background control or voice recognitionSystem.Speech.Recognition;后台控制或语音识别
【发布时间】:2017-10-14 22:26:37
【问题描述】:

我不确定这是否可能,但无论如何,

我在 winform C# 应用程序中使用 using System.Speech.Recognition;

我想知道是否不仅可以识别语音,还可以识别语音,以某种方式识别不同语音之间的差异

从每个单独的声音中获得接近于阅读多重内容的东西,例如来自两个同时或分开说话的用户作为不同的两个。

或者至少可能是某种控制背景响度的方法,例如,如果AudioLevelUpdated 事件允许我看到输入音量,但也可能存在一些特定的方法来将响亮的声音与额外的噪音或背景中的声音分开

【问题讨论】:

  • 恐怕您对免费的 SDK 期望过高...
  • @雷洋所以不可能...
  • 我不确定^_^
  • @Lei Yang 我找不到任何信息...

标签: c# speech-recognition voice-recognition microsoft-cognitive system.speech.recognition


【解决方案1】:

System.Speech.Recognition 不会帮助您进行语音识别。 System.Speech.Recognition 用于语音到文本。向其中添加语法可以提高其效率。您可以训练 Windows 桌面以获得更好的转换。请参阅控制面板中的语音识别。

有几个第三方库可用于语音识别。 去噪可以参考Sound visualizer in C#

您可以在msdn forum 找到有趣的讨论。

【讨论】:

    【解决方案2】:

    我认为您应该看看CRIS,它是 Microsoft 认知服务的一部分,至少对于您关于噪音的问题。

    CRIS 是一种自定义语音服务,其基本用途是使用自定义声学模型(如​​背景噪声)和使用样本学习词汇来提高语音到文本的质量。

    你可以导入:

    • 声学数据集

    • 语言数据集

    • 发音数据集

    例如在声学模型中你有:

    • Microsoft 对话模型,用于识别以对话方式说出的语音(即针对他人的语音)。

    • Microsoft 搜索和听写模型,用于定向到应用程序的语音,例如命令、搜索查询或听写。

    还有一个Speaker Recognition API 可供预览

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2011-09-16
      • 2018-02-23
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多