【发布时间】:2019-03-05 20:19:18
【问题描述】:
我正在尝试在 C# windows 应用程序中创建一个 windows 应用程序,它应该使用 IBM Watson 服务来执行语音到文本的转换。
我们如何实现 IBM Watson Speech to Text API 服务 https://stream.watsonplatform.net/speech-to-text/api 应该听用户语音并编写输出文本。
我搜索了很多文章,在所有这些示例中,.wav(音频)文件作为输入传递并写入输出文本。
我正在尝试更实时地执行此 Speech to Text,而不是传递现有或存储的音频 (.wav) 文件。
使用 Microsoft.Speech 和类似的代码可以完成相同的功能 识别器.SetInputToDefaultAudioDevice()。这里的缺点是,我们必须输入 DictationGrammer。这样应用程序就可以识别语音并转换为文本。
是否也可以通过 Watson API 服务执行类似的任务?
【问题讨论】:
标签: c# api speech-recognition speech-to-text watson