【发布时间】:2022-01-03 10:45:47
【问题描述】:
我想将音频编码从 mulaw 更改为线性,以便使用 Google 的线性语音识别模型。 我正在使用电话频道,因此音频以 mulaw、8 位、8000Hz 编码。 当我使用 Google Mulaw 模型时,识别一些简短的单词会出现一些问题 -> 基本上它们根本无法识别 -> API 返回无 我想知道更改 Linear 或 Flac 的编码是否是一种好习惯? 我已经做到了,但我无法真正衡量这种改进的程度。
【问题讨论】:
-
嗨@ylvi-bux,如果我的回答解决了您的问题,请考虑接受并支持它。如果没有,请告诉我,以便我改进答案。
标签: audio speech-to-text google-speech-api google-speech-to-text-api mu-law