【问题标题】:Microsoft Azure TTS Cognitive Service Voice Limit IssueMicrosoft Azure TTS 认知服务语音限制问题
【发布时间】:2020-05-18 04:16:34
【问题描述】:

我很新学cognitiveMicrosoft Azure 的文字转语音 (TTS) 服务。通过使用AzureTTS 服务,我成功地将给定文本转换为音频文件。当我的SSML XML 文档中有一个voice 元素时,它工作正常。工作SSML的例子是;

<speak version="1.0" xml:lang="en-US">
  <voice xml:lang="en-US" xml:gender="Male" name="en-US-Jessa24kRUS"> 
       Hello, this is my sample text to convert into audio? 
  </voice>
</speak>

但是,当我有多个语音标签(基于性别)时,它会导致错误。其中SSML是:

<speak version="1.0" xml:lang="en-US">
  <voice xml:lang="en-US" xml:gender="Male" name="en-US-Guy24kRUS"> What’s your name? </voice>
  <voice xml:lang="en-US" xml:gender="Female" name="en-US-Jessa24kRUS"> My name is Cindy Smith. Do you know John Silver?</voice>
  <voice xml:lang="en-US" xml:gender="Male" name="en-US-Guy24kRUS"> John and I are old friends. </voice>
  <voice xml:lang="en-US" xml:gender="Female" name="en-US-Jessa24kRUS"> John just joined our company as a salesperson. </voice>
  <voice xml:lang="en-US" xml:gender="Male" name="en-US-Guy24kRUS"> That’s good news. John has been a salesperson for chemical products for many years. </voice>
  <voice xml:lang="en-US" xml:gender="Female" name="en-US-Jessa24kRUS"> I head he really likes his new job.</voice>
</speak>

错误是:

响应状态码不表示成功:400(SSML 必须包含最多 5 个语音元素。实际为 6 个。)。

如果有人解释为什么将我限制为五个voice tags,而documentation 中没有提到限制。

【问题讨论】:

  • 文档有时会过时。
  • 我真的被它困住了,它真的很疯狂。我还没有从任何门户网站获得任何解决方案,而且我的截止日期快到了。 :-(
  • 向你表示哀悼
  • 你有什么想法,我们如何联系微软解决问题!!
  • 我不认为你能在微软做点什么。你最好把你的对话分成几块,然后把它们粘在一起。或者尝试其他 api,例如 amazon polly。

标签: xml azure text-to-speech azure-cognitive-services ssml


【解决方案1】:

由于延迟,这是一个已知设置。我们已经意识到并正在努力消除此限制。希望我们能在这周内完成修复和部署,如果一切顺利的话,我们可能会更早完成。

【讨论】:

  • 因为这个限制,我实现了一个错误的逻辑。我正在创建多个 5 个声音的块并循环调用 API。在得到多个响应后,我将它们组合起来并创建一个文件。我多么粗鲁!
  • 一旦这个限制被取消,请不要忘记 ping 我。谢谢
  • 你好@Ram,关于修复错误的任何消息!
  • 部署完成。请立即尝试。
  • 感谢您的回复。测试后我会 ping 你。
猜你喜欢
  • 1970-01-01
  • 2019-11-17
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2019-08-18
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多