【发布时间】:2020-05-18 04:16:34
【问题描述】:
我很新学cognitiveMicrosoft Azure 的文字转语音 (TTS) 服务。通过使用Azure 的TTS 服务,我成功地将给定文本转换为音频文件。当我的SSML XML 文档中有一个voice 元素时,它工作正常。工作SSML的例子是;
<speak version="1.0" xml:lang="en-US">
<voice xml:lang="en-US" xml:gender="Male" name="en-US-Jessa24kRUS">
Hello, this is my sample text to convert into audio?
</voice>
</speak>
但是,当我有多个语音标签(基于性别)时,它会导致错误。其中SSML是:
<speak version="1.0" xml:lang="en-US">
<voice xml:lang="en-US" xml:gender="Male" name="en-US-Guy24kRUS"> What’s your name? </voice>
<voice xml:lang="en-US" xml:gender="Female" name="en-US-Jessa24kRUS"> My name is Cindy Smith. Do you know John Silver?</voice>
<voice xml:lang="en-US" xml:gender="Male" name="en-US-Guy24kRUS"> John and I are old friends. </voice>
<voice xml:lang="en-US" xml:gender="Female" name="en-US-Jessa24kRUS"> John just joined our company as a salesperson. </voice>
<voice xml:lang="en-US" xml:gender="Male" name="en-US-Guy24kRUS"> That’s good news. John has been a salesperson for chemical products for many years. </voice>
<voice xml:lang="en-US" xml:gender="Female" name="en-US-Jessa24kRUS"> I head he really likes his new job.</voice>
</speak>
错误是:
响应状态码不表示成功:400(SSML 必须包含最多 5 个语音元素。实际为 6 个。)。
如果有人解释为什么将我限制为五个voice tags,而documentation 中没有提到限制。
【问题讨论】:
-
文档有时会过时。
-
我真的被它困住了,它真的很疯狂。我还没有从任何门户网站获得任何解决方案,而且我的截止日期快到了。 :-(
-
向你表示哀悼
-
你有什么想法,我们如何联系微软解决问题!!
-
我不认为你能在微软做点什么。你最好把你的对话分成几块,然后把它们粘在一起。或者尝试其他 api,例如 amazon polly。
标签: xml azure text-to-speech azure-cognitive-services ssml