【发布时间】:2020-10-01 00:09:54
【问题描述】:
*没有编码经验等
我在 SSML 的中断语法中找到了答案,但我不确定我是否可以将它与神经声音 (V3) 一起使用 + 不确定(如果这里的问题是的话)我可以在哪里插入这些中断语法卷曲命令
【问题讨论】:
标签: curl ibm-cloud text-to-speech ibm-watson ssml
*没有编码经验等
我在 SSML 的中断语法中找到了答案,但我不确定我是否可以将它与神经声音 (V3) 一起使用 + 不确定(如果这里的问题是的话)我可以在哪里插入这些中断语法卷曲命令
【问题讨论】:
标签: curl ibm-cloud text-to-speech ibm-watson ssml
API 文档中用于语音合成的 cURL 命令是 https://cloud.ibm.com/apidocs/text-to-speech#synthesize-audio-get
curl -X GET -u "apikey:{apikey}" --output hello_world.wav "{url}/v1/synthesize?accept=audio%2Fwav&text=Hello%20world&voice=en-US_AllisonV3Voice"
正在处理的文本是
text=Hello%20world
如果您需要添加 SSML 语音转换,例如。
<voice-transformation rate="slow">
Hello World
</voice-transformation>
那么你需要将HTML字符转义为
text=<voice-transformation rate="slow">Hello%20world<voice-transformation rate="slow">
制作完整的 cURL
curl -X GET -u "apikey:{apikey}" --output hello_world.wav "{url}/v1/synthesize?accept=audio%2Fwav&text=<voice-transformation rate="slow">Hello%20world<voice-transformation rate="slow">&voice=en-US_AllisonV3Voice"
目前只有3个声音可以这样修改-https://cloud.ibm.com/docs/text-to-speech?topic=text-to-speech-transformation
所以没有神经声音。
【讨论】:
<break>、<paragraph>或<sentance> - cloud.ibm.com/docs/text-to-speech?topic=text-to-speech-timing
上面的答案并不准确。您可以控制所有 IBM 语音的语速,只需使用韵律 SSML 标记:
<prosody rate="slow">Decrease speaking rate by 25%</prosody>
【讨论】: