【发布时间】:2020-02-17 17:43:12
【问题描述】:
我想使用印地语(非英语语言)的一些音频数据的 PESQ、STOI 分数。对于英语,我可以找到 PESQ 算法/代码并使用相同的。喜欢:-StackOverflow question,Python pesq(PyPI)STOI。
我们能否对印地语或其他语言的音频使用相同的代码来确定 PESQ/STOI 分数?
大多数时候,我发现 PESQ 用于“评估语音质量”(不特定于英语)。同样在PESQ score comparison in different languagesPESQ score comparison in different languages_2,他们刚刚比较了不同语言的 PESQ 分数。他们不使用不同的代码。
但是有一些像A Methodology for Improving PESQ accuracy for Chinese Speech这样的论文 ,这是写在结论部分:-“在本文中,正在评估 PESQ,以调查在计算语音质量时是否考虑了中文语音的辅音和声调可理解性。在进行的两个实验中,发现在嘈杂和安静(无噪声)条件下,主观可懂度与 PESQ 的计算质量之间的相关性较低”,
而且在Performance Evaluation and Accuracy Upgrading of PESQ in Chinese Environment ,结论部分提到:-“通过这个结果 大量主观测试数据,反复指出 中文PESQ的分数被低估了, 尽管皮尔逊相关系数高达 除外。 PESQ 给出的分数远低于体验 当语音服务在中间时来自客户 质量。 "
那么对于其他语言(目前我的情况是印地语,印度语),我应该直接使用普通的PESQ方法还是必须修改这个?如果我必须修改相同的内容,那么对于某些印度语言(或英语以外)的任何可用想法都会非常有帮助。
【问题讨论】:
标签: audio speech-recognition speech-to-text speech