【问题标题】:How to calculate audio metrics through parselmouth on a subsequence of audio如何通过 parselmouth 在音频子序列上计算音频指标
【发布时间】:2019-07-26 22:35:25
【问题描述】:

我正在使用parselmouth(praat 的包装)来提取强度和音高特征:

snd = parselmouth.Sound(path)

intensity = snd.to_intensity()
pitch = snd.to_pitch()

但是,音频文件包含很长的静音序列,我想在计算这些音频指标之前将其删除。我可以通过处理通过 wave 包读取音频(并应用一些逻辑)返回的 numpy 数组来消除静音,但无法将新数组传递给 parselmouth。

我什至愿意向 parselmouth 提供 startTime 和 endTime 参数,但也找不到支持该参数的文档。

【问题讨论】:

    标签: python praat


    【解决方案1】:

    有两个选项可能对这种情况有用:

    请注意,您可能希望在移除静音时留出一点余量,因为 1) 强度和音高分析都使用特定大小的滑动窗口(因此,如果您不留余量,一些窗口将超过“不连续语音”),以及 2)音高分析使用启发式方法来保持 +- 连续音高轮廓(因此,如果您没有在检测到静音/没有发声的地方留出余量,则相邻片段' 音高估计会相互影响)。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2023-03-11
      • 1970-01-01
      • 2016-07-04
      相关资源
      最近更新 更多