【发布时间】:2012-10-12 17:54:15
【问题描述】:
我的任务是处理大量的音频文件。每个文件必须分四步处理:
- 从 .wav 转换为原始 pcm,
- 重采样,
- 量化
- 使用三种语音编解码器之一进行编码。
每个步骤对应一个程序,将文件作为输入并返回文件作为输出。逐个文件处理似乎需要很长时间。如何优化程序?例如。并行编程之类的?我试图利用 ramdisk 来减少文件读取/写入所花费的时间,但它并没有改善。 (为什么?) 我在 Ubuntu Linux 下用 Python 编写代码。提前致谢。
【问题讨论】:
标签: python corpus large-data