【发布时间】:2014-10-04 13:05:07
【问题描述】:
基本上我希望能够通过已上传到我的网络服务器 (LAMP) 的音频剪辑进行扫描,并获取音频剪辑的文本内容。
有固定的方法吗?语音识别有什么好的现成解决方案(最好是基于命令行的)?
【问题讨论】:
基本上我希望能够通过已上传到我的网络服务器 (LAMP) 的音频剪辑进行扫描,并获取音频剪辑的文本内容。
有固定的方法吗?语音识别有什么好的现成解决方案(最好是基于命令行的)?
【问题讨论】:
您说您使用 LAMP 堆栈,这意味着您依赖 PHP。语音识别是一项昂贵的工作,如果由使用 C 或 C++ 等低级语言编写的外部工作人员处理,它会更快完成。此外,AFAIK 没有原生 PHP 解决方案来做这种工作。
PHP 允许library loading on runtime,我认为这是要走的路。如果我是你,我会围绕 C/C++ 语音识别库编写一个薄包装器,并从 PHP 代码中调用它。有关如何编写此类扩展的更多详细信息,请参阅此 SO answer。
您可以使用一些开源语音识别库:
正如您所注意到的,没有简单的解决方案,但它仍然是可行的。祝你好运!
【讨论】: