【问题标题】:Speech Recognition for a Web ServerWeb 服务器的语音识别
【发布时间】:2014-10-04 13:05:07
【问题描述】:

基本上我希望能够通过已上传到我的网络服务器 (LAMP) 的音频剪辑进行扫描,并获取音频剪辑的文本内容。

有固定的方法吗?语音识别有什么好的现成解决方案(最好是基于命令行的)?

【问题讨论】:

    标签: speech-recognition


    【解决方案1】:

    您说您使用 LAMP 堆栈,这意味着您依赖 PHP。语音识别是一项昂贵的工作,如果由使用 C 或 C++ 等低级语言编写的外部工作人员处理,它会更快完成。此外,AFAIK 没有原生 PHP 解决方案来做这种工作。

    PHP 允许library loading on runtime,我认为这是要走的路。如果我是你,我会围绕 C/C++ 语音识别库编写一个薄包装器,并从 PHP 代码中调用它。有关如何编写此类扩展的更多详细信息,请参阅此 SO answer

    您可以使用一些开源语音识别库:

    • CMU Sphinx(用 C 编写,API 用 CC++ 编写)
    • Voce(CMU Sphinx 包装器,C++Java 中的 API)

    正如您所注意到的,没有简单的解决方案,但它仍然是可行的。祝你好运!

    【讨论】:

      猜你喜欢
      • 2011-02-22
      • 1970-01-01
      • 1970-01-01
      • 2012-06-26
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2012-02-12
      • 1970-01-01
      相关资源
      最近更新 更多