【问题标题】:On-device single-word voice recognition设备上单字语音识别
【发布时间】:2018-08-11 06:14:26
【问题描述】:

是否只需要一个单词语音识别就可以将任务的复杂性降低到足以离线在 iOS 或 Android 智能手机上执行语音识别处理? (例如,是否可以开发一个相当准确的计数器,用于在麦克风处于活动状态时说出单个预编程单词的次数,以便在标准 iOS 或 Android 智能手机上离线工作?)。

我找到了很多工具和示例来捕获语音并将其发送到在线服务(例如,Google 云语音到文本),但是单个词的焦点是否足以降低识别的复杂性?今天可以离线吗?如果是这样,你有什么图书馆可以推荐吗?或者你会从哪里开始?

【问题讨论】:

  • 你可以查看snowboy。
  • 哦,看起来很有希望——我会试一试并报告。谢谢!

标签: voice-recognition


【解决方案1】:

由于与您的问题相关的各种原因,云服务很好:

  1. 它使新版本算法的部署(发生的频率比大多数人意识到的多要容易得多)
  2. 它允许开发人员收集您的数据并将其用于未来的算法开发(或任何他们喜欢的)
  3. 从实用的角度来看,大多数已部署的模型(至少是有效的模型)都可能非常大,并且在移动设备上占用了相当多的空间。

除上述之外,我认为单数词焦点变化不大,如果有的话。该模型不仅要考虑单词,还要考虑这些单词的不同表达方式(音量、语调、重音、变形等)。

所以您所要求的可以完成,但也有充分的理由将其放在云端。

【讨论】:

  • 当然,我同意所有这些观点。但是,问题是关于设备上的可能性,因为不一定有互联网连接。
  • @medeny 我认为我的回答清楚地表明您可以这样做,但有很多理由不应该这样做。您将创建一个设备来只做一件事,一旦算法老化而没有更新,它就不会做得很好。
猜你喜欢
  • 2011-11-05
  • 1970-01-01
  • 2019-06-04
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多