【发布时间】:2018-12-26 17:32:42
【问题描述】:
给定我希望用户阅读(或多或少准确)的已知手稿(文本),识别用户在手稿中的进度的最佳方法是什么?
当我在 iOS 上寻找特定的解决方案时,我也对更一般的答案感兴趣。
iOS 提供了一个名为Speech 的语音识别框架,我可以使用它来识别任何语音。我目前的方法是使用该框架的字符串结果将它们与手稿进行匹配。但是,在我看来,这似乎有相当多的开销,并且当我第一次向语音识别器提供预期的单词时,它会节省资源并提高精度,以便它“知道”要听什么。
例如,当手稿中的下一个词是“鱼”时,我不会 需要语音识别器来搜索整个英语 字典中最匹配录制音频的单词——我只 需要得到一个概率值,用户刚刚 说“鱼”。
我认为它与关键字识别非常相似,只是我不仅识别了几个关键字,而且识别了整个手稿中的单词。
很遗憾,我一直无法在 iOS 上找到这样的 API。有没有比上述方法更好的方法来实现这种“语音跟踪”?
【问题讨论】:
标签: ios speech-recognition speech-to-text sfspeechrecognizer keyword-spotting