【发布时间】:2016-12-24 14:18:32
【问题描述】:
我们在 C#.net 中使用了一个解决方案,在该解决方案中,某人可以拨打电话号码并先说出一个人,然后是姓氏。然后在我们网站上的来宾注册表中输入该名称。我们使用从美国人口普查中获得的包含 5,000 个名字和 89,000 个姓氏的 XML 字典文件。我们正在使用 Microsoft.Speech.Recognition 库,(也许这就是问题所在)。
我们的问题是,即使使用像 Joshua McDaniels 这样相对简单的名字,我们的失败率也只有 30%。性能(速度方面)很好,只是没有抓住大部分名称。
现在,我知道最终口语名称的质量将决定系统的性能,但对于双关语,我们希望在“实验室”条件下达到接近 99%,发音完美,没有口音,然后称其为好。但即使经过多次试验,同一个人说话、同一个名字、同一个电话、同一个环境,我们的失败率仍然是 25%。
我的问题是:有人知道更好的方法吗?我们考虑过可能会尝试使用 API,这样匹配会更加相关和最新。
【问题讨论】:
标签: c# speech-recognition speech-to-text speech