【问题标题】:Speech to text conversion for non-english language非英语语言的语音到文本转换
【发布时间】:2015-07-14 18:27:22
【问题描述】:

我正在尝试为非英语语言实现天真的语音到文本的转换。用户说其他语言的地方,文本也使用相同的语言。这可能吗?如果是的话,任何人都可以帮助解决如何实施它的想法吗?任何帮助将不胜感激。在此先感谢。

【问题讨论】:

  • naive 还是 native?如果天真,只需嵌入paris hilton 演讲的视频即可。如果是原生的,我不认为你可以自己实现它,你可能想在网上搜索这个服务提供商太难了
  • @KatrinRaimond 你有什么建议吗?
  • 最好注明语言名称
  • @NikolayShmyrev 实际上是梵文。
  • 嗨,Prabhakar,您开始梵文语音转文本的工作了吗?你能和我分享回购协议,这样我也可以参与其中吗?

标签: speech-recognition speech-to-text cmusphinx


【解决方案1】:

任何商业语音识别解决方案都不太可能支持梵语,因此您唯一的选择是将梵语支持添加到 CMUSphinx 等开源引擎中。

这很简单,实际上您只需要按照文档进行操作即可。您还需要了解脚本语言,这将帮助您减少某些步骤的手动工作。

  1. 阅读介绍-CMUSphinx教程介绍成为 熟悉语音识别的概念——特征、声学 模型、语言模型等。

  2. 尝试使用美国英语模型的 CMUSphinx 来了解情况 工作。尝试使用示例美国英语 AN4 数据库进行训练。

  3. 在维基百科中了解您的语言

  4. 为您的语言收集一组转录录音 - 采访、有声读物或自己录制。

  5. 根据您收集的数据,创建一个单词列表和一个 语音词典。可以创建大多数语音词典 在您最喜欢的脚本中使用带有小脚本的简单规则 Python之类的语言。见Generating a dictionary for details

  6. 手动或使用 sphinx4 将音频分段为短句 aligner,创建一个包含所需文件的数据库,如中所述 培训教程Training Acoustic Model For CMUSphinx

  7. 将新模型集成到您的应用程序中并设计数据 收集以改进您的模型。

如果您有任何问题,请随时提问。 This paper 也可能对你有帮助。

相关问题是:

Burmese speech to text conversion in android?

Writing speech-recognition engine

Is it possible to write a speech-recognition engine from scratch?

【讨论】:

  • 查看本文链接。请提及姓名。
猜你喜欢
  • 1970-01-01
  • 2021-09-28
  • 1970-01-01
  • 1970-01-01
  • 2023-04-08
  • 1970-01-01
  • 2017-02-17
  • 1970-01-01
  • 2012-06-16
相关资源
最近更新 更多