【问题标题】:How to specify phonetic keywords for IBM Watson speech2text service?如何为 IBM Watson speech2text 服务指定拼音关键字?
【发布时间】:2016-09-28 20:10:40
【问题描述】:

虽然我们在一般情况下使用 Bluemix Java SDK 取得了很好的成功,但我们在尝试识别偶尔的非英语单词(例如,外国姓氏)时遇到了问题。我们希望可以使用 SPR 音标指定关键字列表(这对 text2speech 非常有用),但 Speech2text 似乎不支持。有什么建议/解决方法吗?

SpeechToText service = new SpeechToText();
service.setUsernameAndPassword("USERNAME", "PASSWORD");

File audio = new File("C:\\Users\\AudioFiles\\euler.wav");    

RecognizeOptions options = new RecognizeOptions().Builder()
  .contentType(HttpMediaType.AUDIO_WAV)
  .continuous(true)
  .inactivityTimeout(500)
  .keywords({"Agarwal", "Euler", "Qin"})
  .keywordsThreshold(0.5)
  .build();

  SpeechResults transcript = service.recognize(audio, options);
  System.out.println(transcript);

目标是能够说“我的名字是约翰·欧拉”。并且成绩单不要返回“我的名字是 John Oyler”之类的内容。 (这是它目前所做的)。

谢谢。

【问题讨论】:

  • 嗨罗伯特,当您在要查找的关键字列表中传递“Euler”时,它是否会显示在找到的关键字列表中?
  • 谢谢丹尼尔。这就是我们所希望的,唉。我们返回:'"keywords_result": {}'。
  • 嗯,你传的三个词其实在词汇表里,但是可能因为在语言模型中的权重很小,所以没有找到。你试过放宽门槛吗?如果任务以名称为中心,您还可以尝试使用 Watson STT 定制服务来提高名称的概率
  • Daniel,确实,如果我将阈值一直降低到 0.15,我确实会得到匹配,但可以预见的是低置信度 (0.17)。您也可能对语言模型中的先验概率低是正确的。我不知道定制服务——将调查它。谢谢。
  • 作为参考,可以找到有关如何自定义语言模型的文档here谢谢,Daniel。

标签: java ibm-cloud speech-recognition speech-to-text ibm-watson


【解决方案1】:

嗯,你传的三个词其实都在词汇表里,但是可能因为在语言模型中的权重很小,所以没有找到。你试过放宽门槛吗?如果任务以名称为中心,您还可以尝试使用 Watson STT 定制服务来提高名称的概率

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2017-08-23
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多