【问题标题】:How to improve the transcription quality in AWS Transcribe如何提高 AWS Transcribe 中的转录质量
【发布时间】:2019-11-12 09:51:09
【问题描述】:

我有几个音频文件是客户和代理之间的对话成功存储在 S3 中。 我尝试使用 AWS transcribe 将音频文件转换为文本,并且转换成功。

但奇怪的是,它甚至没有 60 % 准确,这些是我为 AWS Transcribe 配置的

1) 语言代码 - 英语(印度)
2) 音频频率 - 8000HZ
3) 格式 - WAV

根据本指南 (https://docs.aws.amazon.com/transcribe/latest/dg/limits-guidelines.html),
我将音频频率和格式设置为 8KHZ 并设置为 WAV 我是否需要更改任何其他参数以提高音频质量?

感谢任何帮助。

谢谢,
哈利

【问题讨论】:

    标签: amazon-web-services amazon-s3 aws-lambda aws-transcribe


    【解决方案1】:

    许多因素都会影响转录质量,例如音频中的背景噪音、说话者重叠、说话者的口音。更高质量的音频通常会产生更好的效果。

    【讨论】:

      【解决方案2】:

      您可以尝试使用自定义词汇表。您可以按照此处https://docs.aws.amazon.com/transcribe/latest/dg/how-vocabulary.html

      中的说明创建这些自定义词汇表

      此自定义词汇表应包含一些先前的关键字,这些关键字将被说出并且特定于该域。但是,根据我的经验,这些自定义词汇有时会过拟合(错误地从自定义词汇中输出成绩单中的单词)。

      【讨论】:

        猜你喜欢
        • 1970-01-01
        • 2010-11-29
        • 1970-01-01
        • 2019-02-08
        • 1970-01-01
        • 1970-01-01
        • 2013-06-23
        • 1970-01-01
        相关资源
        最近更新 更多