【问题标题】:Streaming audio mic data to aws transcribe in node将音频麦克风数据流式传输到节点中的 aws 转录
【发布时间】:2020-06-04 03:34:02
【问题描述】:

我正在尝试编写一个节点应用程序,通过 AWS 的流式转录服务从麦克风转录音频。我目前所拥有的可以在this repository 中找到(它很小)。

不幸的是,上述方法不起作用。我相信在获取麦克风流提供的数据并在将其传递到可写转录器流之前对其进行转换存在错误。这是因为我已经证明该应用程序的其他两个组件可以正常工作

  1. 我编写了一段应用程序来将麦克风连接到扬声器,证明麦克风流按预期工作。
  2. 当通过 WebSocket 向转录服务发送请求时,它会返回非异常响应(尽管为空),证明转录服务客户端按预期工作。

附带说明,我不熟悉处理音频数据并将其编码(解码?)为 PCM。我什至不肯定麦克风流给我的东西是否是 PCM,以及我是否需要在将其提供给转录服务之前从 PCM 解码或编码为 PCM。所有这一切都是说,我很确定字节处理是问题所在。

任何帮助进行排序将不胜感激。

谢谢, 杰夫

【问题讨论】:

    标签: node.js websocket audio-streaming microphone aws-transcribe


    【解决方案1】:

    发送到 Amazon Transcribe 流式传输的数据帧需要以特定的方式进行编码 here

    由于您使用的是 WebSocket 流,AWS 有一个 JavaScript 示例项目,您可以参考/使用:https://github.com/aws-samples/amazon-transcribe-websocket-static

    【讨论】:

    • 谢谢,我对示例项目很熟悉。如果您访问我在问题中链接的 git 存储库,您会看到我直接引用它。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2020-09-28
    • 2014-12-20
    • 2018-07-29
    • 2014-10-23
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多