【问题标题】:Sending a stream from the browser to a Node JS server将流从浏览器发送到 Node JS 服务器
【发布时间】:2020-06-30 16:54:58
【问题描述】:

总体思路:我创建了一个 Node JS 程序,它与多个 API 交互以重新创建一个家庭助理(如 Alexia 或 Siri)。它主要与 IBM Watson 交互。我的第一个目标是设置 Dialogflow,这样我就可以让真正的 AI 处理问题,但由于 Dialogflow v2 的更新,我必须使用 Google Cloud,这对我来说太麻烦了,所以我只得到了一个手工制作的脚本从可配置列表中读取可能的响应。

我的实际目标是从用户那里获得一个音频流,并将其发送到我的主程序中。我已经建立了一个快递服务器。当您在“/”上获取时,它会返回一个 HTML 页面。页面如下:

<!DOCTYPE html>
<html lang='fr'>
   <head>
       <script>
           let state = false

           function button() {

               navigator.mediaDevices.getUserMedia({audio: true})
                   .then(function(mediaStream) {

                       // And here I got my stream. So now what do I do?
                   })
                   .catch(function(err) {
                       console.log(err)
                   });
           }
       </script>
       <title>Audio recorder</title>
   </head>
   <body>
       <button onclick='button()'>Lancer l'audio</button>
   </body>
</html>

当用户点击带有mediaDevices.getUserMedia()的按钮时,它会录制用户的音频

我的配置如下所示:

我正在寻找一种启动录制的方法,然后按下停止按钮,当按下停止按钮时,它会自动将流发送到节点程序。如果输出是流则更好,因为它是 IBM Watson 的输入类型(否则我将不得不存储文件,然后读取它,然后删除它)。

感谢您的关注。

趣事:我的图片的 imgur ID 以“NUL”开头,在法语中是“NOOB”的意思,哈哈

【问题讨论】:

标签: javascript node.js audio-streaming getusermedia


【解决方案1】:

大多数浏览器,但不是全部(我在看你,Mobile Safari),支持使用 getUserMedia() 和 MediaRecorder API 捕获和流式传输音频(和你不关心的视频) .使用这些 API,您可以通过 WebSockets、socket.io 或一系列 POST 请求将捕获的音频小块传输到您的 nodejs 服务器。然后 nodejs 服务器可以将它们发送到您的识别服务。这里的挑战:音频被压缩并封装在 webm 中。如果您的服务接受该格式的音频,则此策略将适用于您。

或者您可以尝试使用node-ogg 和node-vorbis 来接受和解码。 (我没有这样做。)

可能还有其他方法。也许知道的人会回答。

【讨论】:

    猜你喜欢
    • 2021-12-27
    • 2021-10-22
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多