【问题标题】:Scaling Socket.IO to multiple Node.js processes using cluster使用集群将 Socket.IO 扩展到多个 Node.js 进程
【发布时间】:2013-08-21 01:30:46
【问题描述】:

用这个来扯我的头发...有没有人设法将 Socket.IO 扩展到由 Node.js 的 cluster 模块产生的多个“工作”进程?

假设我在 四个 工作进程(伪)上有以下内容:

// on the server
var express = require('express');
var server = express();
var socket = require('socket.io');
var io = socket.listen(server);

// socket.io
io.set('store', new socket.RedisStore);

// set-up connections...
io.sockets.on('connection', function(socket) {

  socket.on('join', function(rooms) {
    rooms.forEach(function(room) {
      socket.join(room);
    });
  });

  socket.on('leave', function(rooms) {
    rooms.forEach(function(room) {
      socket.leave(room);
    });
  });

});

// Emit a message every second
function send() {
  io.sockets.in('room').emit('data', 'howdy');
}

setInterval(send, 1000);

在浏览器上...

// on the client
socket = io.connect();
socket.emit('join', ['room']);

socket.on('data', function(data){
  console.log(data);
});

问题:每一秒,我都会收到 四个 消息,因为有四个单独的工作进程发送消息。

如何确保消息只发送一次?

【问题讨论】:

标签: javascript node.js redis socket.io node-redis


【解决方案1】:

编辑:在 Socket.IO 1.0+ 中,现在可以使用更简单的 Redis 适配器模块,而不是设置具有多个 Redis 客户端的存储。

var io = require('socket.io')(3000);
var redis = require('socket.io-redis');
io.adapter(redis({ host: 'localhost', port: 6379 }));

下面的例子看起来更像这样:

var cluster = require('cluster');
var os = require('os');

if (cluster.isMaster) {
  // we create a HTTP server, but we do not use listen
  // that way, we have a socket.io server that doesn't accept connections
  var server = require('http').createServer();
  var io = require('socket.io').listen(server);
  var redis = require('socket.io-redis');

  io.adapter(redis({ host: 'localhost', port: 6379 }));

  setInterval(function() {
    // all workers will receive this in Redis, and emit
    io.emit('data', 'payload');
  }, 1000);

  for (var i = 0; i < os.cpus().length; i++) {
    cluster.fork();
  }

  cluster.on('exit', function(worker, code, signal) {
    console.log('worker ' + worker.process.pid + ' died');
  }); 
}

if (cluster.isWorker) {
  var express = require('express');
  var app = express();

  var http = require('http');
  var server = http.createServer(app);
  var io = require('socket.io').listen(server);
  var redis = require('socket.io-redis');

  io.adapter(redis({ host: 'localhost', port: 6379 }));
  io.on('connection', function(socket) {
    socket.emit('data', 'connected to worker: ' + cluster.worker.id);
  });

  app.listen(80);
}

如果您的主节点需要发布到其他 Socket.IO 进程,但本身不接受套接字连接,请使用 socket.io-emitter 而不是 socket.io-redis

如果您在扩展时遇到问题,请使用 DEBUG=* 运行您的 Node 应用程序。 Socket.IO 现在实现了debug,它还将打印出 Redis 适配器调试消息。示例输出:

socket.io:server initializing namespace / +0ms
socket.io:server creating engine.io instance with opts {"path":"/socket.io"} +2ms
socket.io:server attaching client serving req handler +2ms
socket.io-parser encoding packet {"type":2,"data":["event","payload"],"nsp":"/"} +0ms
socket.io-parser encoded {"type":2,"data":["event","payload"],"nsp":"/"} as 2["event","payload"] +1ms
socket.io-redis ignore same uid +0ms

如果您的主进程和子进程都显示相同的解析器消息,那么您的应用程序正在正确扩展。


如果您是从单个工作人员发出的,那么您的设置应该没有问题。您正在做的是从所有四个工作人员发出,并且由于 Redis 发布/订阅,消息不会重复,而是写入四次,正如您要求应用程序所做的那样。这是 Redis 功能的简单示意图:

Client  <--  Worker 1 emit -->  Redis
Client  <--  Worker 2  <----------|
Client  <--  Worker 3  <----------|
Client  <--  Worker 4  <----------|

如您所见,当您从一个工作人员发出时,它会将发出的内容发布到 Redis,并从其他订阅了 Redis 数据库的工作人员镜像。这也意味着您可以使用连接同一个实例的多个套接字服务器,并且一个服务器上的发射将在所有连接的服务器上触发。

使用集群,当客户端连接时,它将连接到您的四个工作人员之一,而不是全部四个。这也意味着您从该工作人员发出的任何内容都只会向客户端显示一次。所以,是的,应用程序正在扩展,但是你这样做的方式是,你从所有四个工作人员发出,而 Redis 数据库正在使它就像你在一个工作人员上调用它四次一样。如果客户端实际连接到您的所有四个套接字实例,他们将每秒接收 16 条消息,而不是 4 条。

套接字处理的类型取决于您将拥有的应用程序的类型。如果您要单独处理客户端,那么您应该没有问题,因为连接事件只会为每个客户端的一个工作人员触发。如果您需要全局“心跳”,那么您可以在主进程中有一个套接字处理程序。由于主进程死亡时工作人员也会死亡,因此您应该抵消主进程的连接负载,让子进程处理连接。这是一个例子:

var cluster = require('cluster');
var os = require('os');

if (cluster.isMaster) {
  // we create a HTTP server, but we do not use listen
  // that way, we have a socket.io server that doesn't accept connections
  var server = require('http').createServer();
  var io = require('socket.io').listen(server);

  var RedisStore = require('socket.io/lib/stores/redis');
  var redis = require('socket.io/node_modules/redis');

  io.set('store', new RedisStore({
    redisPub: redis.createClient(),
    redisSub: redis.createClient(),
    redisClient: redis.createClient()
  }));

  setInterval(function() {
    // all workers will receive this in Redis, and emit
    io.sockets.emit('data', 'payload');
  }, 1000);

  for (var i = 0; i < os.cpus().length; i++) {
    cluster.fork();
  }

  cluster.on('exit', function(worker, code, signal) {
    console.log('worker ' + worker.process.pid + ' died');
  }); 
}

if (cluster.isWorker) {
  var express = require('express');
  var app = express();

  var http = require('http');
  var server = http.createServer(app);
  var io = require('socket.io').listen(server);

  var RedisStore = require('socket.io/lib/stores/redis');
  var redis = require('socket.io/node_modules/redis');

  io.set('store', new RedisStore({
    redisPub: redis.createClient(),
    redisSub: redis.createClient(),
    redisClient: redis.createClient()
  }));

  io.sockets.on('connection', function(socket) {
    socket.emit('data', 'connected to worker: ' + cluster.worker.id);
  });

  app.listen(80);
}

在示例中,有五个 Socket.IO 实例,一个是主实例,四个是子实例。主服务器从不调用listen(),因此该进程没有连接开销。但是,如果您在主进程上调用一个 emit,它将被发布到 Redis,四个工作进程将在它们的客户端上执行 emit。这抵消了工作人员的连接负载,如果工作人员死亡,您的主要应用程序逻辑将在主服务器中保持不变。

请注意,使用 Redis,即使在命名空间或房间中的所有发射都将由其他工作进程处理,就好像您从该进程触发了发射一样。换句话说,如果您有两个 Socket.IO 实例和一个 Redis 实例,则在第一个工作人员的套接字上调用 emit() 会将数据发送到其客户端,而工作人员二将执行与调用从那个工人。

【讨论】:

  • 好答案。谢谢!在一定程度上起作用。当我发出 io.sockets.emit('userstreamssock', postid);从主人那里,我没有在工人身上得到它。不知道为什么。
  • 仅供参考:它不再适用于 socket.io > 1.0。必须使用 redis 适配器。 socket.io/docs/using-multiple-nodes 我还没有成功获得一个使用 cluster 和 socket.io 1.1.0 运行的示例。
  • @DerM Me not.Running socket.io 1.3.5,我没有找到任何可行的方法。添加粘性会话,更改 HAProxy 配置......这些都不能让套接字与集群一起工作。
  • 我为 Socket.IO 1.0+ 添加了一个示例,并在 1.3.5 上对其进行了测试。请注意,对于主节点,应该使用socket.io-emitter,因为它是一个非侦听过程,但我省略了它以使答案更简单。
  • 我在前端遇到错误...socket.io.min.js:2 GET http://localhost:3000/socket.io/?EIO=3&amp;transport=polling&amp;t=LYqSrsK 404 (Not Found)
【解决方案2】:

让master处理你的心跳(下面的例子)或在内部在不同的端口上启动多个进程并使用nginx(它还支持从V1.3开始的websockets)进行负载平衡。

与 Master 的集群

// on the server
var express = require('express');
var server = express();
var socket = require('socket.io');
var io = socket.listen(server);
var cluster = require('cluster');
var numCPUs = require('os').cpus().length;

// socket.io
io.set('store', new socket.RedisStore);

// set-up connections...
io.sockets.on('connection', function(socket) {
    socket.on('join', function(rooms) {
        rooms.forEach(function(room) {
            socket.join(room);
        });
    });

    socket.on('leave', function(rooms) {
        rooms.forEach(function(room) {
            socket.leave(room);
        });
    });

});

if (cluster.isMaster) {
    // Fork workers.
    for (var i = 0; i < numCPUs; i++) {
        cluster.fork();
    }

    // Emit a message every second
    function send() {
        console.log('howdy');
        io.sockets.in('room').emit('data', 'howdy');
    }

    setInterval(send, 1000);


    cluster.on('exit', function(worker, code, signal) {
        console.log('worker ' + worker.process.pid + ' died');
    }); 
}

【讨论】:

  • 不错的建议,但它仍然只是一个负责潜在 500,000 个 websocket 连接的主进程......并没有真正解决跨多个服务器/每个服务器进程的“可扩展性”问题跨度>
  • 这个怎么样:使用 2 层负载均衡器。 AWS 示例:第一层使用弹性负载均衡器在多台机器之间分配工作负载。第二层在机器上的多个实例之间分配工作负载。您可以运行 cpu.count 节点实例并通过 nginx 或使用节点集群将工作负载分配给它们(在这种情况下不需要 nginx)。我更喜欢nginx版本。对于自动缩放,请使用 OpsWork 并让它根据 cpu 负载处理您的缩放。它会自动添加和删除机器,而且很容易设置。
  • 当我使用 var socket = require('socket.io')(1338); 时出现此错误 Error: listen EADDRINUSE :::1338 how to implement on same !
【解决方案3】:

这实际上看起来像 Socket.IO 在扩展方面取得了成功。您会期望来自一台服务器的消息会发送到该房间中的所有套接字,无论它们碰巧连接到哪台服务器。

最好的办法是拥有一个每秒发送一条消息的主进程。例如,您可以通过仅在 cluster.isMaster 时运行它来做到这一点。

【讨论】:

  • 它成功地“共享”了套接字,但没有成功确定哪些消息不要复制。集群是一个好主意,但它并不是真正的“扩展”……它是管理 4 工作的一个进程
  • @Lee 您希望它使用什么逻辑来决定是否“复制”消息?当您向房间发送消息时,它会发送给房间中的每个人 - 这是预期的行为。如果您希望每个进程每隔一段时间发送消息,则可以为每个进程留一个空间。
  • 我想更好的逻辑是让 socket.emit 以某种方式跨进程同步。不知道如何实现。当有 10 台不同的服务器,每台服务器有 4 个内核时,“每个进程一个房间”的方法无法解决可扩展性问题……但当只涉及一台服务器时,它可能是一个好主意。
  • @Lee 通常使用 Socket.IO 的方式是在一台服务器上发生的某些事件(例如,http 请求)触发向房间发送消息。您会希望此消息会发送给房间中的每个人,而不仅仅是碰巧连接到同一台服务器的人。 “一个进程管理 4 的工作” - 我不确定你的实际逻辑是什么,但每秒发送一条消息不会很费力。
  • 我的目标是真正弄清楚如何做到这一点,但要大规模。现在,对于 10,000 名客户来说,它根本不征税……但是当它是一百万时呢?我正在构建的应用程序有大量的网络套接字连接,用于相当高需求的统计应用程序,并且 API 可以轻松地在短时间内达到 1000 万+ 套接字事务/天。我只是想准备好根据需要扩展它 - 仍然不确定如何在 1 个服务器、1 个进程模型之外做到这一点。
【解决方案4】:

进程间通信不足以使 socket.io 1.4.5 与集群一起工作。强制 websocket 模式也是必须的。见WebSocket handshake in Node.JS, Socket.IO and Clusters not working

【讨论】:

    猜你喜欢
    • 2017-07-31
    • 2014-11-25
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2012-05-19
    • 1970-01-01
    相关资源
    最近更新 更多