【问题标题】:Cassandra restart cluster to operate maintenanceCassandra重启集群运行维护
【发布时间】:2017-01-04 04:16:42
【问题描述】:

目前,我有一个集群 Cassandra 2.1.13,只有一个数据中心有 5 个节点。 我将在这个集群中进行维护操作。 我会一个节点一个节点地做。

我在不同的上下文中想象以下 3 种场景:

在关闭节点之前,我执行nodetool cmd "disablegossip, disablehandoff and drain",来加速节点的启动。

1 - 如果节点宕机时间小于“max_hint_windows_in_ms”,我可以启动节点而无需其他操作

2 - 如果节点停机时间超过“max_hint_windows_in_ms”且小于修复窗口“gc_grace_seconds”,我将启动节点进行完全修复

3 - 如果节点关闭的次数超过修复窗口,我会替换节点以避免恢复数据。

这些场景是否正确? 如果是你,你会怎么做?

【问题讨论】:

    标签: cassandra


    【解决方案1】:

    您可以在开始之前增加您的gc_grace_seconds。如果使用 post C* 3.0 id 也会增加 HH 窗口,但对于 2.1 这不是一个好主意(更多以防将来有人阅读此内容)。

    适当的节点关闭将处理禁用和耗尽,但如果您想确定,请在 gossip/HH 之前禁用节俭和本机传输。在传输之前禁用 gossip,您的客户端应用程序可能仍会尝试将该节点用作协调器,以处理离开集群后无法工作的请求。

    【讨论】:

    • 好的,我禁用了第一个二进制文件、thrift 和最后一个 gossip。谢谢
    猜你喜欢
    • 2012-08-04
    • 2015-02-24
    • 2021-05-23
    • 1970-01-01
    • 2020-01-08
    • 1970-01-01
    • 2013-02-24
    • 2021-05-31
    • 2015-10-01
    相关资源
    最近更新 更多