【问题标题】:Uneven data distribution on cassandra nodescassandra 节点上的数据分布不均
【发布时间】:2017-03-30 05:56:13
【问题描述】:

我在 aws 新加坡地区有一个 4 个节点的 cassandra 集群,我必须将它迁移到孟买地区,所以我在孟买地区创建了一个新的数据中心,将其添加到新加坡集群并在所有新的集群上运行重建命令一个接一个的节点。 先前节点上的数据 = 150GB/节点大约。 新节点上的数据 = 200GB/两个节点上的节点,一个节点上 100GB。

我无法弄清楚为什么会发生这种情况,它应该是 200GB/节点。 我正在使用 cassandra 3.9 并在新数据中心上使用 vnodes,在旧数据中心上使用单个令牌。

我想弄清楚这是什么原因。

我尝试在几秒钟内完成重建,RF 为 3 nodetool 状态显示所有节点 UP 且正常

【问题讨论】:

  • 能否提供nodetool中“Owns (effective),Tokens,Load”列的值?
  • 我添加了一个 nodetool 快照
  • 您的两个集群是否都运行相同版本的 Cassandra?
  • 是的,两者都在使用 3.9

标签: cassandra nodetool


【解决方案1】:

再次尝试重建最后一个节点,这可能是由于未完成的重建过程,请查看日志以查看任何错误。

另外,您能否提供 nodetool 状态的输出?而且,每个 dc 中的复制因子是多少?

编辑:

1) 尝试在 100gb 节点上运行修复。

2) 停止有问题的节点,从数据文件夹中删除所有数据并再次重建(您可能需要使用节点替换选项启动节点)。

【讨论】:

  • 此过程背后的任何原因?我不能无故运行那是我的生产环境
  • 无论如何,您都应该定期运行修复,如果有一些问题/丢失数据,它可能会更正它。第二个过程,如果第一个不工作,是重建过程的完全“重新启动”,它将再次复制所有数据。
猜你喜欢
  • 1970-01-01
  • 2018-11-28
  • 1970-01-01
  • 1970-01-01
  • 2021-03-30
  • 2012-07-13
  • 2018-10-26
  • 2013-08-05
  • 1970-01-01
相关资源
最近更新 更多