【问题标题】:uneven data size on cassandra nodescassandra 节点上的数据大小不均匀
【发布时间】:2018-11-28 03:01:40
【问题描述】:

我很难理解为什么我的 Cassandra 节点的数据大小不均匀。

我有一个由三个节点组成的集群。根据nodetool ring,每个节点拥有33.33%。仍然磁盘空间使用不均衡。

Node1: 4.7 GB (DC: logg_2, RAC: RAC1)
Node2: 13.9 GB (DC: logg_2, RAC:RAC2)
Node3: 9.3 GB (DC: logg_2, RAC:RAC1)

只有一个键位。

keyspace_definition: |
 CREATE KEYSPACE stresscql_cass_logg WITH replication = { 'class': 'NetworkTopologyStrategy', 'logg_2' : 2, 'logg_1' : 1};

而且只有一张表名为blogposts

table_definition: |
  CREATE TABLE blogposts (
        domain text,
        published_date timeuuid,
        url text,
        author text,
        title text,
        body text,
        PRIMARY KEY(domain, published_date)
  ) WITH CLUSTERING ORDER BY (published_date DESC)
    AND compaction = { 'class':'LeveledCompactionStrategy' }
    AND comment='A table to hold blog posts'

请帮助我理解为什么每个节点的数据大小不均匀。

【问题讨论】:

    标签: cassandra cassandra-2.0


    【解决方案1】:

    所有权是节点拥有多少数据。

    每个数据中心的节点拥有的数据的百分比乘以 复制因子。例如,一个节点可以拥有环的 33%,但是 如果复制因子为 3,则显示 100%。

    注意:如果您的集群使用具有不同复制的键空间 策略或复制因子,在运行时指定键空间 nodetool 状态以获取有意义的所有权信息。

    更多信息可以在这里找到: https://docs.datastax.com/en/cassandra/2.1/cassandra/tools/toolsStatus.html#toolsStatus__description

    NetworkTopologyStrategy 将副本放置在同一个数据中心,方法是顺时针走环,直到到达另一个机架中的第一个节点。

    NetworkTopologyStrategy 尝试将副本放置在不同的机架上,因为同一机架(或类似的物理分组)中的节点经常由于电源、冷却或网络问题而同时发生故障。

    因为您只有两个机架(RAC1 和 RAC2),所以您将节点 1 和节点 3 的副本放置在节点 2 中,这就是它更大的原因。

    https://docs.datastax.com/en/cassandra/3.0/cassandra/architecture/archDataDistributeReplication.html

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2012-07-13
      • 2011-07-16
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2020-04-04
      • 1970-01-01
      • 2021-03-30
      相关资源
      最近更新 更多