【问题标题】:Cassandra-Hadoop integrationCassandra-Hadoop 集成
【发布时间】:2015-08-16 00:06:07
【问题描述】:

我对集成 Cassandra 和 Hadoop 感兴趣,更准确地说,是使用 Cassandra 作为 Hadoop 作业的输入。每个 Cassandra 节点也是一个 Hadoop 节点。

我发现这些教程 12 在某种程度上解释了集成。我是 Cassandra 的新手,所以我还在搞清楚一些事情。

我的问题是 - 我是否总是需要使用整个 ColumnFamily(表)作为 MapReduce 作业的输入,或者有没有办法指定你想要的行(至少通过键)?

如果使用整个 ColumnFamily,正确的方法是仅从 Mapper 中发出满足某些条件的行吗?还是有更好的办法?

【问题讨论】:

    标签: hadoop cassandra


    【解决方案1】:

    关于 cassandra 和 hadoop 集成的当前状态有一个 official doc

    我是否总是需要使用整个 ColumnFamily(表)作为 MapReduce 作业的输入,或者有没有办法指定您想要的行(至少通过键)?

    不,您始终可以使用CqlPagingInputFormatCqlConfigHelper.setInputWhereClauses 选项指定行。

    【讨论】:

      猜你喜欢
      • 2014-06-19
      • 2013-11-29
      • 2014-11-27
      • 2014-10-25
      • 2012-02-07
      • 2012-12-12
      • 1970-01-01
      • 2016-03-28
      • 2015-12-16
      相关资源
      最近更新 更多