【问题标题】:Is Using Python to MapReduce for Cassandra Dumb?使用 Python 为 Cassandra Dumb 进行 MapReduce?
【发布时间】:2011-02-01 09:36:30
【问题描述】:

由于 Cassandra 还没有内置 MapReduce(我认为它会在 0.7 中出现),尝试在我的 Python 客户端中使用 MapReduce 是愚蠢的,还是应该只使用 CouchDB 或 Mongo 或其他什么?

该应用程序是统计数据集合,因此我需要能够通过分组对值求和以递增计数器。我不是,但假装我在做 Google 分析,所以我想跟踪出现了哪些浏览器、他们访问了哪些页面,以及访问量与综合浏览量。

我会在写入时自动更新我的计数器,但 Cassandra 也不擅长计数器。

也许 Cassandra 不是这个的正确选择吗?

谢谢!

【问题讨论】:

    标签: python mongodb cassandra couchdb nosql


    【解决方案1】:

    Cassandra 从 0.6 版开始支持 map reduce。 (当前的稳定版本是 0.5.1,但请继续尝试 0.6.0-beta3 中的新 map reduce 功能)要开始使用,我建议查看 'contrib/word_count' 中的 word count map reduce 示例。

    【讨论】:

      【解决方案2】:

      MongoDB 具有就地更新功能,因此 MongoDB 应该非常适合使用计数器。 http://blog.mongodb.org/post/171353301/using-mongodb-for-real-time-analytics

      【讨论】:

      • 这是一个完全有效的答案,抱歉我不能选择两个,另一个更具体地是对我与 Cassandra 的问题的回答。
      猜你喜欢
      • 2012-04-25
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2018-06-17
      • 2014-03-22
      • 2014-11-06
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多