【问题标题】:Is this a suitable (or possible) use of HBase?这是 HBase 的合适(或可能)使用吗?
【发布时间】:2009-11-05 21:11:54
【问题描述】:

我想将 HBase 用作存储,我可以在其中推送几百万个格式为 {document => {term => weight}} 的条目,例如“将术语 X 插入到文档 Y 中,权重为 Z”,然后发出类似“选择此文档的前 1000 个术语”或“为每个文档选择前 1000 个术语”的命令。这适用于我当前的 MySQL 实现,但也许该域更适合 HBase。我注意到 HBase 和 BigTable 用于全文索引,这是一个类似的问题域。

您可以说我只阅读了几页关于 HBase 的内容,但我希望您能理解我的问题的要点。与this question有关。

可能的障碍可能包括 HBase 不允许使用与 LIMIT 子句等效的查询。鉴于我想按权重查询,我想关联{weight => term},这对于具有相同权重的两个词条来说是有问题的(我假设 HBase 只允许唯一键)。或者,我必须存储给定权重的术语集合,但这会限制我准确限制返回术语数量的能力。

【问题讨论】:

    标签: hadoop bigtable hbase


    【解决方案1】:

    简单的回答是的。

    更复杂的答案,现在这些“no sql”数据存储都实现了自己的程序员接口,并且“no sql”意味着它们不是基于 SQL 的。因此,请为一些编码做好准备,尽管这并不困难。大多数情况下,这些数据存储只是名称值对存储,通过 REST 或 SOAP 获得(HBase 也有列族的概念)。不过,他们确实倾向于 Map Reduce,这是一个非常有趣的查询领域,非常值得一读。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2019-05-30
      • 2012-09-05
      • 1970-01-01
      相关资源
      最近更新 更多