【发布时间】:2015-07-23 19:55:05
【问题描述】:
我有一个包含客户联系信息的 hbase 表。该表包含大约 700k 行。我有一个脚本,它必须查询客户表以查找 2000-3000 条记录的匹配项。每次扫描大约需要 1 秒才能完成。因此,对于 2000 条记录,需要 33 分钟才能完成。我想看看我是否可以提高这种性能。我试过设置缓存,但没有帮助。这是详细信息。 我在客户表上只有一个列族,客户 ID 是行键。我的查询看起来像这样。
SingleColumnValueFilter('internal', 'country', =, 'binary:GB') AND SingleColumnValueFilter('internal', 'postcode', =, 'binary:W24RT') AND SingleColumnValueFilter('internal', 'street', =, '二进制:bayswaterroad')
如何提高性能?
【问题讨论】:
-
您是否考虑过使用关系数据库(例如 MySQL)来存储您的数据?对于此任务和您的数据大小,它将更加高效。
标签: performance hbase