【发布时间】:2016-11-19 15:26:06
【问题描述】:
我有一个 cassandra 服务器正在被另一个服务查询,我需要减少查询量。
我的第一个想法是每隔几分钟创建整个数据库的布隆过滤器并将其发送到服务。 但由于我的数据库中有几百 GB(预计会增长到几 TB),每隔几分钟就使数据库过载似乎不是一个好主意。
在寻找更好的解决方案一段时间后,我记得 cassandra 维护自己的布隆过滤器。
是否可以复制 *-Filter.db 文件并在我的代码中使用它们而不是创建我自己的布隆过滤器?
【问题讨论】:
-
查询如何?我不明白你为什么认为你需要访问它的布隆过滤器。
-
我正在运行从服务到 cassandra 的 cql 查询。我想减少对 cassandra 的查询量。我不想创建自己的布隆过滤器,而是想使用 cassandra 中内置的布隆过滤器。
-
为什么你想做 cassandra 已经做过的事情?如果您使用“相同”BF 预过滤查询,您的系统不会更快。如果你想更快,你需要缓存数据(当然,比 cassandra 已经做的更多,或者以不同的方式)。恕我直言。
标签: java cassandra bloom-filter