【发布时间】:2014-11-21 00:01:00
【问题描述】:
C* 中的时间序列建模很简单,但如果您想添加一些粒度怎么办?
我们有一个看起来像这样的表
CREATE TABLE sales (
c_id text,
purchased_at timestamp,
revenue_cents integer,
PRIMARY KEY (channel_id, purchased_at)
);
现在我们要选择过去 365 天内的所有销售额,并将时间粒度设置为一周。我们可以在前端对其进行求和,但就我们将选择数十万行而言,这似乎是一种非性能,尤其是在选择速度最重要的情况下。
一个简短的例子:
在我们的sales 表中,我们插入以下销售额
INSERT INTO sales (c_id, purchased_at, revenue_cents) VALUES (1, '2014-12-15 07:01:00', 200);
INSERT INTO sales (c_id, purchased_at, revenue_cents) VALUES (1, '2014-12-17 08:01:00', 400);
INSERT INTO sales (c_id, purchased_at, revenue_cents) VALUES (1, '2014-12-24 20:01:00', 400);
INSERT INTO sales (c_id, purchased_at, revenue_cents) VALUES (1, '2014-12-16 10:01:00', 600);
每天可能有数千笔销售额,所以如果我们想制作一张关于去年收入多少的图表,请使用如下查询:
SELECT revenue_cents FROM sales WHERE c_id='1' AND purchased_at > '2014-01-01 00:00:00';
我们会像一百万行一样返回,这还不够快。我们也不知道每次销售时的信息,我们只需要第 225 天(或第 44 周或第 6 个月)的信息。因此,如果我们运行上面的查询并希望它以某种方式按月分组,我们将返回 11/12 行,并且将收入美分全部汇总。我知道 C* 不能直接做到这一点,但不知何故这可以,对吧?
因此,我的问题是,如何才能做到这一点?
【问题讨论】: