【发布时间】:2020-03-17 01:53:15
【问题描述】:
我目前正在努力查询存储在分区表中的数据块(每个日期的分区)
数据是这样的:
date, product_id, orders
2019-11-01, 1, 100
2019-11-01, 2, 200
2019-11-02, 1, 300
我有数百个日期分区和每个日期数百万行。
现在,如果我想查询,例如,产品 id 1 和 2 的总订单量为 2 周,并按日期分组(在每个日期的图表中显示),数据库必须达到 2 周分区并为它们获取数据。
当产品数量很大或所需时间很长时,该过程可能需要很长时间。
我了解到 AWS Redshift 适合此类任务。我正在考虑将我的分区表(每个日期的聚合分析)转移到该技术,但我想知道这是否真的是我应该做的,以使这些查询运行得更快。
谢谢!
【问题讨论】:
标签: postgresql nosql bigdata amazon-redshift