【发布时间】:2019-06-12 00:39:40
【问题描述】:
我有一个超宽表,有 100 列红移。这张表更像是一个矩阵。每个用户一行,每列 1 或 0,具体取决于用户的某些特征。目标是从该表中选择 SQL 获得最佳响应时间。我们预计表中的总行数约为 1.6 亿行,选择将返回约 3000 万行。选择通常基于 1 列之一。
表格看起来像user_id, col1, col2.....col100
例如:
select * from table 1 where col10=1;
然后使用此结果集,UI 将显示多列之间的交叉用户。目前表现非常糟糕。哪些 distkey 或 sortkey 选项可以提高查询性能?
【问题讨论】:
标签: amazon-web-services amazon-redshift