【发布时间】:2018-05-02 19:25:02
【问题描述】:
我正在使用 Sybex 官方学习指南学习 Amazon Redshift,在第 173 页有几个短语:
您可以配置表的分布样式,以向 Amazon RS 提供有关应如何对数据进行分区以最好地满足您的查询模式的提示。当您运行查询时,优化器会根据需要将行转移到计算节点以执行任何连接和聚合。
这引出了一些问题?
1) “优化器”的作用是什么?是否跨计算节点重新排列数据以提高每个新查询的性能?
2) 如果 1) 为真并且执行完全不同的新查询:计算节点中的旧数据会发生什么情况?
3) 你能更好地解释一下 3 种分发方式(EVEN、KEY、ALL),尤其是 KEY 方式吗?
补充问题:
1) 领导节点有记录吗?
【问题讨论】:
标签: amazon-web-services amazon-redshift