【发布时间】:2019-03-22 09:02:08
【问题描述】:
我正在编写从 Redshift 表(或视图)到 Redshift 表的 aws Glue 计划转换脚本。
我的一些表很大,我不想将整个表加载到 S3 文件中,或者对于其中的一些,我想要一个增量解决方案。 因此,我正在寻找适用于 aws Glue / Redshift 的预过滤器解决方案(在加载到 S3 之前)。
我知道,如果您直接在 S3 存储桶上工作,则可以使用谓词下推来避免加载您不关心的数据。 Redshift 表似乎不支持它。
您知道 Redshift 的类似解决方案吗?还是解决方法?
谢谢
【问题讨论】: