【发布时间】:2019-01-07 13:58:02
【问题描述】:
我已经读到 Presto 用于临时查询,而 Hive/spark 更适合 ETL 场景。在 ETL 中不使用 Presto 的原因似乎是因为 Presto 查询可能会失败并且没有中间查询容错。
但是,看起来我们可以通过在我们的日常 Jenkins 工作流程中使用 Presto 以及在查询失败时重试来解决它。 有没有人尝试过使用这种方法,或者他们对这种方法有什么缺点?
如果您在 ETL 中使用 Presto,您的 Presto 集群有多大?您将哪种 EC2 实例用于您的 presto 集群?
【问题讨论】: