【发布时间】:2022-08-24 03:44:31
【问题描述】:
我们在 GCP 上部署了 Netflix 指挥,具有强大的 Postgres 持久化存储。
每当超过 3k 个工作流开始并行执行时(每个工作流有 4 个 HTTP 任务), HTTP 任务开始执行所需的时间越来越长。
它只是停留在预定状态,可能会在较高负载下停留很长时间。
我们检查了指挥服务器和 Postgres 数据库的工作负载指标,它们远未达到资源限制。
我们曾考虑为这些 HTTP 任务使用隔离任务,但这并没有什么好处,因为执行的所有任务中有 80% 是我们不希望被卡在计划中的这些 HTTP 任务。
为了解决 HTTP 任务卡在计划状态的问题,我应该更改哪些配置\\设置\\设置?
谢谢