【问题标题】:App engine flexible - auto scaling properly应用引擎灵活 - 正确自动缩放
【发布时间】:2020-11-28 20:02:10
【问题描述】:

我的问题:我的应用程序无法处理多个(100 秒左右)请求。

如何设置具有成本效益的 Auto Scaling 环境?

我已阅读documentation,但我不清楚如何设置适当的环境来处理我的情况。

我可以根据我的预期请求估计实例数、cpu_utilization 以及其他参数吗?

我当前的 yaml(默认)是:

runtime: nodejs
env: flex

manual_scaling:
  instances: 1
resources:
  cpu: 0.5
  memory_gb: 2.5
  disk_size_gb: 10

【问题讨论】:

    标签: google-app-engine google-cloud-platform yaml


    【解决方案1】:

    您可以根据经验估算资源,也可以参考现有基准,但例如 CPU 负载取决于您为收到的每个请求执行的大量处理。

    这是您可以开始构建的示例。
    您可以从较小数量的max_num_instances 开始,然后随时微调值:

    automatic_scaling:
      min_num_instances: 1
      max_num_instances: 15
      cool_down_period_sec: 180
      cpu_utilization:
        target_utilization: 0.6
      target_concurrent_requests: 100
    
    
    • 在任何时候,至少有一个实例将为您的应用启动并运行。
    • 无论负载增长多少,应用的实例都不会超过 15 个。
    • cool_down_period_sec 不允许在 180 秒内执行两个后续缩放操作。
    • target_utilizationtarget_concurrent_requests 表示可以触发缩放操作的阈值。

    【讨论】:

      猜你喜欢
      • 2015-12-31
      • 2016-08-01
      • 2016-04-29
      • 1970-01-01
      • 2015-08-21
      • 2021-08-05
      • 2017-04-19
      • 1970-01-01
      • 2020-07-05
      相关资源
      最近更新 更多