【问题标题】:GCE alerting when one of created metrics is absent (via terraform)当创建的指标之一不存在时 GCE 警报(通过 terraform)
【发布时间】:2020-02-24 13:41:05
【问题描述】:

我已经通过 terraform 配置了警报策略,其中包括 CPU/内存和其他警报(其中很多)。不幸的是,当我的一个 GCE 实例变得无响应时,我遇到了问题——我在我的 Slack 中收到了很多警报,因为我已经为我的所有策略配置了 condition_absent 块。

例如:

    condition_absent {
      duration = "360s"
      filter   = "metric.type=\"custom.googleapis.com/quota/gce\" resource.type=\"global\""

      aggregations {
        alignment_period     = "60s"
        cross_series_reducer = "REDUCE_SUM"
        group_by_fields = [
          "metric.label.metric",
          "metric.label.region",
        ]
        per_series_aligner = "ALIGN_MEAN"
      }
    condition_absent {
      duration = "360s"
      filter          = "metric.type=\"agent.googleapis.com/memory/percent_used\" resource.type=\"gce_instance\" metric.label.\"state\"=\"used\""

      aggregations {
        alignment_period     = "60s"
        cross_series_reducer = "REDUCE_SUM"
        per_series_aligner = "ALIGN_MEAN"
      }

我的问题如下:我可以在 terraform 中创建一个 condition_absent 块而不是多个块,并发送一个通知而不是吨,以防其中一个指标停止工作?

【问题讨论】:

    标签: terraform-provider-gcp


    【解决方案1】:

    我已通过添加 Monitoring Agent Uptime 指标警报解决了这个问题。当 VM 不可访问(过载等)时,它会正确显示

    【讨论】:

      猜你喜欢
      • 2020-10-25
      • 2019-12-26
      • 2022-01-17
      • 1970-01-01
      • 1970-01-01
      • 2019-05-04
      • 2021-05-09
      • 2019-06-05
      • 2021-06-23
      相关资源
      最近更新 更多