【发布时间】:2020-02-24 13:41:05
【问题描述】:
我已经通过 terraform 配置了警报策略,其中包括 CPU/内存和其他警报(其中很多)。不幸的是,当我的一个 GCE 实例变得无响应时,我遇到了问题——我在我的 Slack 中收到了很多警报,因为我已经为我的所有策略配置了 condition_absent 块。
例如:
condition_absent {
duration = "360s"
filter = "metric.type=\"custom.googleapis.com/quota/gce\" resource.type=\"global\""
aggregations {
alignment_period = "60s"
cross_series_reducer = "REDUCE_SUM"
group_by_fields = [
"metric.label.metric",
"metric.label.region",
]
per_series_aligner = "ALIGN_MEAN"
}
condition_absent {
duration = "360s"
filter = "metric.type=\"agent.googleapis.com/memory/percent_used\" resource.type=\"gce_instance\" metric.label.\"state\"=\"used\""
aggregations {
alignment_period = "60s"
cross_series_reducer = "REDUCE_SUM"
per_series_aligner = "ALIGN_MEAN"
}
我的问题如下:我可以在 terraform 中创建一个 condition_absent 块而不是多个块,并发送一个通知而不是吨,以防其中一个指标停止工作?
【问题讨论】: