【发布时间】:2019-09-17 16:25:14
【问题描述】:
我有托管超过 15 个索引的弹性搜索集群,我有一个 Datadog 集成,它显示了我的弹性搜索集群的下视图。
我们与 DD(datadog) 集成了警报,如果整体 CPU 使用率超过 60%,我们会发出警报,而且在我们的应用程序中,当 elasticsearch 集群处于压力之下时,我们会开始收到警报,例如在这种情况下我们的响应时间超过了配置阈值。
现在我的问题是如何知道哪些索引最消耗 ES 集群资源,以便我们可以限制来自这些索引的请求或优化它们的请求。
我们做过的一些事情:
- 查看慢查询日志:这并不是罪魁祸首,因为负载过重或 CPU 使用率高,我们有来自几乎所有大索引的慢查询日志。
- 与 DD 仪表板中一样,
bulk队列中有峰值,但这是总体情况,并非特定于特定 ES 索引。
所以我的问题非常简单,我只需要来自 DD 或弹性的一些指标,它可以很容易地告诉我哪些索引在弹性搜索集群上消耗的资源最多。
【问题讨论】:
标签: performance elasticsearch monitoring datadog