【发布时间】:2019-02-28 13:22:10
【问题描述】:
我正在尝试对我的 Hot-Warm Structured Elasticsearch 集群进行基准测试。我做了很多测试。我关注了很多事情。我想,我的指数率还是不能接受的。
在我的集群中,我有 13 台配备 SSD 的热服务器,其中 3 台配备 NVMe。比较好的CPU。和 3 台暖服务器。在我的测试中,我获得最多 250k 的主分片摄取,500k 的总分片。因为我使用 1 个复制子计数。
对我来说,这意味着每台服务器插入 38k 文档,因为我使用 1 个副本计数,这意味着每台服务器 19k 文档。对于这样一个基本的键值模型,索引速度对我来说太慢了。当我看到我无法对我的真实模型进行基准测试时。
对我有什么建议吗?
我做了以下建议
- bootstrap.memory_lock: true
- thread_pool.bulk.queue_size: 100000(一开始是200,后来我测试了20000,现在是100000)
- thread_pool.index.queue_size: 100000(一开始是200)
- 基本键值模型。 1 个副本,增加的刷新间隔,高或低分片数。禁用 _source 和 _all 字段。我的模型如下。自动生成的 ID。
-
我使用批量处理器摄取数据。我在客户端测试了更改文档计数和并发性。我使用了多个强大的服务器来摄取数据。我的客户有热服务器 ips 来摄取数据,而不是热服务器。
{ “模板”:“test01*”, “设置”:{ “指数”: { “路由”:{ “分配”:{ “要求”: { “box_type”:“热” } } }, "refresh_interval": "600s", "number_of_shards": "26", "number_of_replicas": "1" } }, “映射”:{ “test01”:{ “_资源”: { “启用”:假 }, “_全部”: { “启用”:假 }, “动态”:错误, “特性”: { “rt”:{ “类型”:“关键字” }, “骗局”:{ “类型”:“浮动” } } } } }
【问题讨论】:
标签: elasticsearch elasticsearch-5