【发布时间】:2017-12-30 23:25:13
【问题描述】:
我正在尝试确定在 AWS 上的示例 Kafka 集群设置中可以实现的最大吞吐量。我在两个 EC2 实例上配置了 2 个 Kafka 代理,并尝试使用 ProducerPerformance Tool 来监控吞吐量,如下所示。
./bin/kafka-run-class.sh org.apache.kafka.tools.ProducerPerformance --throughput=10000--topic=TOPIC--num-records=50000000 --record-size=200 --producer -props bootstrap.servers=SERVERS buffer.memory=67108864 batch.size=64000
如果您能帮助我澄清以下问题,我将不胜感激。
- 吞吐量参数是什么意思?
关于我找到的文档 这条信息 -- 将最大消息吞吐量限制为大约 THROUGHPUT 个消息/秒
但我也注意到 -1 作为参数传递给这个 --throughput。(例如这里 - https://engineering.linkedin.com/kafka/benchmarking-apache-kafka-2-million-writes-second-three-cheap-machines )
- 当我们运行脚本时,我们会得到一些示例输出,例如 821,557 条记录/秒(78.3 MB/秒)。这个值与我们之前设置的吞吐量参数有什么关系?
谢谢。
【问题讨论】:
标签: apache-kafka kafka-producer-api