【发布时间】:2019-05-25 16:20:01
【问题描述】:
我有按此处指定的方式将批处理写入 Kafka 的 Spark 代码:
https://spark.apache.org/docs/2.4.0/structured-streaming-kafka-integration.html
代码如下所示:
df.selectExpr("CAST(key AS STRING)", "CAST(value AS STRING)")
\
.write \
.format("kafka") \
.option("kafka.bootstrap.servers",
"host1:port1,host2:port2") \
.option("topic", "topic1") \
.save()
但是数据只被写入 Kafka 分区 0。我怎样才能将它统一写入同一主题中的所有分区?
【问题讨论】:
-
主题实际有多少个分区?
-
主题有多少个分区?
df中有多少个不同的keys?