【发布时间】:2018-04-27 20:11:31
【问题描述】:
是否可以使用 KSQL 不仅通过 GROUP BY 对特定列的条目进行计数,还可以对通过应用程序流式传输的所有条目进行聚合?
我正在寻找这样的东西:
| Count all | Count id1 | count id2 |
| ---245----|----150----|----95-----|
或者在 KSQL 中更像这样:
[some timestamp] | Count all | 245
[some timestamp] | Count id1 | 150
[some timestamp] | Count id2 | 95
.
.
.
谢谢
- 蒂姆
【问题讨论】:
-
所以在伪 SQL 中,类似于
SELECT COUNT(*), COUNT(DISTINCT ID1), COUNT(DISTINCT ID2) FROM FOO?这就是你所追求的吗? -
是的,这是最初的想法。然而,最终的想法是简单地获取全部记录,所以只有 count(*)。 @Hojjat 的回答似乎工作得很好!
标签: apache-kafka apache-kafka-streams ksqldb