【发布时间】:2021-09-02 16:33:44
【问题描述】:
我正在寻找类似于 clickhouse 中的亲和力托管的功能 - https://ignite.apache.org/docs/latest/data-modeling/affinity-collocation
基本上,我有 2 个不同的表,我们称之为员工和出勤
员工表
ID Name
- -
1 Sankar
2 VM
3 Amal
考勤表
Employee_ID Date. isPresent
- - -
1 1/1/2020 True
2 1/1/2020 False
3 1/1/2020 True
现在让两棵树都是 MergeTree,我使用 ID 和 Employee_ID 作为分区键。 这样可以确保两个表中同一员工的记录总是在同一个节点上结束。它不会转到不同的表。
现在,当我根据 ID 和 Employee_ID 进行联接时,我希望发生以下情况。
- 转到每个节点
- 在两个本地表上运行连接
- 从每个节点获取结果并进一步减少它们以获得最终结果。
我尝试了全局和本地分布式 JOIN,似乎他们并没有完全使用它。 请就如何实现这一目标提出建议
【问题讨论】:
标签: sql distributed-computing clickhouse