【发布时间】:2017-03-21 02:08:52
【问题描述】:
在连接两个表后,我需要一个示例,例如:
SELECT *
from
A left join B
on A.col=B.col
sample 1000000
问题是 A 和 B 很大(超过 30 亿行),当我尝试连接时,我的假脱机空间已用完。
有没有办法在样本之后进行连接,以便连接较小的表(例如,从 A 和 B 中选择 10,000,000 个样本,内部连接它们,然后从连接中选择 1,000,000,希望我能做到至少 1,000,000 行?)
附: 我正在使用 teradata
【问题讨论】:
-
(1) A和B是什么关系? 1:1? 1:N? (2)A和B的主要指标是什么?
-
您能否将 1000000 A 采样到临时表中 SELECT * INTO #A FROM A SAMPLE 1000000 然后 SELECT * FROM #A left join B on A.Col = B.col
-
您在这里已经有了很好的答案,但如果您回答@Dudu-Markovitz 的问题,您将可以改进答案。
-
A 和 B 是两张表,但没有严格的 1:1 对应关系,但是它们有很大的交集。我只对这个路口的采样感兴趣。
-
连接中使用的列是两个表之一的主索引吗?