【发布时间】:2016-10-10 10:03:00
【问题描述】:
简而言之,如果查询告诉我 A 与 B 重叠,那么我不需要它也告诉我 B 也与 A 重叠,因为它们彼此重叠。
所以我试图在 sql 中使用自连接来选择“DISTINCT”重叠。
为了说明,这是我写的一个简单的 SQL 小提琴,用于显示包容性重叠选择 (http://sqlfiddle.com/#!9/7af84f/1)
详细...
假设我有一个名称 (char)、d1 (int)、d2 (int) 的表,其架构如下。这里 d1 和 d2 表示某个区间的开始和结束,该区间可能与同一张表中的另一个区间重叠。
CREATE TABLE test (
letter char ,
d1 int ,
d2 int
) ;
给定这张表,我用一些值填充它
INSERT INTO test (letter,d1,d2)
VALUES
('A', 2, 10), -- overlaps C and D
('B', 12, 20), -- overlaps E
('C', 5, 10), -- overlaps A and D
('D', 1, 8), -- overlaps A and C
('E', 13, 15), -- overlaps B
('F', 25, 30); -- doesn't overlap anything
并运行以下使用自联接的查询,以正确查找其中一行中的 d1 和 d2 与其他行中的 d1 和 d2 包含重叠的行。
-- selects all records that overlap in the range d1 - d2 inclusive
-- (excluding the implicit overlap between a record and itself)
-- The results are sorted by letter followed by d1
SELECT
basetable.letter as test_letter,
basetable.d1,
basetable.d2,
overlaptable.letter as overlap_letter,
overlaptable.d1 as overlap_d1,
overlaptable.d2 as overlap_d2
FROM
test as basetable,
test as overlaptable
WHERE
-- there is an inclusive overlap
basetable.d1 <= overlaptable.d2 and basetable.d2 >= overlaptable.d1
AND
-- the row being checked is not itsself
basetable.letter <> overlaptable.letter
AND
basetable.d1 <> overlaptable.d1
AND
basetable.d2 <> overlaptable.d2
ORDER BY
basetable.letter,
basetable.d1
这正确地给了我以下内容,显示了所有 6 个版本的重叠,例如左列表示 A 与 C 重叠,另一行显示 C 与 A 重叠(注意 sqlfiddle 似乎不理解字段别名,所以我的列标题是不同)
test_letter d1 d2 overlap_letter overlap_d1 overlap_d2
A 2 10 D 1 8
B 12 20 E 13 15
C 5 10 D 1 8
D 1 8 A 2 10
D 1 8 C 5 10
E 13 15 B 12 20
我的问题是这样的:
如何更改 sql 以获得四行 'DISTINCT' 或 'one way' 重叠?
即这个结果...
test_letter d1 d2 overlap_letter overlap_d1 overlap_d2
A 2 10 D 1 8
A 2 10 C 5 10
B 12 20 E 13 15
C 5 10 D 1 8
例如:
根据以下推理,仅在左侧列中显示 A、B 和 C 的记录的结果
- A(2,10) 与 D(1,8) 和 C(5,10) 重叠并{显示这两行}
- B(12,20) 与 E(13,15) 重叠 {SHOW THIS ROW}
- C(5,10) 与 D(1,8) 重叠 {SHOW THIS ROW 但不显示 A(1,10) 重叠,因为第 2 行已经显示 A 和 C 重叠}
- D(1,8) {DON'T SHOW any new as we already know about A(1,10) and C(5,10)}
- E(13,15) {DON'T SHOW any new as we already know about B(12,20) }
- F(25,30) {不显示任何内容,因为没有重叠}
【问题讨论】:
-
您有一个名为 test 的表,然后您填写了一个名为 testnames 的表。我已经很困惑了。
-
但您似乎只对一个字母小于另一个字母的情况感兴趣(而不是“不等于”)
-
将
basetable.letter <> overlaptable.letter更改为basetable.letter < overlaptable.letter。它还将使您的查询速度提高 50%。 (现在我可以看到,这正是@Strawberry 用文字写的)。 -
您需要一个标准,如何在(B 重叠 E)和(E 重叠 B)之间进行选择。除了
basetable.letter {< | > }overlaptable.letter其他可能的选项是basetable.d1 > overlaptable.d1' ,basetable.d2 -
是的,只需将 更改为
标签: mysql sql distinct overlapping