【发布时间】:2015-05-30 11:19:46
【问题描述】:
我有一个 IMDB 数据库,我正在尝试计算每年制作的平均演员人数。问题是关于从子查询中选择的速度差异。
我的查询是:
SELECT AVG(sub.num)
FROM
(SELECT
COUNT(production_cast.person_id) AS num,
production.production_year AS pyear
FROM production_cast
INNER JOIN production ON production.id = production_cast.production_id
GROUP BY production.id) sub
GROUP BY(sub.pyear)
但是为了简单起见,以下是问题所涉及的两个查询:
带子查询
SELECT sub.num
FROM
(SELECT
COUNT(production_cast.person_id) AS num,
production.production_year AS pyear
FROM production_cast
INNER JOIN production ON production.id = production_cast.production_id
GROUP BY production.id) sub
没有子查询:
SELECT
COUNT(production_cast.person_id) AS num,
production.production_year AS pyear
FROM production_cast
INNER JOIN production ON production.id = production_cast.production_id
GROUP BY production.id
第二个的持续时间不到一秒,第一个永远不会完成。 -超过5分钟-。
带有子查询的解释
+-------------+------------------+-------+-----------------------------------+-------------+
| select_type | table | type | key | Extra |
+-------------+------------------+-------+-----------------------------------+-------------+
| PRIMARY | <derived2> | ALL | NULL | NULL |
| DERIVED | production | index | idx_Production_id_production_year | Using index |
| DERIVED | production_cast | ref | production_id | NULL |
+-------------+------------------+-------+-----------------------------------+-------------+
没有子查询的解释:
+-------------+-----------------+-----------------------------------+------------+
| select_type | table | key | Extra |
+-------------+-----------------+-----------------------------------+------------+
| SIMPLE | production | idx_Production_id_production_year | Usingindex |
| SIMPLE | production_cast | production_id | NULL |
+-------------+-----------------+-----------------------------------+------------+
造成这种性能差异的原因是什么?有什么办法可以预防?
【问题讨论】: