【问题标题】:MariaDB/PostreSQL - Query optimizationMariaDB/PostgreSQL - 查询优化
【发布时间】:2018-02-07 22:53:42
【问题描述】:

我需要生成一些数字,我设计了一个查询来获得“客户”所需的结果。 此查询基于包含一百万条记录的表。 我通常为此使用 MariaDB,我在大约 7 秒内得到结果。 这个执行时间非常合适,但我希望再次优化以提高我的技能。 经过一番研究,我看到一些帖子说“MySQL 很好,但不是在表上> 1M 的记录,你必须打开别的东西” PostgreSQL 已被多次引用。 所以我安装了 PostgreSQL,并复制了我的表、索引和数据。 我执行了相同的查询,大约 12 秒后得到了结果

我对 PostgreSQL 了解较少,我认为我没有使用该语言固有的特性。 所以现在我留在 MariaDB 上。您有改善执行时间的想法吗?

这是我的查询:

select categorie.cat
,dhu_type.type
,COUNT(DISTINCT(
    CASE WHEN dhu.date between '2013-01-01' and '2013-12-31'    
    THEN dhu.id
    END )

  ) AS "2013"
,COUNT(DISTINCT(
    CASE WHEN dhu.date between '2014-01-01' and '2014-12-31'    
    THEN dhu.id
    END )

  ) AS "2014"
,COUNT(DISTINCT(
    CASE WHEN dhu.date between '2015-01-01' and '2015-12-31'     
    THEN dhu.id
    END )

  ) AS "2015"
,COUNT(DISTINCT(
    CASE WHEN dhu.date between '2016-01-01' and '2016-12-31'       
    THEN dhu.id
    END )

  ) AS "2016"
from dhu
inner join dhu_type on dhu.type_id = dhu_type.id
inner join patient on dhu.patient_id=patient.id
inner join fa on patient.id = fa.patient_id
inner join categorie on categorie.id = fa.cat_id
group by cat,dhu_type.type

我用图表完成我的问题

这里是创建表:

/*!40101 SET @OLD_CHARACTER_SET_CLIENT=@@CHARACTER_SET_CLIENT */;
/*!40101 SET NAMES utf8 */;
/*!50503 SET NAMES utf8mb4 */;
/*!40014 SET @OLD_FOREIGN_KEY_CHECKS=@@FOREIGN_KEY_CHECKS, FOREIGN_KEY_CHECKS=0 */;
/*!40101 SET @OLD_SQL_MODE=@@SQL_MODE, SQL_MODE='NO_AUTO_VALUE_ON_ZERO' */;


CREATE TABLE IF NOT EXISTS `categorie` (
  `id` tinyint(3) unsigned NOT NULL AUTO_INCREMENT,
  `cat` varchar(50) NOT NULL DEFAULT 'neonat',
  PRIMARY KEY (`id`,`cat`)
) ENGINE=InnoDB AUTO_INCREMENT=16 DEFAULT CHARSET=utf8;

CREATE TABLE IF NOT EXISTS `cp` (
  `id` smallint(5) unsigned NOT NULL AUTO_INCREMENT,
  `cp` varchar(5) NOT NULL,
  PRIMARY KEY (`id`),
  UNIQUE KEY `cp` (`cp`)
) ENGINE=InnoDB AUTO_INCREMENT=4096 DEFAULT CHARSET=utf8;


CREATE TABLE IF NOT EXISTS `dhu` (
  `id` int(10) unsigned NOT NULL AUTO_INCREMENT,
  `patient_id` int(10) unsigned NOT NULL,
  `date` date NOT NULL,
  `type_id` tinyint(3) unsigned NOT NULL,
  PRIMARY KEY (`id`),
  KEY `FK_dhu_patient` (`patient_id`),
  KEY `FK_dhu_dhu_type` (`type_id`),
  CONSTRAINT `FK_dhu_dhu_type` FOREIGN KEY (`type_id`) REFERENCES `dhu_type` (`id`),
  CONSTRAINT `FK_dhu_patient` FOREIGN KEY (`patient_id`) REFERENCES `patient` (`id`)
) ENGINE=InnoDB AUTO_INCREMENT=953590 DEFAULT CHARSET=utf8;


CREATE TABLE IF NOT EXISTS `dhu_import` (
  `id` int(10) unsigned NOT NULL AUTO_INCREMENT,
  `noip` bigint(10) unsigned zerofill NOT NULL,
  `date` date NOT NULL,
  `cp` varchar(5) NOT NULL,
  `type` varchar(4) NOT NULL,
  PRIMARY KEY (`id`),
  KEY `noip` (`noip`)
) ENGINE=InnoDB DEFAULT CHARSET=utf8;

CREATE TABLE IF NOT EXISTS `dhu_type` (
  `id` tinyint(3) unsigned NOT NULL AUTO_INCREMENT,
  `type` varchar(4) NOT NULL,
  PRIMARY KEY (`id`),
  UNIQUE KEY `type` (`type`)
) ENGINE=InnoDB AUTO_INCREMENT=8 DEFAULT CHARSET=utf8;

CREATE TABLE IF NOT EXISTS `dpt` (
  `dpt` tinyint(3) unsigned DEFAULT NULL,
  `abrev` char(3) DEFAULT NULL
) ENGINE=InnoDB DEFAULT CHARSET=utf8;


CREATE TABLE IF NOT EXISTS `fa` (
  `patient_id` int(10) unsigned NOT NULL,
  `cat_id` tinyint(3) unsigned NOT NULL,
  PRIMARY KEY (`patient_id`,`cat_id`),
  KEY `idx_cat_id_pat_id` (`cat_id`,`patient_id`),
  CONSTRAINT `FK_fa_patient` FOREIGN KEY (`patient_id`) REFERENCES `patient` (`id`),
  CONSTRAINT `FK_fa_categorie` FOREIGN KEY (`cat_id`) REFERENCES `categorie` (`id`)
) ENGINE=InnoDB DEFAULT CHARSET=utf8;


CREATE TABLE IF NOT EXISTS `fa_import` (
  `noip` bigint(10) unsigned zerofill NOT NULL,
  `cat` varchar(50) NOT NULL,
  PRIMARY KEY (`noip`,`cat`)
) ENGINE=InnoDB DEFAULT CHARSET=utf8 ROW_FORMAT=COMPACT;

CREATE TABLE IF NOT EXISTS `patient` (
  `id` int(10) unsigned NOT NULL AUTO_INCREMENT,
  `noip` bigint(10) unsigned zerofill NOT NULL,
  `cp_id` smallint(5) unsigned NOT NULL,
  PRIMARY KEY (`id`),
  KEY `FK_patient_cp` (`cp_id`),
  CONSTRAINT `FK_patient_cp` FOREIGN KEY (`cp_id`) REFERENCES `cp` (`id`)
) ENGINE=InnoDB AUTO_INCREMENT=262141 DEFAULT CHARSET=utf8;


/*!40101 SET SQL_MODE=IFNULL(@OLD_SQL_MODE, '') */;
/*!40014 SET FOREIGN_KEY_CHECKS=IF(@OLD_FOREIGN_KEY_CHECKS IS NULL, 1, @OLD_FOREIGN_KEY_CHECKS) */;
/*!40101 SET CHARACTER_SET_CLIENT=@OLD_CHARACTER_SET_CLIENT */;

这里是解释查询:

这里是提高性能的修改(选择 categorie.id 而不是 categorie.cat):

这是我找到的最好的查询,感谢@RickJames 和@BillKarwin

select categorie.cat
,dhu_type.`type`
,t.`2013`
,t.`2014`
,t.`2015`
,t.`2016` 
from ( select fa.cat_id as catid
,dhu.type_id typid
,COUNT(DISTINCT(
    CASE WHEN dhu.date between '2013-01-01' and '2013-12-31'    
    THEN dhu.id
    END )

  ) AS "2013"
,COUNT(DISTINCT(
    CASE WHEN dhu.date between '2014-01-01' and '2014-12-31'    
    THEN dhu.id
    END )

  ) AS "2014"
,COUNT(DISTINCT(
    CASE WHEN dhu.date between '2015-01-01' and '2015-12-31'     
    THEN dhu.id
    END )

  ) AS "2015"
,COUNT(DISTINCT(
    CASE WHEN dhu.date between '2016-01-01' and '2016-12-31'       
    THEN dhu.id
    END )

  ) AS "2016"
from dhu
inner join patient on dhu.patient_id=patient.id
inner join fa on patient.id = fa.patient_id
group by fa.cat_id, dhu.type_id ) t

inner join categorie on t.catid = categorie.id
inner join dhu_type on t.typid = dhu_type.id

order by categorie.cat,dhu_type.`type`

【问题讨论】:

  • 改为内连接 fa, patient, categorie。
  • 你是对的,查询更具可读性但执行时间相同。
  • 条件聚合/过滤器#GIYF
  • 您能否在 sqlfiddle.com 或 db-fiddle.com 上发布您的表/数据(包括任何索引),然后回复此评论?另外,您是否尝试过使用 EXPLAIN?
  • 请在 mysql 上运行 ANALYZE TABLE,在 postgres 上运行 VACUUM ANALYZE,发布表定义,在 mysql 上运行 EXPLAIN 查询,在 postgres 上运行 EXPLAIN ANALYZE。

标签: mysql sql postgresql query-optimization mariadb


【解决方案1】:
  • MySQL 可以很好地处理十亿行表。

  • 任何数据库引擎都受磁盘速度和用于缓存的 RAM 大小(或少)的支配。

  • 教科书说要规范化所有内容,但我建议 4 字符 type 不值得规范化。同样适用于 5 字符 cp

  • 除非您真的想要输出全为零的行,否则请在 GROUP BY 之前添加此 WHERE dhu.date between '2016-01-01' and '2016-12-31'

  • 按照我的建议 here 进行多:多模式设计 (fa)。这可能会加快 MySQL 的查询速度。 (我不知道同样的原则是否适用于 Postgres。)

【讨论】:

  • 谢谢。我删除了你处理的项目,并添加了几个。
  • 我添加了“反向”索引 (cat_id,patient_id) 但没有影响。我从未想过使用它,感谢您的建议 ;) 我不能使用 WHERE YEAR(dhu.date) = 2016 因为我需要计算范围 [2013-01-01 ; 2016-12-31] 我认为执行时间仅来自我在桌面上运行的虚拟机(Centos/1Go RAM)。悲伤....
  • FWIW,将属性拉出到由自动增量索引的查找表中的设计是不是规范化。它与任何正常形式无关。
  • 我不知道它的任何名称,除了“制作一个自动增量索引的查找表”。 :-)
  • 好的,我称之为 MALTIBAAI。 ;)
猜你喜欢
  • 2021-04-06
  • 2016-07-09
  • 2014-06-13
  • 2022-01-12
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2022-11-12
  • 1970-01-01
相关资源
最近更新 更多