详解MySQL中的count()、union()和group by语句

本篇文章带大家了解一下count()、union()和group by语句,补充一下mysql知识点(不同count()的用法、union执行流程、group by语句)。

详解MySQL中的count()、union()和group by语句

一、MySQL中count()的不同用法

count()是一个聚合函数,对于返回的结果集,一行行地判断,如果count函数的参数不是NULL,累计值就加1,否则不加。最后返回累计值。【相关推荐:mysql视频教程】

1.对于count(主键id)来说,InnoDB引擎会遍历整张表,把每一行的id值都取出来,返回给server层。server层拿到id后,判断是不可能为空的,就按行累加

2.对于count(1)来说,InnoDB引擎遍历整张表,但不取值。server层对于返回的每一行,放一个数字1进入,判断是不可能为空的,按行累加

3.对于count(字段)来说,如果这个字段是定义为not null的话,一行行地从记录里面读出这个字段,判断不能为null,按行累加;如果这个字段定义允许为null的话,那么执行的时候,判断到有可能是null,还要把值取出来在判断一下,不是null才累加

4.对于count(*)来说,并不会把全部字段取出来,而是专门做了优化。不取值,count(*)肯定不是null,按行累加

1.png

二、union执行流程

为了便于量化分析,以下面表t1来举例

create table t1(id int primary key, a int, b int, index(a));CREATE DEFINER=`root`@`%` PROCEDURE `idata`()BEGINdeclare i int;  set i=1;  while(i<=1000)do    insert into t1 values(i, i, i);    set i=i+1;  end while;END

分析下面这条SQL语句:

(select 1000 as f) union (select id from t1 order by id desc limit 2);

union的语义是取这两个子查询结果的并集。并集的意思是这两个集合加起来,重复的行只保留一行

在这里插入图片描述

第二行的key=PRIMARY,说明第二个子句用到了索引id第三行的Extra字段,表示在对子查询的结果集做union的时候,使用了临时表

这个语句的执行流程如下:

1.创建一个内存临时表,这个临时表只有一个整型字段f,并且f是主键字段

2.执行第一个子查询,得到1000这个值

3.执行第二个子查询:

拿到第一行id=1000,试图插入临时表中。但由于1000这个值已经存在于临时表了,违反了唯一性约束,所以插入失败,然后继续执行取到第二行id=999,插入临时表成功

4.从临时表中按行取出数据,返回结果,并删除临时表,结果中包含两行数据分别是1000和999

在这里插入图片描述

这里的内存临时表起到了暂存数据的作用,而且计算过程还用上了临时表主键id的唯一性约束,实现了union的语义

如果把上面的语句中union改成union all的话,就没有了去重的语义。这样执行的时候,就依次执行子查询,得到的结果直接作为结果集的一部分,发给客户端。因此也就不需要临时表了

在这里插入图片描述

第二行Extra字段显示的是Using index,表示只使用了覆盖索引,没有用临时表

三、group by语句详解

1、group by执行流程

还是使用上面的表t1,分析下面这条SQL语句:

select id%10 as m, count(*) as c from t1 group by m;

这个语句的逻辑是把表t1里的数据,按照id%10进行分组统计,并按照m的结果排序后输出。explain结果如下:

在这里插入图片描述
在Extra字段里面,可以看到三个信息:

Using index,表示这个语句使用了覆盖索引,选择了索引a,不需要回表Using temporary,表示使用了临时表Using filesort,表示需要排序

这个语句的执行流程如下:

1.创建内存临时表,表里有两个字段m和c,主键是m

2.扫描表t1的索引a,依次取出叶子节点上的id值,计算id%10的结果,记为x

如果临时表中没有主键为x的行,就插入一个记录(x,1)如果表中有主键为x的行,就将x这一行的c值加1

3.遍历完成后,再根据字段m做排序,得到结果集返回给客户端

在这里插入图片描述

内存临时表排序流程图:

在这里插入图片描述

在这里插入图片描述

如果并不需要对结果进行排序,在SQL语句末尾增加order by null:

select id%10 as m, count(*) as c from t1 group by m order by null;

在这里插入图片描述

由于表t1中的id值是从1开始的,因此返回的结果集中第一行是id=1

这个例子里由于临时表只有10行,内存可以放得下,因此全程只使用了内存临时表。但是,内存临时表的大小是有限的,参数tmp_table_size就是控制整个内存大小的,默认是16M

set tmp_table_size=1024;select id%100 as m, count(*) as c from t1 group by m order by null limit 10;

把内存临时表的大小限制为最大1024字节,并把语句改成id%100,这样返回结果里有100行数据。但是,这时的内存临时表大小不够存下这100行数据,也就是说,执行过程中会发现内存临时表大小达到了上限。那么,这时候会把内存临时表转成磁盘临时表,磁盘临时表默认使用的引擎是InnoDB

2、group by优化方法——索引

group by的语义逻辑,是统计不同的值的个数。但是,由于每一行的id%100的结果是无序的,所以就需要有一个临时表来记录并统计结果。那么,如果扫描过程中可以保证出现的数据是有序的就可以了

假设,现在有一个类似下图的这么一个数据结构

在这里插入图片描述
如果可以确保输入的数据是有序的,那么计算group by的时候,就只需要从左到右,顺序扫描,依次累加。也就是下面这个流程:

当碰到第一个1的时候,已经知道累积了X个0,结果集里的第一行就是(0,X)当碰到第一个2的时候,已经知道累积了Y个1,结果集里的第一行就是(1,Y)

按照这个逻辑执行的话,扫描到整个输入的数据结束,就可以拿到group by的结果,不需要临时表,也需要再额外排序

在MySQL5.7版本支持了generated column机制,用来实现列数据的关联更新。创建一个列z,在z列上创建一个索引

alter table t1 add column z int generated always as(id % 100), add index(z);

这样,索引z上的数据就是有序的了。group by语句就可以改成:

select z, count(*) as c from t1 group by z;

在这里插入图片描述
从这个Extra字段可以看到,这个语句的执行不再需要临时表,也不需要排序了

3、group by优化方法——直接排序

在group by语句中加入SQL_BIG_RESULT这个提示,就可以告诉优化器:这个语句涉及的数据量很大,直接用磁盘临时表。因为磁盘临时表是B+树存储,存储效率不如数组来得高。所以MySQL优化器直接用数组来存

select SQL_BIG_RESULT id%100 as m, count(*) as c from t1 group by m;

1.初始化sort_buffer,确定放入一个整型字段,记为m

2.扫描表t1的索引a,依次取出里面的id值,将id%100的值存入sort_buffer中

3.扫描完成后,对sort_buffer的字段m做排序(如果sort_buffer内存不够用,就会利用磁盘临时文件辅助排序)

4.排序完成后,就得到了一个有序数组

根据有序数组,得到数组里面的不同值,以及每个值的出现次数

在这里插入图片描述在这里插入图片描述
这个语句的执行没有再使用临时表,而是直接用了排序算法

更多编程相关知识,请访问:编程入门!!

以上就是详解MySQL中的count()、union()和group by语句的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/185465.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
为女生量身打造,九号电动Q3和爱玛露娜Pro哪个好?一文看懂差别
上一篇 2026年9月4日 21:42:47
如何在Centos 7.3下安装Graylog2全程指导
下一篇 2026年9月4日 21:47:08

相关推荐

  • 如何在mysql中优化多列条件查询使用索引

    多列查询能否高效使用索引取决于复合索引设计和最左前缀原则:1. 复合索引需按查询条件顺序创建,如CREATE INDEX idx_status_city_age ON users(status, city, age);2. 查询必须从最左列开始连续使用索引列才能命中;3. 避免在索引列使用函数、类型…

    2026年9月12日
    000
  • 如何在mysql中优化范围查询使用索引

    范围查询可有效使用索引,关键在于遵循最左前缀原则,将等值条件列置于复合索引前,范围列置后,避免在索引列上使用函数,并优先使用覆盖索引以减少回表。 在MySQL中,范围查询(如 >、<、BETWEEN、IN 等)能否有效使用索引,关键在于索引的设计和查询语句的写法。虽然范围查询可以使用索引…

    2026年9月12日
    300
  • 如何在mysql中监控复制状态

    使用SHOW SLAVE STATUS命令可实时监控MySQL主从复制状态,重点关注Slave_IO_Running和Slave_SQL_Running线程状态及Seconds_Behind_Master延迟指标,结合Last_Error分析故障原因,建议通过自动化工具如Prometheus与Gra…

    2026年9月12日
    000
  • 如何在mysql中优化查询性能

    答案:优化MySQL查询需合理使用索引、优化SQL语句、设计高效表结构并调整系统配置。1. 为WHERE、ORDER BY等字段建索引,遵循最左前缀原则,避免函数操作导致索引失效;2. 避免SELECT *,用JOIN替代子查询,使用LIMIT分页,通过EXPLAIN分析执行计划;3. 选用合适数据…

    2026年9月12日
    000
  • docker中mysql容器数据如何持久化

    使用Docker数据卷或绑定挂载将MySQL数据目录持久化到宿主机,可防止容器删除导致数据丢失;推荐创建命名数据卷(如docker volume create mysql-data)并挂载至容器的/var/lib/mysql目录,确保数据独立保存且易于管理,同时建议定期备份并避免多个容器共享同一数据…

    2026年9月12日
    100
  • MySQL兼容性检查与版本适配策略_Sublime支持多版本语法规范管理

    MySQL兼容性检查与版本适配策略_Sublime支持多版本语法规范管理MySQL兼容性检查与版本适配策略_Sublime支持多版本语法规范管理MySQL兼容性检查与版本适配策略_Sublime支持多版本语法规范管理MySQL兼容性检查与版本适配策略_Sublime支持多版本语法规范管理

    1.兼容性检查与版本适配的核心在于确保代码与不同mysql版本协同工作,并通过策略调整实现多版本语法规范管理。2.进行mysql兼容性检查时,需了解目标版本特性、利用mysql_upgrade和sqlancer等工具检测问题,并编写单元测试验证数据类型兼容性。3.sublime text可通过安装s…

    2026年9月12日 用户投稿
    300
  • 如何在mysql中优化JOIN多表查询性能

    优化MySQL JOIN查询需先建立关联字段索引,减少全表扫描;通过WHERE提前过滤数据,避免SELECT *以降低开销;遵循小表驱动大表原则,合理控制JOIN数量;利用覆盖索引避免回表;结合EXPLAIN分析执行计划,关注type和Extra字段,持续调优慢查询。 在MySQL中优化JOIN多表…

    2026年9月12日
    500
  • 如何在mysql中使用LIMIT进行分页查询

    分页查询使用LIMIT offset, row_count实现,offset=(page-1)*size计算偏移量,需配合ORDER BY保证数据一致性,避免深度分页性能问题,建议通过索引过滤或缓存优化。 在MySQL中使用LIMIT进行分页查询,主要是通过LIMIT子句控制返回的记录数量,并结合O…

    2026年9月12日
    100
  • 如何在mysql中恢复误删数据

    首先检查是否开启binlog并利用其恢复数据,若开启则通过mysqlbinlog解析日志并反向生成SQL还原;其次可从最近的备份文件如mysqldump中直接导入数据完成恢复。 在MySQL中误删数据后,恢复的关键在于是否有备份或开启了二进制日志(binlog)。如果没有做任何准备,恢复会非常困难甚…

    2026年9月12日
    100
  • mysql数据库如何设计分区表

    设计MySQL分区表需根据数据访问模式选择合适策略,适用于数据量大且有明显查询特征的场景。1. 选择分区类型:RANGE用于时间或数值范围查询,LIST适用于离散值分类,HASH和KEY用于均匀分布数据,复合分区适应复杂负载。2. 分区键应与高频查询字段一致,实现分区裁剪,避免更新频繁或低基数字段,…

    2026年9月12日
    100
  • Linux如何监控服务的运行时间和负载

    Linux如何监控服务的运行时间和负载Linux如何监控服务的运行时间和负载Linux如何监控服务的运行时间和负载Linux如何监控服务的运行时间和负载

    要监控Linux服务的运行时间和负载,需选择合适的工具并配置监控与告警。首先明确监控目标如Web或数据库服务,然后选用top、ps、sar等命令行工具或Prometheus、Grafana、Nagios等系统级方案。使用top可实时查看CPU和内存占用;ps结合grep和STIME可查进程启动时间;…

    2026年9月12日 用户投稿
    000
  • mysql如何测试事务一致性

    答案:测试MySQL事务一致性需验证ACID特性,首先创建InnoDB表并模拟转账事务,确保余额总和不变;其次通过人为报错测试回滚后数据是否复原;接着在并发场景下检验隔离性,防止超扣;再用自动化脚本模拟多线程操作,校验最终一致性;最后通过kill进程测试崩溃后已提交事务的持久性。 测试 MySQL …

    2026年9月12日
    100
  • 如何在mysql中设置单主多从架构

    首先配置主库启用binlog并创建复制用户,然后为每个从库设置唯一server-id并配置连接主库的复制参数,最后验证各从库的Slave_IO_Running和Slave_SQL_Running状态为Yes,确认数据同步正常。 在 MySQL 中实现单主多从架构,主要是通过配置主从复制(Replic…

    2026年9月12日
    100
  • 如何升级多源复制环境

    先升级从库再逐个升级主库,确保数据一致性。需确认拓扑结构、版本兼容性及GTID设置,备份配置文件并在测试环境验证。停止从库复制线程后升级软件,重启并监控复制状态。每次仅升级一个主库,切换流量、待binlog消费完后关闭升级,检查参数并恢复连接。使用pt-table-checksum校验数据,避免并发…

    2026年9月12日
    200
  • 如何在mysql中查看事件调度器日志

    要监控MySQL事件调度器,需确保event_scheduler=ON,并通过information_schema.EVENTS查看事件状态,启用通用查询日志记录执行过程,检查错误日志排查问题,推荐创建日志表记录事件执行详情,以全面掌握事件行为。 MySQL 本身不提供专门的“事件调度器日志”文件,…

    2026年9月12日
    000
  • 如何在mysql中高效使用SELECT语句

    避免SELECT *,只查询必要列以减少I/O和网络开销;2. 在WHERE条件中使用索引字段并避免函数操作以防止索引失效;3. 用主键或唯一键进行分页优化,避免大偏移量导致性能下降。 在MySQL中高效使用SELECT语句,关键在于优化查询逻辑、合理利用索引以及减少不必要的数据处理。以下是一些实用…

    2026年9月12日
    000
  • 如何使用mysql实现新闻发布系统项目

    核心是设计新闻、分类、用户、评论表并建立关联,通过SQL实现增删改查,用预处理语句防范注入,构建完整系统。 用MySQL做新闻发布系统,核心是把新闻内容和用户操作变成数据库里的“记录”。关键在于设计好数据表,让它们能准确描述新闻、分类、用户这些信息,以及它们之间的关系。只要表结构合理,增删改查就很简…

    2026年9月12日
    200
  • 如何在mysql中优化批量写入效率

    使用批量INSERT、显式事务、调整InnoDB参数、优先LOAD DATA INFILE及优化索引策略可显著提升MySQL写入效率,核心是减少I/O与事务开销。 在 MySQL 中进行批量写入时,如果处理不当,很容易导致性能低下。优化批量写入效率可以从多个方面入手,核心目标是减少磁盘 I/O、降低…

    2026年9月12日
    000
  • 如何使用mysql设计订单支付系统

    答案:设计可靠订单支付系统需合理设计order_info和payment_log表结构,使用DECIMAL存储金额,通过事务保证ACID,结合状态机控制订单状态转换,利用唯一索引防重复,加锁与WHERE条件校验防止并发问题,记录支付日志并定期对账,确保数据一致性与系统可扩展性。 设计一个可靠的订单支…

    2026年9月12日
    000
  • 如何在Linux中优化mysql启动参数

    根据服务器硬件和业务负载调整MySQL内存与I/O参数可显著提升性能。1. 内存方面:innodb_buffer_pool_size设为物理内存50%~70%,key_buffer_size针对MyISAM表设小值(32M~64M),query_cache_size在旧版本中按需启用,tmp_tab…

    2026年9月12日
    000

发表回复

登录后才能评论
关注微信