作者:高鹏
文章末尾有他著作的《深入理解 MySQL 主从原理 32 讲》,深入透彻理解 MySQL 主从,GTID 相关技术知识。

继上一篇文章:

MySQL:查询字段数量多少对查询效率的影响

我们继续来讨论一下 count(*)、count(字段)实现上的区别。注意我们这里都使用 Innodb 做为存储引擎,不讨论其他引擎。因为了有了前面的讨论,更容易看出它们的区别,这里我们有如下注意点:

  • 我们需要做到执行计划一样,这里以全表扫描为例。实际上 count 很可能使用到覆盖索引(Using index),本文主要讨论它们实现的异同。
  • count(*) 和 count(字段) 在结果上可能并不一致。比如 count(字段),但是某些行本字段为 NULL 的话那么将不会统计行数,下面将会说明这种 NULL 判断的位置。本文还是使用简单的全表扫描来进行对比实现上的区别。首先我们要明确的是 count 使用的是一个 COUNT 计数器。

一、使用示例

在示例中我们也可以看到两个语句的结果实际上并不一致。

mysql> show create table  baguai_f  G
*************************** 1. row ***************************Table: baguai_f
Create Table: CREATE TABLE `baguai_f` (`id` int(11) DEFAULT NULL,`a` varchar(20) DEFAULT NULL,`b` varchar(20) DEFAULT NULL,`c` varchar(20) DEFAULT NULL
) ENGINE=InnoDB DEFAULT CHARSET=utf8
1 row in set (0.00 sec)mysql> select * from baguai_f  ;
+------+------+------+------+
| id   | a    | b    | c    |
+------+------+------+------+
|    1 | g    | g    | NULL |
|    1 | g1   | g1   | g1   |
|    3 | g2   | g2   | g2   |
|    4 | g    | g    | NULL |
|    5 | g    | g    | NULL |
|    6 | g3   | g3   | g3   |
+------+------+------+------+
6 rows in set (0.00 sec)mysql> desc select count(*) from  baguai_f where b='g';
+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+
| id | select_type | table    | partitions | type | possible_keys | key  | key_len | ref  | rows | filtered | Extra       |
+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+
|  1 | SIMPLE      | baguai_f | NULL       | ALL  | NULL          | NULL | NULL    | NULL |    6 |    16.67 | Using where |
+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+
1 row in set, 1 warning (0.00 sec)mysql> desc select count(c) from  baguai_f where b='g';
+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+
| id | select_type | table    | partitions | type | possible_keys | key  | key_len | ref  | rows | filtered | Extra       |
+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+
|  1 | SIMPLE      | baguai_f | NULL       | ALL  | NULL          | NULL | NULL    | NULL |    6 |    16.67 | Using where |
+----+-------------+----------+------------+------+---------------+------+---------+------+------+----------+-------------+
1 row in set, 1 warning (0.00 sec)mysql>  select count(*) from  baguai_f where b='g';
+----------+
| count(*) |
+----------+
|        3 |
+----------+
1 row in set (0.00 sec)mysql>  select count(c) from  baguai_f where b='g';
+----------+
| count(c) |
+----------+
|        0 |
+----------+
1 row in set (0.00 sec)

这种不一致来自于 b='g' 的 c 列中都是 NULL 值,因此 count(c) 返回为 0。

二、示例中 count(*) 获取数据流程简析

注意在《MySQL:查询字段数量多少对查询效率的影响》一文中我们已经详细的描述了部分流程,这里不再赘述,如果需要更加详细的了解,自行参考。

1. MySQL 层 构建 read_set

这里构建的 read_set 实际上只会包含列b,即一个字段。

2. Innodb 层 构建模板

同理根据 read_set 构建的字段模板中只会包含列b。LOOP:这里开始循环返回每一条数据

3. Innodb 层 根据模板返回数据

这里我们可以看看模板的数量和模板对应的具体列名

  • 模板的数量
断点:row_sel_store_mysql_rec
查看模板数量:
(gdb) p prebuilt->n_template
$1 = 1

  • 查看模板对应的字段
断点:row_sel_field_store_in_mysql_format_func
查看模板对应的字段:
(gdb) p field->name
$3 = {m_name = 0x7ffe7c99cf85 "b"}

显然这里只是将 b 列的值返回给了 MySQL层,这里也很好理解,因为 b 列在 MySQL 层需要继续做过滤操作。

4. MySQL 层 过滤条件 b='g'

好了,当前返回给 MySQL 层的数据中只有 b 列的数据,然后施加 b='g' 这个条件进行过滤。

5. MySQL 层 过滤后做一个 COUNT 计数操作

对于普通的 select 语句过滤后的数据就可以返回了,但是对于 count 这种操作,这里做的是一个计数操作,其中行会对 count 字段的 NULL 值进行判断,当然这里是 count(*) 也就不存在 NULL 值判断了,下面是这段代码:

bool Item_sum_count::add()
{if (aggr->arg_is_null(false))return 0;count++;return 0;
}

END LOOP

最终我们只需要返回这个计数就可以了。下面是发送的数据,断点可以设置在 Query_result_send::send_data 中。

$22 = Item::SUM_FUNC_ITEM
(gdb) p ((Item*)(items)->first->info)->field_type()
$23 = MYSQL_TYPE_LONGLONG
(gdb) p ((Item*)(items)->first->info)->val_int()
$24 = 3
(gdb) p (items)->first->info
$26 = (void *) 0x7ffe7c006580
(gdb) p ((Item_sum_count*)$26)->count
$28 = 3

我们可以发送的数据实际就是这个计数器,最终值为 3。

三、示例中 count(c) 获取数据流程的不同

实际上整个流程基本一致,但是区别在于:

  • 构建的 read_set 不同,模板个数自然不同,因为需要 2 个字段,即 b、c 两个字段,其中 b 列用于 where 条件过滤,而 b 列用于统计是否有 NULL 值,因此模板数量为 2,如下:
(gdb) p prebuilt->n_template
$29 = 2

  • 做 COUNT 计数器的时候会根据 c 列的 NULL 值做实际的过滤,操作只要是 NULL 则 count 计数不会增加 1,这个还是参考这段代码:
bool Item_sum_count::add()
{if (aggr->arg_is_null(false)) //过滤NULL值return 0;count++;return 0;
}

最终会调入函数 Field::is_null 进行 NULL 值判断,断点可以设置在这里。

四、不同点总结

示例中的语句 count(c) 返回为 0。现在我们很清楚了,这些数据什么时候过滤掉的,总结如下:

  • Innodb 层返回了全部的行数据。
  • MySQL 层通过 where 条件过滤,剩下了 b='g' 的行。
  • MySQL 层通过 NULL 判断,将剩下的 count(c) 中为 NULL 的行也排除在计数之外。

而 count(*) 则没有第 3 步,这是一个不同。

然后的不同点就是在返回的字段上:

  • count(c) 很明显除了 where 条件以外,还需要返回 c 列给 MySQL 层
  • count(*) 则不需要返回额外的字段给 MySQL 层,只需要 MySQL 层过滤需要的b列即可。

通过上面的分析,实际上效率没有太大的差别,我觉得同样执行计划,同样返回数据结果的前提下,可能 count(*) 的效率要略微高一点。

五、备用栈帧(下图需点击放大查看)

NULL 值计数过滤栈帧

最后推荐高鹏的专栏《深入理解 MySQL 主从原理 32 讲》,想要透彻了解学习 MySQL 主从原理的朋友不容错过。

select * 与 count(*)数量不一致_技术分享 | MySQL:count(*)、count(字段) 实现上区别相关推荐

  1. mysql55和57的区别_技术分享 | MySQL:count(*)、count(字段) 实现上区别

    我们继续来讨论一下 count(*).count(字段)实现上的区别.注意我们这里都使用 Innodb 做为存储引擎,不讨论其他引擎.因为了有了前面的讨论,更容易看出它们的区别,这里我们有如下注意点: ...

  2. 多少行数_技术分享 | MySQL:查询字段数量多少对查询效率的影响

    作者:高鹏 文章末尾有他著作的<深入理解 MySQL 主从原理 32 讲>,深入透彻理解 MySQL 主从,GTID 相关技术知识. 这个问题是最近一个朋友问我的.刚好就好好看了一下,留下 ...

  3. mysql内连接简写_技术分享 | MySQL 的 join_buffer_size 在内连接上的应用

    本文详细介绍了 MySQL 参数 join_buffer_size 在 INNER JOIN 场景的使用,OUTER JOIN 不包含.在讨论这个 BUFFER 之前,我们先了解下 MySQL 的 I ...

  4. mysql优化说出九条_技术分享 | MySQL 优化:为什么 SQL 走索引还那么慢?

    原标题:技术分享 | MySQL 优化:为什么 SQL 走索引还那么慢? 背景 2019-01-11 9:00-10:00 一个 MySQL 数据库把 CPU 打满了. 硬件配置:256G 内存,48 ...

  5. mysql数据库中count的作用_详解 MySQL中count函数的正确使用方法

    1. 描述 在MySQL中,当我们需要获取某张表中的总行数时,一般会选择使用下面的语句 select count(*) from table; 其实count函数中除了*还可以放其他参数,比如常数.主 ...

  6. date转timestamp格式_技术分享 | MySQL:timestamp 时区转换导致 CPU %sy 高的问题

    作者:高鹏文章末尾有他著作的<深入理解 MySQL 主从原理 32 讲>,深入透彻理解 MySQL 主从,GTID 相关技术知识.本文为学习记录,可能有误请谅解. 本文建议PC端观看,效果 ...

  7. mysql 行锁 超时_技术分享 | MySQL 行锁超时排查方法优化

    作者:xuty 本文来源:原创投稿 * 爱可生开源社区出品,原创内容未经授权不得随意使用,转载请联系小编并注明来源. 一.大纲 #### 20191219 10:10:10,234 | com.ali ...

  8. 发布json数据_技术分享 | MySQL 8.0.17 GA 发布!

    昨日 MySQL 官网正式发布 8.0.17 / 5.7.27 / 5.6.45 三个(维护)版本,距离上一个 GA 版本(8.0.16)发布时隔仅 88 天! MySQL 各开发团队的博客网站,同一 ...

  9. mysql 客户端_技术分享 | MySQL 客户端连不上(1045 错误)原因全解析

    作者:Carlos Tutte.Marcos Albe 翻译:管长龙 在我们学习 MySQL 或从事 MySQL DBA 工作期间,时常会遇到:"我尝试连接到 MySQL 并且收到1045 ...

  10. left join 索引失效无条件_技术分享 | MySQL 优化:JOIN 优化实践

    近期刚好学习了丁奇老师的<MySQL 实战 45 讲>中的 join 优化相关知识,又刚刚好碰上了一个非常切合的 join 查询需要优化,分析过程有些曲折,记录下来留作笔记.问题 SQL ...

最新文章

  1. 【英语学习】【WOTD】disavow 释义/词源/示例
  2. 快速打开计算机磁盘的软件,怎样快速启动电脑
  3. 51单片机汇编_1_内外存储器转移数据
  4. 【mysql】mysql常用语句
  5. 今天同学跟我说刚入门前端,想到我目前实习的公司涨涨经验
  6. 【搞定GTD】用iPhone打造GTD实践1年后的心得体会
  7. 理解概念IMAP4、IMAP4rev1 client protocol、POP3、SMTP、MIME、RFC822
  8. NIVIDIA 硬解码学习4
  9. MySQL 从 8.0.31 开始从原来的 mysql:mysql-connector-java 改为 com.mysql:mysql-connector-j
  10. 为什存在_tmain以及Unicode和ANSI
  11. oracle19C设置兼容低版本oracle客户端
  12. The JSON value could not be converted to System.Int64
  13. Linux安装SQuirreL SQL Client
  14. 什么是DDR RAM DDR2 DDR3 DDR4 之间有什么区别
  15. 小程序微信支付完整demo源码,包含退款
  16. 汇信软件入选山东省优秀软件企业、标志性软件产品项目
  17. 你的肉眼欺骗了你--主观亮度与客观亮度
  18. 2023年除了百度还有哪些搜索引擎推荐?
  19. GPU Skinning 一:骨骼动画原理
  20. amazon ec2 linux yum install,在 Amazon Linux 2 EC2 实例上安装来自 Extras 库的软件

热门文章

  1. Protable 自定义添加搜索栏和toolbar
  2. Kotlin — 竞技程序设计(类似天梯训练)
  3. Futter基础第15篇: 实现类似闲鱼App底部导航凸起按钮
  4. 1031 查验身份证 (15 分)—PAT (Basic Level) Practice (中文)
  5. 鼠标左键长按功能的实现
  6. 使用PowerDesigner进行面向对象分析与UML建模(转)
  7. The GenerateResource task failed unexpectedly. a generic error occured in GDI+
  8. 2000/XP系统蓝屏原因与解决
  9. 经典——也许这就是方向
  10. 游戏筑基开发之字符串、字符指针、字符数组的相关知识梳理(C语言)