本文分享主要描述了几种书写SQL时常见的一些隐藏错误,主要包括:在运算符中使用null值、在聚合数据时使用null值、求平均值时使用判断条件、滤条件中使用and和or、查询的列字段之间缺少逗号分隔、inner join与left join。都是一些比较细节的点,希望本文对你有所帮助。

在运算符中使用null值

在SQL中常见的运算符有算术运算符(+,-),逻辑运算符(in,not in),比较运算符(>,<)等等。但是,如果参与运算的数据中存在null值,这个时候我们就要小心了,因为对于null值参与的运算可能会返回null值

  • 情况1:与null值列相加

比如有如下表:

当我们对每行的列字段相加时,会出现null

SELECTJan + Feb + Mar as total_amount -- 结果为null
FROM stores
WHERE store = 1

比如:

SELECT 100 + null + 190; -- 结果为null

其实,我们计算的时候希望null值变为0,但是SQL并没有帮我们转换,所以遇到这种存在null值的情况,要加以小心,我们可以通过判断进行处理,比如:

SELECT 100 + coalesce(null,0) + 190; -- 结果为290

  • 情况2:not in 操作

比如有如下表:

当我们使用下面语句进行查询时:

SELECT*
FROM scores
WHERE tag not in ("优")

结果输出为:

其实对于id=3的数据,也应该出现在结果里,但是没有出现,是因为null判断之后返回null值,比如:

select null not in ("tag1","tag2"); -- 返回null值
select coalesce(null,"") not in ("tag1","tag2"); -- 返回true

所以避免上述情况发生,需要使用判断进行处理,比如如果为NULL值,则取值空字符串。

在聚合数据时使用null值

一般使用聚合函数时,需要特别注意聚合的字段是否包含null值。当然,如果是求和,比如sum,应该不会有所影响,因为null值不参与求和。但是,在我们求平均值的时候,需要格外注意null值,看下面的例子:

当我们对amount求平均时:

SELECTavg(amount) as avg_amount
FROM orders

上面的结果会是什么呢?是150还是100呢?答案是:(150+150)/2=150,这个数据显示不是正确的,因为忽略了一行数据,解决上述问题我们可以使用判断当为null值时,取值0,,比如:

SELECTavg(coalesce(amount,0)) as avg_amount
FROM orders
-- 结果为(150+150+0)/3=100

求平均值时使用判断条件

还有一种情况是,当我们使用条件判断进行求平均值时,也要加以小心,稍不留神就会得到错误的结果,看下面的例子:如下表

当我们使用条件判断,求平均值时:

SELECT
avg(if(status = 1,amount,0)) as avg_complete_amount
FROM orders

猜一下上面的结果会是什么呢?100还是150呢?答案是100,这个结果显然不是我们想要的,因为status=1的数据只有两行,正确结果应该是:(150+150)/2=150.

那么怎么才能得到上面的结果呢?因为null值不参与计算,所以我们可以通过判断,当不满足条件时,取null值即可,SQL如下:下面SQL的判断是:if(status = 1,amount,null),这样就可以输出正确结果150了。

SELECT
avg(if(status = 1,amount,null)) as avg_complete_amount
FROM orders

滤条件中使用and和or

当我们使用一个复杂的条件语句时,很容易犯一个运算符优先级的错误。其中最为常见的就是:当编写SQL时,and先于or进行处理

比如有下面的表:

当我们要查询,用户等级rating为A或者B时,并且amount大于100的数据时:

SELECT*
FROMuser_amount
WHERE rating = "A" OR rating = "B" AND amount > 100;

上面的结果会输出:

1       A       50
4       A       150
5       B       126

很显然结果是错误的,这是什么原因的,细心的你会发现,由于AND条件的优先级高于OR,所以上面的SQL语句会先筛选条件为rating = "B" AND amount > 100的数据,然后在筛选条件为**rating = "A"**的数据。解决上面的问题只需要加一个括号,区分一下优先级即可。如下:

SELECT
*
FROM
user_amount
WHERE (rating = "A" OR rating = "B") AND amount > 100;
-- 结果为:
4       A       150
5       B       126

查询的列字段之间缺少逗号分隔

如果不细心,会造成这种情况出现,就是一个字段作为了前面字段的别名,比如:

SELECTclo1,clo2 clo3
FROM tbl

上面的sql语句是可以被执行的,但是结果是col2的值对应的别名为clo3,并且数据会少一列,会让人感觉很诧异。

inner join与left join

这种情况一般在没有搞清楚表之间的关系时,或者主表选择不清楚时会出现,一旦使用了错误的JOIN类型,得到的结果可能会多也可能会少。所以在进行连接查询时,区分JOIN类型也是值得注意的,下图是JOIN类型之间的区别。

总结

本文主要分享了一些书写SQL时常见的隐含错误,在平时的工作中应当尽量注意避免,希望本文对你有所帮助。

Hive SQL使用过程中的奇怪现象​mp.weixin.qq.com数仓面试|四个在工作后才知道的SQL密技​mp.weixin.qq.com数仓规范|使SQL更易于阅读的几个小技巧​mp.weixin.qq.comSQL查询的底层运行原理分析​mp.weixin.qq.com

区分错误类型_数仓|几种SQL隐藏的错误,你遇到过吗?相关推荐

  1. select隐藏_数仓|几种SQL隐藏的错误,你遇到过吗?

    本文分享主要描述了几种书写SQL时常见的一些隐藏错误,主要包括:在运算符中使用null值.在聚合数据时使用null值.求平均值时使用判断条件.滤条件中使用and和or.查询的列字段之间缺少逗号分隔.i ...

  2. sql order by 降序_数仓面试|四个在工作后才知道的SQL密技

    SQL是大数据从业者的必备技能,大部分的大数据技术框架也都提供了SQL的解决方案.可以说SQL是一种经久不衰.历久弥新的编程语言.尤其是在数仓领域,使用SQL更是家常便饭.本文会分享四个在面试和工作中 ...

  3. 每天和琦琦学点新知识_大数据_数仓分析

    数仓分析 ShopXO免费开源商城系统.国内领先企业级B2C免费开源电商系统,包含PC.h5.微信小程序.支付宝小程序.百度小程序.头条&抖音小程序.QQ小程序.APP.多商户,遵循MIT开源 ...

  4. 数仓 调度_数仓调度研究-总论

    作为一个IT从业不满三年的菜鸟,可能写类似总结性的文章还是比较费力,但是我还是想尝试写一篇比较出色总结,那么我讲从数据调度N个方面依次详细讲述ETL调度问题. 回答内容如下: 1.什么是数据调度 2. ...

  5. 参数构造错误 微信_快速掌握前端开发中的常见错误

    前言 今天我们来了解一下现在浏览器中支持的一些Error对象,如果你还在经常在捕获到错误的时候不知道该用哪个类型,总是习惯于去throw new Error('xx')的话,相信本文会帮你对error ...

  6. ios 打印 详细错误日志_【专家专栏】林相宇 | IOS错误日志抓取和分析

    原标题:[专家专栏]林相宇 | IOS错误日志抓取和分析 在调试自己和别人的IOS App时,发生Crash是非常正常的情况,分析这些Crash的主要手段之一就是分析Crash发生时产生的错误日志.对 ...

  7. 区分错误类型_汽车轮胎更换标准轮胎类型选择方式-详解

    汽车轮胎在用车过程中要注意两方面的检查. 磨损极限 老化极限 轮胎的磨损极限会通过胎冠内部的凸起点,以及侧壁胎肩位置的三角形指示符号标注.两个标准达到其中任何一项后,轮胎都要考虑更换或者四轮对调.部分 ...

  8. 区分错误类型_牛鹭学院:Bug类型解析及其常见实例介绍

    软件测试中,bug的类型有很多种,比如:代码错误.界面优化.设计缺陷.需求补充和用户体验等:一般情况下,需求补充和设计缺陷比较好区分,但是代码错误.界面优化和用户体验区分不是很明显:下面我们就来说说这 ...

  9. 区分错误类型_形象解释 Python 新手最容易犯的错误

    点击上方"Python编程时光",选择"加为星标"第一时间关注Python技术干货! 一.画蛇添足:多余的分号 Python语言与大多数编程语言不相同,它的语句 ...

最新文章

  1. 人工脑连接体:类脑人工智能的奇点时刻来临
  2. python对话框代码_Python、tkinter、复杂对话框和代码结构
  3. matlab mingw 32,Matlab 2017b MinGW-w64 5.3安裝
  4. 如何实现SSH断开后 进程仍然在后台运行
  5. NHibernate官方文档中文版——批量插入(Batch inserts)
  6. 如何在Win7 x64上的配置32位的PostgreSQL ODBC数据源
  7. 谈谈全自动安装常使用的pip install的原理及作用!!!
  8. 三星note10 android q,【极光ROM】-【三星NOTE10/NOTE10+/5G N97XX-9825】-【V8.0 Android-Q-TJ4】...
  9. Nginx优化---防盗链--网页缓存--网页压缩--日志分割
  10. QCLOUD APIGATEWAY HTTP header字段整理
  11. C语言报错警告合集(转)
  12. 高纯度高活性艾美捷人重组MEGACD40L蛋白(可溶性)
  13. javaweb指导书
  14. Python与正则表达式
  15. bootstrap的引入和使用
  16. html页面插入百度谷歌地图的方法
  17. 批处理bat 延时启动的方法
  18. P4844 LJJ爱数数 数论
  19. bzoj 4398: 福慧双修(最短路建模/构造)
  20. 下载国外大数据库不用愁

热门文章

  1. 实验五 — — Java网络编程及安全
  2. 排序算法Java实现(基数排序)
  3. PyTorch中Tensor的基本用法与动手学深度学习的预备知识
  4. 计算机网络之Web应用
  5. maven安装与项目创建
  6. java用循环语法在窗体中显示文字,如果子窗体在窗体视图中,则访问2003循环当前页面不起作用...
  7. sqlite查询乘以某列如果是null就换成_大数据之Hive group by with cube/rollup分组查询...
  8. java图片压缩不失真_软件分享 | Lit图片压缩
  9. C语言二维数组找出交集,【leetcode C语言实现】剑指 Offer 04. 二维数组中的查找...
  10. 贪心算法+回溯算法+动态规划