阿⾥巴巴SQL规范(⾮优化)
⼀、SQL 规约
1. 【强制】不要使⽤ count(列名)或 count(常量)来替代 count(*),count(*)是 SQL92 定义的 标准统计⾏数的语法,跟数据库⽆关,跟NULL 和⾮ NULL ⽆关。 说明:count(*)会统计值为 NULL 的⾏,⽽ count(列名)不会统计此列为 NULL 值的⾏。
2. 【强制】count(distinct col) 计算该列除 NULL 之外的不重复⾏数,注意 count(distinct col1, col2) 如果其中⼀列全为 NULL,那么即使另⼀列有不同的值,也返回为 0。
3. 【强制】当某⼀列的值全是 NULL 时,count(col)的返回结果为 0,但 sum(col)的返回结果为 NULL,因此使⽤ sum()时需注意 NPE 问题。
正例:可以使⽤如下⽅式来避免 sum 的 NPE 问题:
SELECT IF(ISNULL(SUM(g)),0,SUM(g)) FROM table;
sqljoinon多个条件SELECT COALESCE(SUM(要sum的字段),0) FROM table;
解释:
coalesce()解释:返回参数中的第⼀个⾮空表达式(从左向右)如果sum为空,则显⽰后⾯那个0
4. 【强制】使⽤ ISNULL()来判断是否为 NULL 值。注意:NULL 与任何值的直接⽐较都为 NULL。 说明: 1) NULL<>NULL 的返回结果是 NULL,⽽不是 false。 2) NULL=NULL 的返回结果是 NULL,⽽不是 true。 3) NULL<>1 的返回结果是 NULL,⽽不是true。
mysql语句的执行顺序5. 【强制】 在代码中写分页查询逻辑时,若 count 为 0 应直接返回,避免执⾏后⾯的分页语句。
cluster(id)6. 【强制】不得使⽤外键与级联,⼀切外键概念必须在应⽤层解决。 说明:(概念解释)学⽣表中的 student_id 是主键,那么成绩表中的 student_id 则为外键。 如果更新学⽣表中的 student_id,同时触发成绩表中的 student_id 更新,则为级联更新。 外键与级联更新适⽤于单机低并发,不适合分布式、⾼并发集;级联更新是强阻塞,存在数 据库更新风暴的风险;外键影响数据库的插⼊速度。
7. 【强制】禁⽌使⽤存储过程,存储过程难以调试和扩展,更没有移植性。
8. 【强制】数据订正时,删除和修改记录时,要先 select,避免出现误删除,确认⽆误才能执 ⾏更新语句。
9. 【推荐】in 操作能避免则避免,若实在避免不了,需要仔细评估 in 后边的集合元素数量,控 制在 1000 个之内。
10. 【参考】如果有全球化需要,所有的字符存储与表⽰,均以 utf-8 编码,那么字符计数⽅法 注意: 说明: SELECT LENGTH("轻松⼯作"); 返回为 12 SELECT CHARACTER_LENGTH("轻松⼯作"); 返回为 4 如果要使⽤表情,那么使⽤ utfmb4 来进⾏存储,注意它与 utf-8 编码的区别。
11. 【参考】 TRUNCATE TABLE ⽐ DELETE 速度快,且使⽤的系统和事务⽇志资源少,但 TRUNCATE ⽆事务且不触发 trigger,有可能造成事故,故不建议在开发代码中使⽤此语句。 说明:TRUNCATE TABLE 在功能上与不带 WHERE ⼦句的 DELETE 语句相同。 ⼆、 ORM 规约
1. 【强制】在表查询中,⼀律不要使⽤ * 作为查询的字段列表,需要哪些字段必须明确写明。
说明:1)增加查询分析器解析成本。
2)增减字段容易与 resultMap 配置不⼀致。
2. 【强制】POJO 类的 Boolean 属性不能加 is,⽽数据库字段必须加 is_,要求在 resultMap 中 进⾏字段与属性之间的映射。
说明:参见定义 POJO 类以及数据库字段定义规定,在<resultMap>中增加映射,是必须的。 在 MyBatis Generator ⽣成的代码中,需要进⾏适当的修改。
3. 【强制】不要⽤ resultClass 当返回参数,即使所有类属性名与数据库字段⼀⼀对应,也需 要定义;反过来,每⼀个表也必然有⼀个与之对应。 说明:配置映射关系,使字段与 DO 类解耦,⽅便维护。
4. 【强制】xml 配置中参数注意:#{},#param# 不要使⽤${} 此种⽅式容易出现 SQL 注⼊。
activecell5. 【强制】iBATIS ⾃带的 queryForList(String statementName,int start,int size)不推 荐使⽤。
说明:其实现⽅式是在数据库取到statementName对应的SQL语句的所有记录,再通过subList 取 start,size 的⼦集合,线上因为这个原因曾经出现过 OOM(程序申请内存过⼤,虚拟机⽆法满⾜我们,然后⾃杀了。)。
正例:在 l 中引⼊ #start#, #size# Map<String, Object> map = new HashMap<String, Object>();
map.put("start", start); map.put("size", size);
解释:
OOM:程序申请内存过⼤,虚拟机⽆法满⾜我们,然后⾃杀了。通俗来讲就是我们的APP需要申请⼀
块内存来存放图⽚的时候,系统认为我们的程序需要的内存过⼤,及时系统有充分的内存,⽐如1G,但是系统也不会分配给我们的APP,故⽽抛出OOM异常,程序没有捕捉异常,故⽽弹窗崩溃了.
6. 【强制】不允许直接拿 HashMap 与 Hashtable 作为查询结果集的输出。
7. 【强制】更新数据表记录时,必须同时更新记录对应的 gmt_modified 字段值为当前时间。
8. 【推荐】不要写⼀个⼤⽽全的数据更新接⼝,传⼊为 POJO 类,不管是不是⾃⼰的⽬标更新字 段,都进⾏ update table set
c1=value1,c2=value2,c3=value3; 这是不对的。执⾏ SQL 时,尽量不要更新⽆改动的字段,⼀是易出错;⼆是效率低;三是增加binlog 存储。
9. 【参考】@Transactional 事务不要滥⽤。事务会影响数据库的 QPS,另外使⽤事务的地⽅需 要考虑各⽅⾯的回滚⽅案,包括缓存回滚、搜索引擎回滚、消息补偿、统计修正等。
解释:
QPS(Queries Per Second意思是“每秒查询率”,是⼀台服务器每秒能够相应的查询次数,是对⼀个特定的查询服务器在规定时间内所处理流量多少的衡量标准。)
10. 【参考】<isEqual>中的 compareValue 是与属性值对⽐的常量,⼀般是数字,表⽰相等时带 上此条件;<isNotEmpty>表⽰不为空且不为 null 时执⾏;<isNotNull>表⽰不为 null 值时 执⾏。
三、索引规约
1. 【强制】业务上具有唯⼀特性的字段,即使是组合字段,也必须建成唯⼀索引。 说明:不要以为唯⼀索引影响了 insert 速度,这个速度损耗可以忽略,但提⾼查速度是明显的;另外,即使在应⽤层做了⾮常完善的校验控制,只要没有唯⼀索引,根据墨菲定律,必 然有脏数据产⽣。
2. 【强制】 超过三个表禁⽌ join。需要 join 的字段,数据类型必须绝对⼀致;多表关联查询 时,保证被关联的字段需要有索引。 说明:即使双表 join 也要注意表索引、SQL 性能。
3. 【强制】在 varchar 字段上建⽴索引时,必须指定索引长度,没必要对全字段建⽴索引,根据 实际⽂本区分度决定索引长度即可。 说明:索引的长度与区分度是⼀对⽭盾体,⼀般对字符串类型数据,长度为 20 的索引,区分 度会⾼达 90%以上,可以使⽤ count(distinct left(列名, 索引长度))/count(*)的区分度 来确定。
4. 【强制】页⾯搜索严禁左模糊或者全模糊,如果需要请⾛搜索引擎来解决。 说明:索引⽂件具有 B-Tree 的最左前缀匹配特性,如果左边的值未确定,那么⽆法使⽤此索 引。
5. 【推荐】如果有 order by 的场景,请注意利⽤索引的有序性。order by 最后的字段是组合 索引的⼀部分,并且放在索引组合顺序的最后,避免出现 file_sort 的情况,影响查询性能。 正例:where a=? and b=? order by c; 索引:a_b_c 反例:索引中有范围查,那么索引有序性⽆法利⽤,如:WHERE a>10 ORDER BY b; 索引 a_b ⽆法排序。
6. 【推荐】利⽤覆盖索引来进⾏查询操作,避免回表。 说明:如果⼀本书需要知道第 11 章是什么标题,会翻开第 11 章对应的那⼀页吗?⽬录浏览 ⼀下就好,这个⽬录就是起到覆盖索引的作⽤。 正例:能够建⽴索引的种类:主键索引、唯⼀索引、普通索引,⽽覆盖索引是⼀种查询的⼀种 效果,⽤ explain 的结果,extra 列会出现:using index。
7. 【推荐】利⽤延迟关联或者⼦查询优化超多分页场景。 说明:MySQL 并不是跳过 offset ⾏,⽽是取 offset+N ⾏,然后返回放弃前offset ⾏,返回 N ⾏,那当 offset 特别⼤的时候,效率就⾮常的低下,要么控制返回的总页数,要么对超过 特定阈值的页数进⾏ SQL
改写。 正例:先快速定位需要获取的 id 段,然后再关联: SELECT a.* FROM 表 1 a, (select id from 表 1 where 条件 LIMIT 100000,20 ) b where a.id=b.id
oracle 11g 官方文档8. 【推荐】 SQL 性能优化的⽬标:⾄少要达到 range 级别,要求是 ref 级别,如果可以是 consts 最好。
说明:
1)consts 单表中最多只有⼀个匹配⾏(主键或者唯⼀索引),在优化阶段即可读取到数据。
2)ref 指的是使⽤普通的索引(normal index)。
java split函数3)range 对索引进⾏范围检索。 反例:explain 表的结果,type=index,索引物理⽂件全扫描,速度⾮常慢,这个 index 级别⽐较 range 还低,与全表扫描是⼩巫见⼤巫。
9. 【推荐】建组合索引的时候,区分度最⾼的在最左边。 正例:如果 where a=? and b=? ,a 列的⼏乎接近于唯⼀值,那么只需要单建idx_a 索引即 可。 说明:存在⾮等号和等号混合判断条件时,在建索引时,请把等号条件的列前置。如:where a>? and b=? 那么即使 a 的区分度更⾼,也必须把 b 放在索引的最前列。
10. 【参考】创建索引时避免有如下极端误解: 1)误认为⼀个查询就需要建⼀个索引。 2)误认为索引会消耗空间、严重拖慢更新和新增速度。 3)误认为唯⼀索引⼀律需要在应⽤层通过“先查后插”⽅式解决。
版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系QQ:729038198,我们将在24小时内删除。
发表评论