MySQL用错了,99%的人已中招(mysqluse)
zhezhongyun 2025-05-05 20:09 41 浏览
在我们日常工作中,可能会经常使用MySQL数据库,因为它是开源免费的,而且性能还不错。
在国内的很多公司中,经常被使用。
但我们在MySQL使用过程中,也非常容易踩坑,不信继续往下看。
今天这篇文章重点跟大家一起聊一聊使用 MySQL 的15个坑,希望对你会有所帮助。
1查询不加where条件
有些小伙伴,希望在代码中,一次性把表中的所有数据都查出来,然后在内存中处理业务逻辑,认为代码性能更好。
反例:
SELECT * FROM users;在查询数据的时候不加where条件。
这种情况下数据量小还好。
但如果数据量很大,每个业务操作,都需要查出表中的所有数据,可能会导致程序出现OOM问题。
如果数据太多,处理速度也会集聚下降。
正例:
SELECT * FROM users WHERE code = '1001';使用具体的where查询条件,比如code字段,先过滤数据,再做处理。
2 没有使用索引
有时候,我们的程序,在刚上线的时候,数据比较少,没有加索引,问题不大。
但随着用户量越来越多,表中数据在呈指数级的增加。
突然有一天发现,查询数据变慢了。
例如:
SELECT * FROM users WHERE code = '1001';我们可以给customer_id字段加个索引:
CREATE INDEX idx_customer ON orders(customer_id);这能大大提升速度!
3 不处理 NULL 值
问题描述:统计时忘了 NULL 的影响,以为结果准确,结果却大相径庭。
反例:
CREATE INDEX idx_customer ON orders(customer_id);这些只能统计name字段非NULL的数量。
其实,没有统计完全。
如果想统计所有的记录行数,我们可以使用COUNT(*)。
正例:
SELECT COUNT(*) FROM users;这样就能统计所有行数。
4 数据类型选错
有些小伙伴,在创建表时,随意使用 VARCHAR(255),会导致性能低下,还浪费存储。
反例:
CREATE TABLE products (
    id INT,
    status VARCHAR(255) 
);这种情况的性能不佳。
我们可以将status字段该成tinyint类型:
CREATE TABLE products (
    id INT,
    status tinyint(1) DEFAULT '0' COMMENT '状态 1:有效 0:无效'
);更节省空间。
5 深分页问题
我们在日常工作中,经常会遇到需要分页查询数据的场景。
我们一般会使用limit关键字。
例如:
SELECT * FROM users LIMIT 0,10;  如果数据多的时候,第一页、第二页、第三页可能查询性能还OK。
但如果查询到第10万页,可能查询性能,就会变得非常差。
这就出现了深分页问题。
如何解决深分页问题?
5.1 记录上一次的id
我们现在的主要问题是,在分页的查询过程中,假如要查询第10万页的数据,要先扫描第9万9999页的数据。
但如果我们把上一次查询的位置记录下,后面再查询下一页的时候,就可以直接从之前的位置开始,往后查询。
例如下面这样的:
select id,name where order 
where id>1000000 limit 100000,10上一次查询获取到的最大的id是1000000,那么本次查询直接从1000000的下一个位置开始查询。
这样就可以不用查询前面的数据,提升不少的查询效率。
但这套方案有两个需要注意的地方:
需要记录上一次的查询出的id,适合上一页或下一页的场景,不适合随机查询到某一页。需要id字段是自增的。
5.2 使用子查询
先用子查询查询出符合条件的主键,再用主键id做条件查出所有字段。
select * from order where id in (
 select id from (
  select id from order where time>'2024-08-11' limit 100000, 10
 ) t
)这样子查询中,可以走覆盖索引。
我们之前的SQL,查询10条数据,但需要回表100010次。
实际上,我们只需要查询10条数据,也就是我们只需要10次回表其实就够了。
通过子查询的方式,能够减少回表的次数。
因此,我们可以通过减少回表次数来优化深分页的问题。
5.3 使用inner join关联查询
根据子查询类似:
select * from order o1
inner join (
   select id from order 
    where create_time>'2024-08-11' 
    limit 100000,10
) as o2 on o1.id=o2.id;在inner join子语句中,也是先通过查询条件和分页条件过滤数据,返回id。
然后再通过id做关联查询。
可以减少回表的次数,从而提升查询速度。
最近就业形势比较困难,为了感谢各位小伙伴对苏三一直以来的支持,我特地创建了一些工作内推群, 看看能不能帮助到大家。
你可以在群里发布招聘信息,也可以内推工作,也可以在群里投递简历找工作,也可以在群里交流面试或者工作的话题。
6 没有用explain分析查询
有些现在sql语句,查询慢,却不去分析执行计划,结果就只能盲目优化。
正例:
EXPLAIN SELECT * FROM users WHERE email = 'test@example.com';EXPLAIN 会告诉你查询是怎么执行的,帮助你找到瓶颈。
如果大家想进一步了解explain关键字,可以看看我的另一篇文章《SQL性能优化神器》,里面有非常详细的介绍。
7 字符集设置不当
有些小伙伴,喜欢将MySQL的字符集设置成utf8。
我几年之前也喜欢这干。
但后面出现问题了,比如在用户评价输入框中,用户输入了表情符合,可能会直接导致程序保存。
字符集设置错误,也可能会导致汉字变乱码,用户体验直线下滑。
正例:
CREATE TABLE messages (
    id INT,
    content TEXT
) CHARACTER SET utf8mb4; 建议大家在建表时,将字符集设置成使utf8mb4,它能够支持更多的字符,包括:常用中文汉字和一些表情符号。
8 SQL注入风险
用拼接 SQL 的方式,容易被 SQL 注入攻击,安全隐患大。
在一些自定义排序规则,使用order by 动态拼接用户选择的排序字段,或者排序方式,比如:升序或降序时,如果处理不好,就可能会出现SQL注入问题。
反例:
String query = "SELECT * FROM users WHERE email = '" + userInput + "';";尽量少在sql中直接拼接字符串,而应该使用PreparedStatement预编译的方式。
正例:
PreparedStatement stmt = connection.prepareStatement("SELECT * FROM users WHERE email = ?");
stmt.setString(1, userInput);在MyBatis中在使用$符号赋值时要注意,最好使用#符号赋值。
如果大家对sql注入问题比较感兴趣,可以看看我的另一篇文章《卧槽,sql注入竟然把我们的系统搞挂了》,里面有非常详细的介绍。
9 事务问题
有些小伙伴,在日常工作中,写代码时可能会忘掉事务。
特别是在更新多个表时不使用事务,数据容易出现不一致的情况。
反例:
UPDATE accounts SET balance = balance - 100 WHERE id = 1;
UPDATE accounts SET balance = balance + 100 WHERE id = 2;用户1给用户2转账100元,如果不用事务,可能会出现用户1转出了100,用户2却没收到的情况。
我们使用使用START TRANSACTION命令开启事务,使用COMMIT命令提交事务。
正例:
START TRANSACTION;
UPDATE accounts SET balance = balance - 100 WHERE id = 1;
UPDATE accounts SET balance = balance + 100 WHERE id = 2;
COMMIT;  这样如果用户1转出100成功了,但用户2转入100失败了,则用户1的数据会回滚。
在Spring中可以使用@Transactional注解声明式事务,或者使用TransactionTemplate类这种编程式事务。
建议优先使用TransactionTemplate这种编程式事务。
10 校对规则问题
我们的表和字段上,有个COLLATE参数,可以配置校对规则。
它主要包含了三种:
- 以_ci结尾的。
 - 以_bin结尾的。
 - 以_cs结尾的。
 
ci是case insensitive的缩写,意思是大小写不敏感,即忽略大小写。
cs是case sensitive的缩写,意思是大小写敏感,即区分大小写。
还有一种是bin,它是将字符串中的每一个字符用二进制数据存储,区分大小写。
使用最多的是 utf8mb4_general_ci(默认的)和 utf8mb4_bin。
我们的brand表在创建表的时候,使用的COLLATE是utf8mb4_general_ci,它不区分大小写。
CREATE TABLE `brand` (
  `id` bigint NOT NULL AUTO_INCREMENT COMMENT 'ID',
  `name` varchar(30) NOT NULL COMMENT '品牌名称',
  `create_user_id` bigint NOT NULL COMMENT '创建人ID',
  `create_user_name` varchar(30) NOT NULL COMMENT '创建人名称',
  `create_time` datetime(3) DEFAULT NULL COMMENT '创建日期',
  `update_user_id` bigint DEFAULT NULL COMMENT '修改人ID',
  `update_user_name` varchar(30)  DEFAULT NULL COMMENT '修改人名称',
  `update_time` datetime(3) DEFAULT NULL COMMENT '修改时间',
  `is_del` tinyint(1) DEFAULT '0' COMMENT '是否删除 1:已删除 0:未删除',
  PRIMARY KEY (`id`) USING BTREE
) ENGINE=InnoDB DEFAULT CHARSET=utf8mb4 COLLATE=utf8mb4_unicode_ci  COMMENT='品牌表';这样在使用下面sql语句查询数据时:
select * from brand where `name`='yoyo';就能把大写的YOYO查出来。
如果我们的表中设置的COLLATE是不区分大小写,但是业务代码中,却区分了大小写,二者不一致,就可能会出问题。
这时候,在业务代码中,就不能直接使用equals方法判断字符串是否相同,而应该改成equalsIgnoreCase方法了。
11 使用过多的 SELECT *
有些小伙伴,在写的sql语句中,习惯性使用select *,一次性查询所有的字段。
反例:
SELECT * FROM orders;  这种做法每次都会查出很多没用的字段,不仅浪费带宽,也增加了查询开销。
好的做法是,每次只查询要用到的字段。
正例:
SELECT id, total FROM orders;  我们的业务中,只需要用到id和total字段的数据,其他的字段就可以无需查询。
12 索引失效
不知道你有没有遇到过,生成环境明明创建了索引,但数据库在执行SQL的过程中,索引竟然失效了。
由于索引失效,让之前原本很快的操作,一下子变得很慢,影响了接口的性能。
我们可以通过explain关键字,查看sql的执行计划,可以确认索引是否失效。
如果索引失效了,可能是哪些原因导致的问题呢?
下面这张图给大家列举了常见原因:
想进一步了解索引失效问题的小伙伴,可以看一下我的另一篇文章《聊聊索引失效的10种场景,太坑了》,里面有非常详细的介绍。
13 频繁修改表或数据
在高并发场景下,频繁添加、修改字段,或者批量更新数据,导致系统性能下降。
我们在使用alter添加或者修改表字段,或者使用update批量更新,或者使用delete批量删除数据时,都可能会锁表。
如果此时正好有大量的用户请求过来了,会导致系统响应变慢。
在高并发场景下,update或者delete的数据量,不要太多,可以分批,多次执行。
对于一些alter或drop修改表结构的操作,应该避免在用户高峰期执行,最好选择在凌晨,用户少的时候执行。
此外,可以使用Percona Toolkit、gh-ost等在线工具,可以在不锁表的情况下,进行alter操作。
14 没有定期备份
在工作中,最怕遇到猪队友误删数据。
我遇到过好几次。
将测试环境的表中的数据全删了。
数据全没了就后悔,太晚了。
建议定期备份,使用mysqldump:
mysqldump -u root -p database_name > backup.sql我们可以写一个定时任务,每个一段时间,比如:一天或,备份一次数据。
后面如果哪天又被误删数据了,可以直接通过mysql命令,将数据还原。
15 忘了归档历史数据
有些小伙伴,经常吐槽,表中的历史数据太多,查询速度像蜗牛一样慢。
这时候,我们需要将历史数据归档了。
用户一般最关心的是最近:一个月、三个月、半年或者一年的数据。
他们极少会去查询一年以上的数据。
因此,建议将历史数据做归档。
在MySQL中只保存最新的数据,历史数据可以迁移到归档库中。
学习交流
最后,把我的座右铭送给你:投资自己才是最大的财富。 如果你觉得本文章对你有帮助,点赞,收藏不迷路
公众号:我不是架构师,持续为你输出更多的硬核文章和面试经验。
相关推荐
- Python入门学习记录之一:变量_python怎么用变量
 - 
        
写这个,主要是对自己学习python知识的一个总结,也是加深自己的印象。变量(英文:variable),也叫标识符。在python中,变量的命名规则有以下三点:>变量名只能包含字母、数字和下划线...
 
- python变量命名规则——来自小白的总结
 - 
        
python是一个动态编译类编程语言,所以程序在运行前不需要如C语言的先行编译动作,因此也只有在程序运行过程中才能发现程序的问题。基于此,python的变量就有一定的命名规范。python作为当前热门...
 
- Python入门学习教程:第 2 章 变量与数据类型
 - 
        
2.1什么是变量?在编程中,变量就像一个存放数据的容器,它可以存储各种信息,并且这些信息可以被读取和修改。想象一下,变量就如同我们生活中的盒子,你可以把东西放进去,也可以随时拿出来看看,甚至可以换成...
 
- 绘制学术论文中的“三线表”具体指导
 - 
        
在科研过程中,大家用到最多的可能就是“三线表”。“三线表”,一般主要由三条横线构成,当然在变量名栏里也可以拆分单元格,出现更多的线。更重要的是,“三线表”也是一种数据记录规范,以“三线表”形式记录的数...
 
- Python基础语法知识--变量和数据类型
 - 
        
学习Python中的变量和数据类型至关重要,因为它们构成了Python编程的基石。以下是帮助您了解Python中的变量和数据类型的分步指南:1.变量:变量在Python中用于存储数据值。它们充...
 
- 一文搞懂 Python 中的所有标点符号
 - 
        
反引号`无任何作用。传说Python3中它被移除是因为和单引号字符'太相似。波浪号~(按位取反符号)~被称为取反或补码运算符。它放在我们想要取反的对象前面。如果放在一个整数n...
 
- Python变量类型和运算符_python中变量的含义
 - 
        
别再被小名词坑哭了:Python新手常犯的那些隐蔽错误,我用同事的真实bug拆给你看我记得有一次和同事张姐一起追查一个看似随机崩溃的脚本,最后发现罪魁祸首竟然是她把变量命名成了list。说实话...
 
- 从零开始:深入剖析 Spring Boot3 中配置文件的加载顺序
 - 
        
在当今的互联网软件开发领域,SpringBoot无疑是最为热门和广泛应用的框架之一。它以其强大的功能、便捷的开发体验,极大地提升了开发效率,成为众多开发者构建Web应用程序的首选。而在Spr...
 
- Python中下划线 ‘_’ 的用法,你知道几种
 - 
        
Python中下划线()是一个有特殊含义和用途的符号,它可以用来表示以下几种情况:1在解释器中,下划线(_)表示上一个表达式的值,可以用来进行快速计算或测试。例如:>>>2+...
 
- 解锁Shell编程:变量_shell $变量
 - 
        
引言:开启Shell编程大门Shell作为用户与Linux内核之间的桥梁,为我们提供了强大的命令行交互方式。它不仅能执行简单的文件操作、进程管理,还能通过编写脚本实现复杂的自动化任务。无论是...
 
- 一文学会Python的变量命名规则!_python的变量命名有哪些要求
 - 
        
目录1.变量的命名原则3.内置函数尽量不要做变量4.删除变量和垃圾回收机制5.结语1.变量的命名原则①由英文字母、_(下划线)、或中文开头②变量名称只能由英文字母、数字、下画线或中文字所组成。③英文字...
 
- 更可靠的Rust-语法篇-区分语句/表达式,略览if/loop/while/for
 - 
        
src/main.rs://函数定义fnadd(a:i32,b:i32)->i32{a+b//末尾表达式}fnmain(){leta:i3...
 
- C++第五课:变量的命名规则_c++中变量的命名规则
 - 
        
变量的命名不是想怎么起就怎么起的,而是有一套固定的规则的。具体规则:1.名字要合法:变量名必须是由字母、数字或下划线组成。例如:a,a1,a_1。2.开头不能是数字。例如:可以a1,但不能起1a。3....
 
- Rust编程-核心篇-不安全编程_rust安全性
 - 
        
Unsafe的必要性Rust的所有权系统和类型系统为我们提供了强大的安全保障,但在某些情况下,我们需要突破这些限制来:与C代码交互实现底层系统编程优化性能关键代码实现某些编译器无法验证的安全操作Rus...
 
- 探秘 Python 内存管理:背后的神奇机制
 - 
        
在编程的世界里,内存管理就如同幕后的精密操控者,确保程序的高效运行。Python作为一种广泛使用的编程语言,其内存管理机制既巧妙又复杂,为开发者们提供了便利的同时,也展现了强大的底层控制能力。一、P...
 
- 一周热门
 
- 最近发表
 
- 标签列表
 - 
- HTML 教程 (33)
 - HTML 简介 (35)
 - HTML 实例/测验 (32)
 - HTML 测验 (32)
 - JavaScript 和 HTML DOM 参考手册 (32)
 - HTML 拓展阅读 (30)
 - HTML文本框样式 (31)
 - HTML滚动条样式 (34)
 - HTML5 浏览器支持 (33)
 - HTML5 新元素 (33)
 - HTML5 WebSocket (30)
 - HTML5 代码规范 (32)
 - HTML5 标签 (717)
 - HTML5 标签 (已废弃) (75)
 - HTML5电子书 (32)
 - HTML5开发工具 (34)
 - HTML5小游戏源码 (34)
 - HTML5模板下载 (30)
 - HTTP 状态消息 (33)
 - HTTP 方法:GET 对比 POST (33)
 - 键盘快捷键 (35)
 - 标签 (226)
 - opacity 属性 (32)
 - transition 属性 (33)
 - 1-1. 变量声明 (31)
 
 
