血一般的教训,请慎用Insert Into Select

IT科技类资讯2025-11-05 14:07:422373

 图片来自 Pexels 

事情的血般训请起因

公司的交易量比较大,使用的慎用数据库是 MySQL,每天的血般训请增量差不多在百万左右,公司并没有分库分表,慎用所以想维持这个表的血般训请性能只能考虑做数据迁移。

同事李某接到了这个任务,慎用于是血般训请他想出了这两个方案:

先通过程序查询出来,然后插入历史表,慎用再删除原表。血般训请 使用 insert into select 让数据库 IO 来完成所有操作。慎用

第一个方案使用的血般训请时候发现一次性全部加载,系统直接就 OOM 了,慎用但是血般训请分批次做就过多 IO 和时间长,于是慎用选用了第二种方案,测试的血般训请时候没有任何问题,开开心心上线,然后被开除。

到底发生了啥?我们复盘一下。

先来看第一个方案,先看伪代码:

// 1、查询对应需要迁移的数据 List<Object> list = selectData(); // 2、将数据插入历史表 insertData(list); // 3、IT技术网删除原表数据 deleteByIds(ids);

我们可以从这段代码中看到,OOM 的原因很简单,我们直接将数据全部加载内存,内存不爆才怪。

再来看看第二个方案,到底发生了啥?

为了维持表的性能,同时保留有效数据,经过商量定了一个量,保留 10 天的数据,差不多要在表里面保留 1kw 的数据。

所以同事就做了一个时间筛选的操作,直接 insert into select ... dateTime < (Ten days ago)...

爽极了,直接就避免了要去分页查询数据,这样就不存在 OOM 啦。还简化了很多的代码操作,减少了网络问题。

为了测试,还特意建了 1kw 的数据来模拟,测试环境当然是没有问题啦,顺利通过。

考虑到这个表是一个支付流水表,于是将这个任务做成定时任务,并且定在晚上 8 点执行。云南idc服务商

晚上量也不是很大,自然是没有什么问题,但是第二天公司财务上班,开始对账,发现资金对不上,很多流水都没有入库。

最终排查发现晚上 8 点之后,陆陆续续开始出现支付流水插入失败的问题,很多数据因此丢失。

最终定位到了是迁移任务引起的问题,刚开始还不明所以,白天没有问题,然后想到晚上出现这样的情况可能是晚上的任务出现了影响,最后停掉该任务的第二次上线,发现没有了这样的情况。

复盘

问题在哪里?为什么停掉迁移的任务之后就好了呢?这个 insert into select 操作到底做了什么?

我们来看看这个语句的 explain:

 

我们不难从图中看出,这个查询语句直接走了全表扫描。这个时候,我们不难猜想到一点点问题。

如果全表扫描,源码库我们这个表这么大,是不是意味着迁移的时间会很长?假若我们这个迁移时间为一个小时,那是不是意味着就解释了我们白天没有出现这样问题的原因了。但是全表扫描是最根本的原因吗?

我们不妨试试,一边迁移,一边做些的操作,还原现场。最终还是会出现这样的问题。

这个时候,我们可以调整一下,大胆假设,如果不全表扫描,是不是就不会出现这样的问题。当我们将条件修改之后,果然发现没有走了全表扫描了。

最终再次还原现场,问题解决了:

 

得出结论:全表扫描导致了这次事故的发生。这样做就解决了发生的问题,但是做为陆陆续续开始失败这个就不好解释了。

原因

在默认的事务隔离级别下:insert into a select b 的操作 a 表示直接锁表,b 表是逐条加锁。这也就解释了为什么出现陆续的失败的原因。

在逐条加锁的时候,流水表由于多数是复合记录,所以最终部分在扫描的时候被锁定,部分拿不到锁,最终导致超时或者直接失败,还有一些在这加锁的过程中成功了。

为什么测试没有问题?

在测试的时候充分的使用了正式环境的数据来测试,但是别忽视一个问题,那就是测试环境毕竟是测试环境,在测试的时候,数据量真实并不代表就是真实的业务场景。

比方说,这个情况里面就少了一个迁移的时候,大量数据的插入这样的情况。最终导致线上 Bug。

解决办法

既然我们避免全表扫描就可以解决,我们避免它就行了。想要避免全表扫描,对 where 后面的条件做索引,让我们的 select 查询都走索引即可。

insert into 还能用吗?回答是:当然可以。

总结

使用 insert into select 的时候请慎重,一定要做好索引。

作者:xlecho

编辑:陶家龙

出处:https://juejin.cn/post/6931890118538199048 

本文地址:http://www.bzuk.cn/html/59b38099560.html
版权声明

本文仅代表作者观点,不代表本站立场。
本文系作者授权发表,未经许可,不得转载。

热门文章

全站热门

Ubuntu的root默认是禁止使用的,在安装的时候也没要求你设置root的密码,和红帽系统系列这里是不同的。要在Ubuntu下使用root,我们可以使用终端给root设置密码 sudo passwd root 假如只是普通用户密码忘了,用root就可以修改。假如root都忘记了,就进入单用户模式,这里跟红帽系统系列也不同。 具体方法如下: 进入单用户模式: #1,开机进入grub时,用上下键移到第二行的恢复模式,按e(注意不是回车) #2, 把ro single 改成rw single init=/bin/bash , 然后按ctrl+x,就可以进入 单用户模式,进去干什么都行了。(进去是命令行,所以你得要懂使用命令行!)我们可以修改普通用户密码,也可以改root密码。提示,完成后,按”ctrl+alt+delete“组合神键重启(我试过用命令关机,重启都不行,只能用这个)。 这些我都是试过的,也是成功的,你试试吧!我看过一些网上的一些方法,也试过,是不行的!一些是用红帽系统系列的方法,一些是某个步骤不对! 修改普通用户密码,命令如下格式: passwd 用户名

缤果交友,缔造真挚友谊(探索新的社交方式,让缘分聚焦于心灵契合)

铁三角CKR5耳机的音质评测(探究CKR5耳机的声音表现和品质特点)

以拍脸效果怎么样?(拍脸效果的实际效果与体验分享)

Ubuntu系统下的网络设置,包括多种:设置双网卡、单网卡绑定多IP等,这里面大家要实现的是最基本的网络设置。 sudo su gedit /etc/network/interfaces 文件内容: auto lo iface lo inet loopback auto eth0 ##这个应该是决定是否启用这个端口 iface eth0 inet static ##静态设置IP hwaddress ether 52:54:xx:51:xx:xx ##加入MAC地址,记得要放在IP地址之前 address 202.198.151.17 netmask 255.255.255.0 #broadcast 202.198.151.255 gateway 202.198.151.254 ##通过dhcp动态设置 iface eth1 inet dhcp 设置MAC地址的映射关系 gedit /etc/iftab 加入一行 eth1 mac 52:54:xx:51:xx:xx 设置DNS服务器 sudo vi /etc/resolv.conf 内容 nameserver 202.198.125.255 重新设置网络,以启用新设置 sudo /etc/init.d/networking restart

红杉娱乐(红杉娱乐公司的发展历程与创新业务模式)

尼康D90相机详细评测(一款功能强大的中级单反相机)

肯高偏振镜的优势与应用(解密肯高偏振镜的工作原理及广泛应用领域)

友情链接

滇ICP备2023006006号-33