您当前的位置：首页 > 电脑百科 > 数据库 > 百科

血一般的教训，请慎用Insert Into Select

时间：2021-03-04 10:20:48 来源：作者：

+ 加入收藏

血一般的教训，请慎用 insert into select。同事应用之后，导致公司损失了近 10w 元，最终被公司开除。

图片来自 Pexels

事情的起因

公司的交易量比较大，使用的数据库是 MySQL，每天的增量差不多在百万左右，公司并没有分库分表，所以想维持这个表的性能只能考虑做数据迁移。

同事李某接到了这个任务，于是他想出了这两个方案：

先通过程序查询出来，然后插入历史表，再删除原表。
使用 insert into select 让数据库 IO 来完成所有操作。

第一个方案使用的时候发现一次性全部加载，系统直接就 OOM 了，但是分批次做就过多 IO 和时间长，于是选用了第二种方案，测试的时候没有任何问题，开开心心上线，然后被开除。

到底发生了啥?我们复盘一下。

先来看第一个方案，先看伪代码：

// 1、查询对应需要迁移的数据 
List<Object> list = selectData(); 
 
// 2、将数据插入历史表 
insertData(list); 
 
// 3、删除原表数据 
deleteByIds(ids);

我们可以从这段代码中看到，OOM 的原因很简单，我们直接将数据全部加载内存，内存不爆才怪。

再来看看第二个方案，到底发生了啥?

为了维持表的性能，同时保留有效数据，经过商量定了一个量，保留 10 天的数据，差不多要在表里面保留 1kw 的数据。

所以同事就做了一个时间筛选的操作，直接 insert into select ... dateTime < (Ten days ago)...

爽极了，直接就避免了要去分页查询数据，这样就不存在 OOM 啦。还简化了很多的代码操作，减少了网络问题。

为了测试，还特意建了 1kw 的数据来模拟，测试环境当然是没有问题啦，顺利通过。

考虑到这个表是一个支付流水表，于是将这个任务做成定时任务，并且定在晚上 8 点执行。

晚上量也不是很大，自然是没有什么问题，但是第二天公司财务上班，开始对账，发现资金对不上，很多流水都没有入库。

最终排查发现晚上 8 点之后，陆陆续续开始出现支付流水插入失败的问题，很多数据因此丢失。

最终定位到了是迁移任务引起的问题，刚开始还不明所以，白天没有问题，然后想到晚上出现这样的情况可能是晚上的任务出现了影响，最后停掉该任务的第二次上线，发现没有了这样的情况。

复盘

问题在哪里?为什么停掉迁移的任务之后就好了呢?这个 insert into select 操作到底做了什么?

我们来看看这个语句的 explain：

我们不难从图中看出，这个查询语句直接走了全表扫描。这个时候，我们不难猜想到一点点问题。

如果全表扫描，我们这个表这么大，是不是意味着迁移的时间会很长?假若我们这个迁移时间为一个小时，那是不是意味着就解释了我们白天没有出现这样问题的原因了。但是全表扫描是最根本的原因吗?

我们不妨试试，一边迁移，一边做些的操作，还原现场。最终还是会出现这样的问题。

这个时候，我们可以调整一下，大胆假设，如果不全表扫描，是不是就不会出现这样的问题。当我们将条件修改之后，果然发现没有走了全表扫描了。

最终再次还原现场，问题解决了：

得出结论：全表扫描导致了这次事故的发生。这样做就解决了发生的问题，但是做为陆陆续续开始失败这个就不好解释了。

原因

在默认的事务隔离级别下：insert into a select b 的操作 a 表示直接锁表，b 表是逐条加锁。这也就解释了为什么出现陆续的失败的原因。

在逐条加锁的时候，流水表由于多数是复合记录，所以最终部分在扫描的时候被锁定，部分拿不到锁，最终导致超时或者直接失败，还有一些在这加锁的过程中成功了。

为什么测试没有问题?

在测试的时候充分的使用了正式环境的数据来测试，但是别忽视一个问题，那就是测试环境毕竟是测试环境，在测试的时候，数据量真实并不代表就是真实的业务场景。

比方说，这个情况里面就少了一个迁移的时候，大量数据的插入这样的情况。最终导致线上 Bug。

解决办法

既然我们避免全表扫描就可以解决，我们避免它就行了。想要避免全表扫描，对 where 后面的条件做索引，让我们的 select 查询都走索引即可。

insert into 还能用吗?回答是：当然可以。

总结

使用 insert into select 的时候请慎重，一定要做好索引。

作者：xlecho

编辑：陶家龙

出处：https://juejin.cn/post/6931890118538199048

Tags：Insert Into Select 点击:() 评论:()

声明：本站部分内容及图片来自互联网,转载是出于传递更多信息之目的,内容观点仅代表作者本人,如有任何标注错误或版权侵犯请与我们联系(Email:2595517585@qq.com)，我们将及时更正、删除，谢谢。

▌相关推荐

血一般的教训，请慎用Insert Into Select

血一般的教训，请慎用 insert into select。同事应用之后，导致公司损失了近 10w 元，最终被公司开除。图片来自 Pexels事情的起因公司的交易量比较大，使用的数据库是 MySQL，每天的...【详细内容】

2021-03-04　　Tags: Insert Into Select 点击:(179)　　评论:(0)　　加入收藏

Insert into select语句竟然也会引发的生产事故？

Insert into select请慎用。这天xxx接到一个需求，需要将表A的数据迁移到表B中去做一个备份。本想通过程序先查询查出来然后批量插入。但xxx觉得这样有点慢，需要耗费大量的网络...【详细内容】

2020-03-12　　Tags: Insert Into Select 点击:(89)　　评论:(0)　　加入收藏

▌简易百科推荐

SQL常用增删改查语句

1增1.1【插入单行】insert [into] <表名> (列名) values (列值)例：insert into Strdents (姓名,性别,出生日期) values ('开心朋朋','男','1980/6/15&#3...【详细内容】

2021-12-27　　快乐火车9d3　　　　Tags:SQL 　点击:(1)　　评论:(0)　　加入收藏

以一个简单的查询存储过程为例，简单说一下sql的几种写法

最近发现还有不少做开发的小伙伴，在写存储过程的时候，在参考已有的不同的写法时，往往很迷茫，不知道各种写法孰优孰劣，该选用哪种写法，以及各种写法的优缺点，本文以一个简单的查询...【详细内容】

2021-12-23　　linux上的码农　　　　Tags:sql 　点击:(9)　　评论:(0)　　加入收藏

HasorDB 一个全功能数据库访问工具

《开源精选》是我们分享Github、Gitee等开源社区中优质项目的栏目，包括技术、学习、实用与各种有趣的内容。本期推荐的HasorDB 是一个全功能数据库访问工具，提供对象映射、丰...【详细内容】

2021-12-22　　GitHub精选　　　　Tags:HasorDB 　点击:(5)　　评论:(0)　　加入收藏

一文详解Liquibase如何自动化数据库脚本部署

作者丨Rafal Grzegorczyk译者丨陈骏策划丨孙淑娟【51CTO.com原创稿件】您是否还在手动对数据库执行各种脚本?您是否还在浪费时间去验证数据库脚本的正确性?您是否还需要将...【详细内容】

2021-12-22　　　　51CTO　　Tags:Liquibase 　点击:(3)　　评论:(0)　　加入收藏

SQL 中 on 和 where 条件放置的差异

场景描述：由于生产环境的表比较复杂，字段很多。这里我们做下简化，只为说明今天要聊的问题。有两张表 tab1，tab2： tab1 数据如下： tab2 数据如下：然后给你看下，我用来统计 name=&#3...【详细内容】

2021-12-20　　Bald　　　　Tags:SQL 　点击:(5)　　评论:(0)　　加入收藏

一文掌握SQL基础

前言知识无底，学海无涯，知识点虽然简单，但是比较多，所以将MySQL的基础写出来，方便自己以后查找，还有就是分享给大家。一、SQL简述1.SQL的概述Structure Query Language(结构化查...【详细内容】

2021-12-16　　谣言止于独立思考　　　　Tags:SQL基础　点击:(13)　　评论:(0)　　加入收藏

做测试不会 SQL？超详细的 SQL 查询语法教程来啦

前言作为一名测试工程师，工作中在对测试结果进行数据比对的时候，或多或少要和数据库打交道的，要和数据库打交道，那么一些常用的 SQL 查询语法必须要掌握。最近有部分做测试小伙...【详细内容】

2021-12-14　　柠檬班软件测试　　　　Tags:SQL 　点击:(15)　　评论:(0)　　加入收藏

C｜数据存储地址与字节偏移、数据索引

话说C是面向内存的编程语言。数据要能存得进去，取得出来，且要考虑效率。不管是顺序存储还是链式存储，其寻址方式总是很重要。顺序存储是连续存储。同质结构的数组通过其索引表...【详细内容】

2021-12-08　　小智雅汇　　　　Tags:数据存储　点击:(17)　　评论:(0)　　加入收藏

数据库迁移有什么技巧？|分享强大的database迁移和同步工具

概述DBConvert Studio 是一款强大的跨数据库迁移和同步软件，可在不同数据库格式之间转换数据库结构和数据。它将成熟、稳定、久经考验的 DBConvert 和 DBSync 核心与改进的现...【详细内容】

2021-11-17　　雪竹聊运维　　　　Tags:数据库　点击:(26)　　评论:(0)　　加入收藏

谈谈执行一条SQL的流程

一、前言大家好,我是小诚,《从0到1-全面深刻理解MySQL系列》已经来到第四章,这一章节的主要从一条SQL执行的开始,由浅入深的解析SQL语句由客户端到服务器的完整执行流程,最...【详细内容】

2021-11-09　　woaker　　　　Tags:SQL 　点击:(35)　　评论:(0)　　加入收藏

推荐资讯

远程软件发展迅猛，ToDe	倒计时！企业QQ即将下架
极简Windows11与iPhon	iPhone信号问题，花10元
惊人数据：App Store中4	个人所得税递延纳税报
非常实用的 Python 库	等离子电视技术先进，为

无相关信息