【MySQL】007 -- 事务的隔离:可重复读与读提交的数据版本可见性
创始人
2025-05-31 21:05:18
0

    此文章为《MySQL 实战 45 讲》的学习笔记,其课程链接可参见:MySQL实战45讲_MySQL_数据库-极客时间

目录

一、事务的隔离

1、事务的启动时机

2、如何理解事务B查到的k的值是3,而事务A查到的k的值是1?

①、MySQL中两个“视图”的概念

②、数据版本的可见性

3、快照在MVCC中如何工作

①、事务ID(row trx_id)

②、undo log

③、InnoDB是怎么定义那个“100G”的快照的?

4、更新逻辑

①、当前读

5、事务的可重复读的能力是怎么实现的?

①、读提交与可重复读隔离级别最主要的区别

②、在读提交隔离级别下,事务A和事务B的查询语句查到的k是多少?

6、小结

可重复读与读提交的数据版本可见性

7、思考题


一、事务的隔离

1、事务的启动时机

如上图所示:begin/start transaction 命令并不是一个事务的起点,在执行到它们之后的第一个操作InnoDB表的语句(第一个快照读语句),事务才真正启动。如果你想要马上启动一个事务,可以使用start transaction with consistent snapshot 这个命令。

2、如何理解事务B查到的k的值是3,而事务A查到的k的值是1?

①、MySQL中两个“视图”的概念

在MySQL里,有两个“视图”的概念:

  • 一个是view。它是一个用查询语句定义的虚拟表,在调用的时候执行查询语句并生成结果。创建视图的语法是create view ... ,而它的查询方法与表一样
  • 另一个是InnoDB在实现MVCC时用到的一致性读视图,即consistent read view,用于支持RC(Read Committed,读提交)和RR(Repeatable Read,可重复读)隔离级别的实现。

②、数据版本的可见性

一个数据版本,对于一个事务视图来说,除了自己的更新总是可见以外,有三种情况:

  • 版本未提交,不可见;
  • 版本已提交,但是是在视图创建后提交的,不可见;
  • 版本已提交,而且是在视图创建前提交的,可见。

一个数据版本,对于一个事务视图来说,除了自己的更新总是可见以外;由于一致性读的原因,虽然期间这一行数据被修改过,但是事务A不论在什么时候查询,看到这行数据的结果都是一致的,始终为1。而事务B为什么查询到的值是3,请看4.①中的当前读部分。

3、快照在MVCC中如何工作

在可重复读隔离级别下,事务在启动的时候就“拍了个快照”。注意,这个快照是基于整库的。

①、事务ID(row trx_id)

InnoDB里面每个事务有一个唯一的事务ID,叫作transaction id。它是在事务开始的时候向InnoDB的事务系统申请的,按照申请顺序严格递增。

而每行数据也都是有多个版本的。每次事务更新数据的时候,都会生成一个新的数据版本,并且把transaction id赋值给这个数据版本的事务ID,记为row trx_id。同时,旧的数据版本要保留,并且在新的数据版本中,能够有信息可以直接拿到它。

也就是说,数据表中的一行记录,其实可能有多个版本(row),每个版本都有自己的row trx_id。如下图所示,这是一个记录被多个事务连续更新后的状态。

图中虚线框里是同一行数据的4个版本,当前最新版本是V4,k的值是22,它是被transaction id 25的事务更新的,因此它的row trx_id也是25

②、undo log

补充说明】:undo log是什么?

innodb事务日志包括redo log和undo log。redo log是重做日志,提供前滚操作,undo log是回滚日志,提供回滚操作。

undo log不是redo log的逆向过程,其实它们都算是用来恢复的日志:

  1. redo log通常是物理日志,记录的是数据页的物理修改,而不是某一行或某几行修改成怎样怎样,它用来恢复提交后的物理数据页(恢复数据页,且只能恢复到最后一次提交的位置)。
  2. undo用来回滚行记录到某个版本。undo log一般是逻辑日志,根据每行记录进行记录。

问题:undo log在哪呢?

实际上,上图中的3个虚线箭头就是undo log;而V1、V2、V3并不是物理上真实存在的,而是每次需要的时候根据当前版本和undo log计算出来的。比如,需要V2的时候,就是通过V4依次执行U3、U2算出来。

③、InnoDB是怎么定义那个“100G”的快照的?

在实现上, InnoDB为每个事务构造了一个数组,用来保存这个事务启动瞬间,当前正在“活跃”的所有事务ID。“活跃”指的就是,启动了但还没提交

数组里面事务ID的最小值记为低水位,当前系统里面已经创建过的事务ID的最大值加1记为高水位。

这个视图数组和高水位,就组成了当前事务的一致性视图(read-view)。

而数据版本的可见性规则,就是基于数据的row trx_id和这个一致性视图的对比结果得到的,数据版本的可见性规则如下图所示:

对于当前事务的启动瞬间来说,一个数据版本的row trx_id,有以下几种可能:

a. 若 row trx_id在数组中,表示这个版本是由还没提交的事务生成的,不可见;

b. 若 row trx_id不在数组中,表示这个版本是已经提交了的事务生成的,可见。

  • 如果落在绿色部分,表示这个版本是已提交的事务或者是当前事务自己生成的,这个数据是可见的;
  • 如果落在红色部分,表示这个版本是由将来启动的事务生成的,是肯定不可见的;
  • 如果落在黄色部分,那就包括两种情况

InnoDB利用了“所有数据都有多个版本”的这个特性,实现了“秒级创建快照”的能力

4、更新逻辑

①、当前读

更新操作这里用到了这样一条规则:更新数据都是先读后写的,而这个读,只能读当前的值,称为“当前读”(current read。因此,在更新的时候,当前读拿到的数据是(1,2),更新后生成了新版本的数据(1,3),这个新版本的row trx_id是101。所以,在执行事务B查询语句的时候,一看自己的版本号是101,最新数据的版本号也是101,是自己的更新,可以直接使用,所以查询得到的k的值是3。

其实,除了update语句外,select语句如果加锁,也是当前读。

lock in share mode:读锁(S锁,共享锁)

for update:写锁(X锁,排他锁)

5、事务的可重复读的能力是怎么实现的?

可重复读的核心就是一致性读(consistent read;而事务更新数据的时候,只能用当前读。如果当前的记录的行锁被其他事务占用的话,就需要进入锁等待。

①、读提交与可重复读隔离级别最主要的区别

读提交的逻辑和可重复读的逻辑类似,它们最主要的区别是:

  • 在可重复读隔离级别下,只需要在事务开始的时候创建一致性视图,之后事务里的其他查询都共用这个一致性视图;
  • 读提交隔离级别下,每一个语句执行前都会重新算出一个新的视图

②、在读提交隔离级别下,事务A和事务B的查询语句查到的k是多少?

start transaction with consistent snapshot; ”的意思是从这个语句开始,创建一个持续整个事务的一致性快照。所以,在读提交隔离级别下,这个用法就没意义了,等效于普通的start transaction。

答案:事务A查询语句返回的是k=2,事务B查询结果k=3

原因

这是因为,此时事务A的查询语句的视图数组是在执行这个语句的时候创建的,时序上(1,2)、(1,3)的生成时间都在创建这个视图数组的时刻之前。但是,在这个时刻:

  • (1,3)还没提交,属于情况1,不可见;
  • (1,2)提交了,属于情况3,可见。

6、小结

可重复读与读提交的数据版本可见性

InnoDB的行数据有多个版本,每个数据版本有自己的row trx_id,每个事务或者语句有自己的一致性视图。普通查询语句是一致性读,一致性读会根据row trx_id和一致性视图确定数据版本的可见性。

  • 对于可重复读,查询只承认在事务启动前就已经提交完成的数据;
  • 对于读提交,查询只承认在语句启动前就已经提交完成的数据;

7、思考题

问题:我用下面的表结构和初始化语句作为试验环境,事务隔离级别是可重复读。现在,我要把所有“字段c和id值相等的行”的c值清零,但是却发现了一个“诡异”的、改不掉的情况。请你构造出这种情况,并说明其原理。

mysql> CREATE TABLE `t` (

  `id` int(11) NOT NULL,

  `c` int(11) DEFAULT NULL,

  PRIMARY KEY (`id`)

) ENGINE=InnoDB;

insert into t(id, c) values(1,1),(2,2),(3,3),(4,4);

复现出来以后,请你再思考一下,在实际的业务开发中有没有可能碰到这种情况?你的应用代码会不会掉进这个“坑”里,你又是怎么解决的呢?

参考答案: 

此时,session A看到的就是截图中的效果。此外,还有另外一种场景:

这个操作序列跑出来,session A看的内容也是能够复现我截图的效果的。这个session B’启动的事务比A要早。

用新的方式来分析session B’的更新为什么对session A不可见就是:session A视图数组创建的瞬间,session B’是活跃的,属于“版本未提交,不可见”这种情况

相关内容

热门资讯

令人神往的反义词 令人神往的反义词有:令人作呕,令人切齿,令人痛心,令人神往[lìng rén shén wǎng]的...
补残守缺的反义词 补残守缺的反义词有:标新立异,补残守缺[bǔ cán shǒu quē]的意思:残:残缺,不完整;缺...
石沉大海的反义词 石沉大海的反义词有:一封家书,死灰复燃,石沉大海[shí chén dà hǎi]的意思:石头沉到海...
心胸开阔的反义词 心胸开阔的反义词有:小心眼儿,心胸狭隘,心胸开阔[xīn xiōng kāi kuò]的意思:心胸:...
毫不在意的反义词 毫不在意的反义词有:耿耿于怀,毫不在意[háo bù zài yì]的意思:丝毫不在乎或不介意出自:...
直来直去的反义词 直来直去的反义词有:拐弯抹角,曲尽其妙,绕脖子,直来直去[zhí lái zhí qù]的意思:指来...
高瞻远瞩的反义词   高瞻远瞩:站得高,看得远。比喻眼光远大。出自 汉·王充《论衡·别通篇》。  一、【反义词】  苟...
粗衣淡饭的反义词 粗衣淡饭的反义词有:锦衣玉食,粗衣淡饭[cū yī dàn fàn]的意思:粗:粗糙、简单;淡饭:指...
筋疲力尽的反义词 筋疲力尽的反义词有:容光焕发,精力充沛,精神抖擞,精神焕发,筋疲力尽[jīn pí lì jìn]的...
未老先衰的反义词 未老先衰的反义词有:人老心不老,老当益壮,返老还童,鹤发童颜,未老先衰[wèi lǎo xiān s...
男女有别的反义词 男女有别的反义词有:亲密无间,男女有别[nán nǚ yǒu bié]的意思:指男女之间有所分别出自...
二话不说的反义词 二话不说的反义词有:喋喋不休,二话不说[èr huà bù shuō]的意思:不说任何别的话。指立即...
大度包容的反义词 大度包容的反义词有:小肚鸡肠,睚眦必报,大度包容[dà dù bāo róng]的意思:形容气量大,...
悲痛欲绝的反义词 悲痛欲绝的反义词有:惊喜交集,惊喜若狂,抚掌大笑,欣喜若狂,悲痛欲绝[bēi tòng yù jué...
拿手好戏的反义词 拿手好戏的反义词有:一无所能,一无所长,拿手好戏[ná shǒu hǎo xì]的意思:拿手:擅长。...
佶屈聱牙的反义词 佶屈聱牙的反义词有:出口成章,朗朗上口,琅琅上口,佶屈聱牙[jí qū áo yá]的意思:佶屈:曲...
炫耀的近反义词是什么 炫耀的近反义词是什么  导语:有近义词和反义词的题目,学生都很容易错。说明学生的词汇量比较少,对于词...
五零四散的反义词 五零四散的反义词有:完完整整,五零四散[wǔ líng sì sàn]的意思:形容零星涣散。出自:郭...
干涸的反义词是什么及造句 干涸的反义词是什么及造句  【干涸解释】:(河道、池塘等)没有水了。以下是小编收集整理关于该词反义词...
洗手不干的反义词 洗手不干的反义词有:执迷不悟,死不悔改,洗手不干[xǐ shǒu bù gàn]的意思:把手洗干净休...