MySQL实战解析底层---事务隔离:为什么你改了我还看不见

news2024/11/15 4:36:36

目录

前言

隔离性与隔离级别

事务隔离的实现

事务的启动方式


  • 前言

  • 和数据库打交道的时候,总是会用到事务
  • 最经典的例子就是转账,你要给朋友小王转 100 块钱,而此时你的银行卡只有 100 块钱
  • 转账过程具体到程序里会有一系列的操作,比如查询余额、做加减法、更新余额等
  • 这些操作必须保证是一体的,不然等程序查完之后,还没做减法之前,你这 100 块钱,完全可以借着这个时间差再查一次,然后再给另外一个朋友转账,如果银行这么整,不就乱了么?
  • 这时就要用到“事务”这个概念了
  • 简单来说,事务就是要保证一组数据库操作,要么全部成功,要么全部失败
  • 在 MySQL 中,事务支持是在引擎层实现的
  • MySQL 是一个支持多引擎的系统,但并不是所有的引擎都支持事务
  • 比如 MySQL 原生的 MyISAM 引擎就不支持事务,这也是 MyISAM 被 InnoDB 取代的重要原因之一
  • 下面将会以 InnoDB 为例,剖析 MySQL 在事务支持方面的特定实现,并基于原理给出相应的实践建议,希望这些案例能加深你对 MySQL 事务原理的理解
  • 隔离性与隔离级别

  • 提到事务,你肯定会想到 ACID(Atomicity、Consistency、Isolation、Durability,即原子性、一致性、隔离性、持久性)
  • 今天就来说说其中 I,也就是“隔离性”
  • 当数据库上有多个事务同时执行的时候,就可能出现脏读(dirty read)、不可重复读(non-repeatable read)、幻读(phantom read)的问题,为了解决这些问题,就有了“隔离级别”的概念
  • 在谈隔离级别之前,你首先要知道,你隔离得越严实,效率就会越低
  • 因此很多时候,都要在二者之间寻找一个平衡点
  • SQL 标准的事务隔离级别包括:读未提交(read uncommitted)、读提交(read committed)、可重复读(repeatable read)和串行化(serializable )
  • 下面逐一解释:
    • 读未提交是指,一个事务还没提交时,它做的变更就能被别的事务看到
    • 读提交是指,一个事务提交之后,它做的变更才会被其他事务看到
    • 可重复读是指,一个事务执行过程中看到的数据,总是跟这个事务在启动时看到的数据是一致的;当然在可重复读隔离级别下,未提交变更对其他事务也是不可见的
    • 串行化,顾名思义是对于同一行记录,“写”会加“写锁”,“读”会加“读锁”;当出现读写锁冲突的时候,后访问的事务必须等前一个事务执行完成,才能继续执行
  • 其中“读提交”和“可重复读”比较难理解,所以用一个例子说明这几种隔离级别
  • 假设数据表 T 中只有一列,其中一行的值为 1
  • 下面是按照时间顺序执行两个事务的行为

  • 来看看在不同的隔离级别下,事务 A 会有哪些不同的返回结果,也就是图里面 V1、V2、V3 的返回值分别是什么
  • 若隔离级别是“读未提交”
    • 则 V1 的值就是 2
    • 这时候事务 B 虽然还没有提交,但是结果已经被 A 看到了
    • 因此,V2、V3 也都是 2
  • 若隔离级别是“读提交”
    • 则 V1 是 1,V2 的值是 2
    • 事务 B 的更新在提交后才能被 A 看到
    • 所以, V3 的值也是 2
  • 若隔离级别是“可重复读”
    • 则 V1、V2 是 1,V3 是 2
    • 之所以 V2 还是 1,遵循的就是这个要求:事务在执行期间看到的数据前后必须是一致的
  • 若隔离级别是“串行化”
    • 则在事务 B 执行“将 1 改成 2”的时候,会被锁住
    • 直到事务 A 提交后,事务 B 才可以继续执行
    • 所以从 A 的角度看, V1、V2 值是 1,V3 的值是 2
  • 在实现上,数据库里面会创建一个视图,访问的时候以视图的逻辑结果为准
  • 在“可重复读”隔离级别下
    • 这个视图是在事务启动时创建的,整个事务存在期间都用这个视图
  • 在“读提交”隔离级别下
    • 这个视图是在每个 SQL 语句开始执行的时候创建的
    • 这里需要注意的是,“读未提交”隔离级别下直接返回记录上的最新值,没有视图概念
  • 而“串行化”隔离级别下
    • 直接用加锁的方式来避免并行访问
  • 可以看到在不同的隔离级别下,数据库行为是有所不同的
  • Oracle 数据库的默认隔离级别其实就是“读提交”
  • 因此对于一些从 Oracle 迁移到 MySQL 的应用,为保证数据库隔离级别的一致,你一定要记得将 MySQL 的隔离级别设置为“读提交”
  • 配置的方式是,将启动参数 transaction-isolation 的值设置成 READ-COMMITTED
  • 可以用 show variables 来查看当前的值
  • 总结来说,存在即合理,每种隔离级别都有自己的使用场景,要根据自己的业务情况来定
  • 那什么时候需要“可重复读”的场景呢?
  • 来看一个数据校对逻辑的案例
  • 假设你在管理一个个人银行账户表
  • 一个表存了账户余额,一个表存了账单明细
  • 到了月底你要做数据校对,也就是判断上个月的余额和当前余额的差额,是否与本月的账单明细一致
  • 你一定希望在校对过程中,即使有用户发生了一笔新的交易,也不影响你的校对结果
  • 这时候使用“可重复读”隔离级别就很方便
  • 事务启动时的视图可以认为是静态的,不受其他事务更新的影响
  • 事务隔离的实现

  • 理解了事务的隔离级别,再来看看事务隔离具体是怎么实现的
  • 这里展开说明“可重复读”
  • 在 MySQL 中,实际上每条记录在更新的时候都会同时记录一条回滚操作
  • 记录上的最新值,通过回滚操作,都可以得到前一个状态的值
  • 假设一个值从 1 被按顺序改成了 2、3、4
  • 当前值是 4,但是在查询这条记录的时候,不同时刻启动的事务会有不同的 read-view
  • 在视图 A、B、C 里面,这一个记录的值分别是 1、2、4,同一条记录在系统中可以存在多个版本,就是数据库的多版本并发控制(MVCC)
  • 对于 read-view A,要得到 1,就必须将当前值依次执行图中所有的回滚操作得到
  • 同时你会发现,即使现在有另外一个事务正在将 4 改成 5,这个事务跟 read-view A、B、C对应的事务是不会冲突的
  • 回滚日志总不能一直保留吧,什么时候删除呢?
  • 答案是,在不需要的时候才删除
  • 也就是说,系统会判断,当没有事务再需要用到这些回滚日志时,回滚日志会被删除
  • 什么时候才不需要了呢?
  • 就是当系统里没有比这个回滚日志更早的 read-view 的时候
  • 基于上面的说明,来讨论一下为什么建议你尽量不要使用长事务
  • 长事务意味着系统里面会存在很老的事务视图
  • 由于这些事务随时可能访问数据库里面的任何数据,所以这个事务提交之前,数据库里面它可能用到的回滚记录都必须保留,这就会导致大量占用存储空间
  • 在 MySQL 5.5 及以前的版本,回滚日志是跟数据字典一起放在 ibdata 文件里的,即使长事务最终提交,回滚段被清理,文件也不会变小
  • 有数据只有 20GB,而回滚段有 200GB的库
  • 最终只好为了清理回滚段,重建整个库
  • 除了对回滚段的影响,长事务还占用锁资源,也可能拖垮整个库,这个会在后面讲锁的时候展开
  • 事务的启动方式

  • 如前面所述,长事务有这些潜在风险,建议尽量避免
  • 其实很多时候业务开发并不是有意使用长事务,通常是由于误用所致
  • MySQL 的事务启动方式有以下几种:
  • (1)显式启动事务语句, begin 或 start transaction;配套的提交语句是 commit,回滚语句是 rollback
  • (2)set autocommit=0,这个命令会将这个线程的自动提交关掉;意味着如果你只执行一个select 语句,这个事务就启动了,而且并不会自动提交;这个事务持续存在直到你主动执行 commit 或 rollback 语句,或者断开连接
  • 有些客户端连接框架会默认连接成功后先执行一个 set autocommit=0 的命令
  • 这就导致接下来的查询都在事务中,如果是长连接,就导致了意外的长事务
  • 因此建议你总是使用 set autocommit=1, 通过显式语句的方式来启动事务
  • 但是有的开发会纠结“多一次交互”的问题
  • 对于一个需要频繁使用事务的业务,第二种方式每个事务在开始时都不需要主动执行一次 “begin”,减少了语句的交互次数
  • 如果你也有这个顾虑,建议你使用 commit work and chain 语法
  • 在 autocommit 为 1 的情况下,用 begin 显式启动的事务,如果执行 commit 则提交事务
  • 如果执行 commit work and chain,则是提交事务并自动启动下一个事务,这样也省去了再次执行 begin 语句的开销
  • 同时带来的好处是从程序开发的角度明确地知道每个语句是否处于事务中
  • 可以在 information_schema 库的 innodb_trx 这个表中查询长事务

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/382979.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

高可用/性能

文章目录1.数据库系统架构发展(1)单库架构(2)主备架构(3)主从架构2.主从复制主从同步配置主从复制模式(1)异步复制(2)半同步复制(3)全…

用spectralayers 简单去一下人声做个伴奏

最近有个同事说有个工作要一个歌的伴奏不会下载问我能不能给下一个。问题是我五音不全,也不咋关注伴奏这方面的事儿,然后巧了,当天晚上就有个网上的大哥在群里聊天的时候说有个去人声比较给力的软件,我马上给要来了。 软件叫啥sp…

【代码随想录训练营】【Day29】第七章|回溯算法|491.递增子序列|46.全排列|47.全排列 II

递增子序列 题目详细:LeetCode.491 注意这道题求的是子序列,而不是子数组,子数组要求其数组是原数组的子集,且元素是连续的,而子序列只需要保证至少有两个元素即可,不需要关系元素是否连续。 所以一开始…

测试人员如何在测试环境数据库批量生成测试数据?方案分享

测试人员为了测试某个特定场景,往往需要在测试环境数据库中插入特定的测试数据来满足需求;性能测试时,常需要在测试环境生成大量可用测试数据来支持性能测试;建设持续集成持续交付体系时,我们往往也需要在测试环境生成…

【网络】套接字 -- TCP

🥁作者: 华丞臧. 📕​​​​专栏:【网络】 各位读者老爷如果觉得博主写的不错,请诸位多多支持(点赞收藏关注)。如果有错误的地方,欢迎在评论区指出。 推荐一款刷题网站 👉 LeetCode刷题网站 文章…

记录一次nginx转发代理skywalking白屏 以及nginx鉴权配置

上nginx代码 #user nobody; worker_processes 1; #error_log logs/error.log; #error_log logs/error.log notice; #error_log logs/error.log info; #pid logs/nginx.pid; events { worker_connections 1024; } http { include mime.types; …

【2023】某python语言程序设计跟学第二周内容

本文说明: 案例内容为北理工python语言程序设计课程,如有不妥请联系! 目录蟒蛇绘制案例:执行结果:代码分析:举一反三:绘制一个五角星图案执行结果:turtle库根据案例简单说明&#xf…

linux(Centos)安装docker

官网地址:Install Docker Engine on CentOS 首先检查linux系统版本及内核: 安装docker要求系统版本至少为7.x版本,内核至少为3.8以上 cat /etc/redhat-release # 查看系统版本号uname -r #查看linux系统内核 检查系统是否能连上外网&#…

3.基于Label studio的训练数据标注指南:文本分类任务

文本分类任务Label Studio使用指南 1.基于Label studio的训练数据标注指南:信息抽取(实体关系抽取)、文本分类等 2.基于Label studio的训练数据标注指南:(智能文档)文档抽取任务、PDF、表格、图片抽取标注等…

NJU数电实验-1

实验一 选择器 2选1多路选择器 逻辑表达式:y(∼s&a)∣(s&b)y(\sim s\&a)|(s\&b)y(∼s&a)∣(s&b) 逻辑电路: 数据流建模 数据流建模主要是通过连续赋值语句 assign 来描述电路的功能 module m_mux21(a,b,s,y);input a,b,s;…

这是一篇很好的互动式文章,Framer Motion 布局动画

重现framer的神奇布局动画的指南。 到目前为止&#xff0c;我最喜欢 Framer Motion 的部分是它神奇的布局动画–将 layout prop 拍在任何运动组件上&#xff0c;看着该组件从页面的一个部分无缝过渡到下一个部分。 <motion.div layout /> 在这篇文章中&#xff0c;我们…

【测试岗】那个准点下班的人,比我先升职了...

前言 陈双喜最近心态很崩。和他同期一道进公司的陈琪又升了一级&#xff0c;可是明明大家在进公司时&#xff0c;陈琪不论是学历还是工作经验&#xff0c;样样都不如自己&#xff0c;眼下不过短短的两年时间便一跃在自己的职级之上&#xff0c;这着实让他有几分不甘心。 程双…

linux常用命令介绍 03 篇——常用的文本处理工具之grep和cut(以及部分正则使用)

linux常用命令介绍 03 篇——常用的文本处理工具之grep和cut&#xff08;以及部分正则使用&#xff09;1 常用命令01篇 和 02篇1.1 Linux命令01篇——Linux解压缩文件常用命令1.2 Linux命令02篇——linux日常常用命令介绍2. 正则表达式2.1 基本定义2.2 正则中常用的元字符3. gr…

【python】异常详解

注&#xff1a;最后有面试挑战&#xff0c;看看自己掌握了吗 文章目录错误分类捕捉异常实例finally的使用捕捉特定异常抛出异常用户自定义异常&#x1f338;I could be bounded in a nutshell and count myself a king of infinite space. 特别鸣谢&#xff1a;木芯工作室 、I…

项目质量管理有哪些不同阶段?其中“质量“指的是什么?

项目质量管理是指在整个项目中管理和保持质量的过程。 "质量 "不是意味着 "完美"&#xff0c;通常更多的是指在整个项目中确保质量的一致性。然而&#xff0c;"质量 "的确切含义取决于客户或利益相关者对项目的需求&#xff0c;因此在每个项目可…

Ubuntu开机自动挂载硬盘

查看挂载信息&#xff0c;命令台输入 df -h能够看到/dev/nvme0n1p2是我们要挂在的硬盘&#xff0c;其路径是/media/lkzcswq/Data 找到要挂载磁盘的UUID sudo blkid /dev/nvme0n1p2观察到这个磁盘的UUID为72922DF0922DBA0D&#xff0c;type为ntfs 4. 编辑/etc/fstab文件 #如…

【服务器数据恢复】VMware虚拟机下的SQL Server数据库数据恢复案例

服务器数据恢复环境&#xff1a; 一台某品牌PowerEdge系列服务器和一台PowerVault系列存储&#xff0c;上层是ESXI虚拟机文件&#xff0c;虚拟机中运行SQL Server数据库。 服务器故障&#xff1a; 机房非正常断电导致虚拟机无法启动。管理员检查虚拟机发现虚拟机配置文件丢失&…

一、Java概述

一、Java概述 1.1 版本 Java SE 标准版&#xff08;核心版本&#xff09;&#xff0c;主要包含Java最核心的库包括&#xff1a;集合&#xff0c;IO&#xff0c;数据库连接、网络编程等 Java EE 企业版&#xff0c;主要用于开发&#xff0c;装配&#xff0c;部署企业级应用包括…

工业机器人编程调试怎么学

很多人觉得工业机器人很难学学&#xff0c;实际上机器人涉及的知识远比PLC要少。现简单说明一下初学者学习工业机器人编程调试的流程&#xff0c;以AUBO机器人为例&#xff1a; 首先我们需要知道工业机器人的调试学起来不难&#xff0c;远比编程更简单&#xff0c;示教器上的编…

基于信息间隙决策理论的碳捕集电厂调度(Matlab代码实现)

&#x1f4a5;&#x1f4a5;&#x1f49e;&#x1f49e;欢迎来到本博客❤️❤️&#x1f4a5;&#x1f4a5; &#x1f3c6;博主优势&#xff1a;&#x1f31e;&#x1f31e;&#x1f31e;博客内容尽量做到思维缜密&#xff0c;逻辑清晰&#xff0c;为了方便读者。 ⛳️座右铭&a…