分布式的物理现实:分区、部分失败与时钟
2026/8/22大约 2 分钟
分布式事务系列 · 阶段 1 · 理论与协议 · 第 6/49 篇 · 🚧 占位待学
上一篇:《本地事务的天花板:跨库跨服务为什么失灵》
下一篇:《CAP 定理:为什么是三选二》
学习大纲:《分布式事务学习总纲》
状态:待学习。 本文为占位文档:知识点清单、实验与验收标准已就绪,正文待按「先学习、先实验、再撰写」补全。
对应总纲单元:阶段 1 · 单元 1.1
一、本文要解决的问题
把数据库复制到两台机器、把服务拆到两个进程之后,物理上到底多了哪些麻烦?这三个麻烦是 CAP 定理存在的理由,也是所有分布式事务方案真正对抗的敌人。
二、知识点清单
- 网络分区与普通丢包的区别
- 部分失败:调用一半成功一半失败,且无法区分「慢」和「死」
- 无全局时钟:时钟漂移、跨机器事件排序问题
- 三者分别怎么破坏本地事务的 ACID(逐条对应)
三、动手实验(学习时必须真跑)
- 思想实验:两机房专线断了,两边各自接收写入,推演数据如何分叉
- (可选)本地用防火墙规则模拟两进程间断连,观察调用方的超时行为
四、验收标准(全部通过才进入下一篇)
五、写作提示(补正文时遵守)
- 开篇问题驱动;结构走「是什么 → 为什么 → 怎么做 → 背景知识」
- 所有代码、命令、输出必须先在本机跑通再写入,不得杜撰
- 版本口径以总纲环境清单为准(Apache Seata 2.6.0 / MySQL 8.0 / RocketMQ 5.x / Spring Boot 3.x)
- 涉及版本敏感结论时标注出处与时间
本篇完成后,把文首导航块的「🚧 占位待学」去掉,并在总纲处打卡。