ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

分布式存储架构演进十周年:从分库分表、中间件到原生分布式 Multi-Raft

分布式存储架构演进十周年:从分库分表、中间件到原生分布式 Multi-Raft 分布式存储架构演进十周年从分库分表、中间件到原生分布式 Multi-Raft站在 2026 年秋天的这个时间节点回望企业级数据基础设施与分布式存储架构在过去的整整十年里经历了一场波澜壮阔的技术大迁徙。十年前2015~2016 年前后当互联网业务数据量从“千万级”野蛮生长至“百亿级”、“万亿级”时单机关系型数据库在物理容量与连接数上面临着崩溃的边缘。为了应对海量数据的吞吐压力一代又一代的架构师与数据库工程师在不同的历史阶段给出了三种截然不同的架构解法。深入复盘这三代架构的演进逻辑、技术代价与本质局限我们才能真正看懂为什么“原生分布式 Multi-Raft 底座”是海量数据存储演进的终极必然归宿[分布式存储架构十年演进三代进化全景] 第一代: 客户端分库分表 (2015~2019, Sharding-JDBC / TDDL) [应用代码] ──(硬编码分片规则: order_id % 1024)──▶ [1024 张物理 MySQL 分表] (致命痛点: 业务侵入极深、跨分片 JOIN 彻底失效、扩容必须停机重分片!) ───────────────────────────────────────────────────────────── 第二代: 集中式数据库代理中间件 (2019~2023, MyCat / DBProxy) [应用代码] ──▶ [集中式 Proxy 网关集群] ──▶ [后置 MySQL 分库集群] (致命痛点: Proxy 自身成为单点瓶颈、分布式 2PC 性能极其昂贵、脑裂风险高) ───────────────────────────────────────────────────────────── ★ 第三代: 原生分布式 Multi-Raft 底座 (2023~2026, 当前方案) [应用代码] ──(标准 SQL 接口, 0 侵入)──▶ [无状态分布式 SQL 计算层] │ ▼ [原生 Multi-Raft 存储池: 25 万个 Region 自动动态分裂、自适应迁移与多副本强一致!]第一代2015~2019客户端分库分表的“手工痛苦时代”在第一代架构中分布式能力完全被生硬地塞进了业务应用代码或 SDK 内部如早期的 TDDL、Sharding-JDBC业务代码强耦合研发人员写每一句 SQL 都必须小心翼翼地带着sharding_key扩容代价深不见底一旦预先规划的 1024 张表容量用完团队必须停机数天编写极其繁琐的双写迁移脚本进行“再拆表Re-sharding”分布式事务彻底裸奔跨库事务只能依赖业务层做极其复杂的 TCC / Saga 最终一致性补偿研发心智负担极其沉重第二代2019~2023集中式代理中间件的“妥协与瓶颈”为了解决业务代码侵入的问题行业演进出了独立的数据库代理层如 Cobar、MyCat、MySQL Proxy解决的痛点对外暴露统一的单个 MySQL 协议端口业务无需再关心底层分表致命新瓶颈Proxy 节点自身成为了网络与内存的巨大单点性能瓶颈底层依然是数十个独立的 MySQL 实例分布式 2PC两阶段提交在跨网络下性能极其昂贵TPS 极低一旦发生网络分区Proxy 极易发生误判导致脑裂脏写第三代2023~2026原生分布式 Multi-Raft 底座的“降维打击”第三代原生分布式架构彻底打破了“分库分表”的旧思维从底层存储引擎和共识算法层进行了革命性重构[原生分布式 Multi-Raft 架构三大终极降维打击优势] 1. 存储层真强一致: - 每个 Region 分片通过 Multi-Raft 多数派实现硬件级高可用彻底告别异步主从复制丢失数据! 2. 极致弹性与自愈: - 分片超过 96MB 自动分裂新机器上线自动拓扑再均衡扩容搬迁业务发生整整 0 感知! 3. 完整 ACID 分布式事务: - 基于 Percolator / MVCC 与乐观锁/悲观锁并发控制跨全集群任意表关联如同单机一样优雅自然!单表万亿行无感承载研发人员像使用单机 MySQL 一样建表无需再关心任何分片规则万亿规模秒级自愈96 台裸金属节点、25 万个分片在后台实现无人值守的自动化负载均衡。结语从人工拆表的狼狈与苦涩到原生分布式底座的优雅与从容。这十年的技术大演进本质上是软件工程将“复杂性不断下沉至系统底层、把简单与确定性还给业务开发者”的伟大胜利
返回列表