PlanetScale 如何实现 Postgres 海量并行备份

Massively Parallel Postgres Backups

PlanetScale 如何实现 Postgres 海量并行备份

在 PlanetScale,我们每天需为繁忙的数据库生成加密快照,且绝不能影响生产查询。面对分片数据库,我们采用了一种独特的策略:动态启动临时 EC2 实例,利用 Amazon S3 存储旧备份,并结合 WAL 回放技术进行增量同步。这种大规模并行处理方案,让 PB 级数据库的备份速度突破 50 GB/s,将原本需要数十小时的备份压缩至数小时甚至更短。此外,这套机制不仅用于灾难恢复,更是数据库扩容和节点故障替换的核心支撑,让复杂的底层操作对用户完全透明。

我们的目标是将 Postgres 和 MySQL 备份的创建、调度、管理和恢复变得毫不费力。
  1. bddicken

    我在这篇文章里(作者在此)强调的是如何扩展 Postgres 的备份能力。之所以可行,是因为 Postgres 及其周边工具链中已经内置了极其稳固的系统,可供我们在此基础上构建。

    更广泛的启示在于这样一个原则:“如何把原本无法独立扩展的东西变得可扩展?”这一原则适用于备份、计算层、存储层以及代理。这也是为什么 Neki 和 Vitess 如此强大,能够应对从 1GB 的小型数据库到 PB 级海量数据的各种场景。

    我会在线待命,随时回答大家的问题 :)。

  2. Onavo

    挺有意思,据我上次了解,PlanetScale 仍然没有提供 Postgres 版本的在线升级功能。

同日更多故事

2026-08-03