Cloudflare Meerkat:全球共识新实验
Cloudflare Meerkat - Globally distributed consensus

在遍布全球的330多个数据中心里,Cloudflare的许多内部服务需要读写同一份控制平面状态,且必须保证强一致性。然而,互联网环境充满不确定性,传统如Raft这类依赖Leader和超时机制的共识算法,在面对网络延迟波动时往往导致服务不可用。为此,Cloudflare研究团队推出了Meerkat,一个基于QuePaxa算法构建的全新分布式共识服务。Meerkat允许所有副本随时写入,无需等待超时,从而在广域网中实现高可用与强一致性。目前,Meerkat仍处于实验阶段,主要用于管理小规模控制平面状态,未来将支撑更多关键应用。
在互联网这个不可预测的地方,服务器和数据中心会宕机,队列会填满,链路和电缆会被切断,这使得构建一个既全球可用又保证强一致性的数据系统变得异常困难。
- QuePaxa 作为首个生产级异步共识算法,不依赖超时机制即可在消息延迟剧烈波动时保持进度,但评论者担心其在正常低延迟场景下的性能可能不如 Raft。
- 有评论者指出文章混淆了线性化(linearizability)与强一致性概念,并质疑将读操作纳入全局共识会导致高延迟,从而限制其实际应用场景。
- 多位从业者反驳了'大厂已全面弃用 etcd'的说法,强调 AWS、Azure 和 GCP 的 K8s 服务仍在使用 etcd,并批评文章缺乏代码链接及未提及 CAP 理论显得不专业。
- 评论认为该算法实现难度极高,其故障模式可能导致无限重试和长尾延迟,与 Raft 中基于超时的确定性延迟预期截然不同。
- 部分观点认为许多分布式协调需求本质上只需单写锁,单节点 Postgres 即可满足,质疑 Cloudflare 内部控制平面是否真的无法使用现有方案。