首个向量化 Quicksort 诞生

Vectorized and performance-portable Quicksort

首个向量化 Quicksort 诞生

我们开源了一款全新的排序算法,其速度比 C++ 标准库的 std::sort 快约 10 倍,且能超越现有针对特定架构优化的算法。该实现利用 SIMD 指令集,在保持对现代 CPU 架构广泛兼容的同时,显著提升了列式数据库场景下的排序效率。通过巧妙运用 compress-store 指令及其在 AVX2 等架构上的模拟方案,我们实现了首个跨平台的向量化 Quicksort。无论是在 Apple M1 还是 Intel Skylake 上,该算法均刷新了单核排序速度的记录,为处理大规模数据带来了前所未有的性能突破。

我们期待看到,当单 CPU 核心能够实现每秒 1GB 的排序速度时,将解锁哪些全新的应用场景与能力。

同日更多故事

2026-09-16