Бенчмарк векторных индексов: почему цифры в блогах врут
Benchmarking Vector Indexes

Percona запустила vector-bench — открытый инструмент для честного сравнения векторных индексов в базах данных. В статье объясняется, почему одиночные метрики вроде QPS или recall бессмысленны без контекста: recall зависит от настройки ef_search, а скорость — от способа построения индекса. Авторы описывают методологию: фиксированные версии движков, одинаковые данные и оборудование, замеры recall vs throughput, стоимости построения, конкурентности и фильтрованных запросов. Особое внимание уделяется подводным камням, таким как TOAST в PostgreSQL и разнице между инкрементальным и массовым построением индекса.
Если вы запомните из этого поста одну вещь, запомните: каждое измерение здесь — пара (recall, throughput).