Kapa 实测:Grep 检索能否击败传统 RAG?

Benchmarking retrieval for agents on messy real-world company knowledge

Kapa 实测:Grep 检索能否击败传统 RAG?

在 Cursor 放弃代码库嵌入索引、转而依赖 grep 的背景下,Kapa 发布了 Company Knowledge Bench,这是一个基于 1000 个真实生产案例构建的检索基准。测试结果显示,仅使用 grep 的 frontier model 在耗时增加五倍的情况下,得分可与调优后的现代检索管道持平;而 Kapa Deep 代理检索器则在 5 秒内实现了更优表现。文章深入剖析了为何通用公共基准无法覆盖复杂的公司内部知识场景,并详细拆解了从查询分解、混合搜索到代理式检索的七种方案在完整性、最小性和源权威性上的表现,为构建高效的企业级 Agent 检索提供了关键数据参考。

一个仅使用 grep 的前沿模型,得分可与调优后的现代检索管道持平,但耗时却是其五倍。

同日更多故事

2026-10-02