4B 모델로 Postgres보다 81% 빠른 쿼리 플랜 생성하기

Training a 4B model to produce 81% faster query plans than Postgres

4B 모델로 Postgres보다 81% 빠른 쿼리 플랜 생성하기

Postgres의 쿼리 옵티마이저는 조인 순서 선택이 NP-hard임에도 불구하고 통계 추정에 의존해 종종 최적이 아닌 플랜을 고른다. 이 실험에서는 4B 오픈웨이트 모델을 SFT와 에이전틱 RL로 포스트트레이닝해 113개의 조인 많은 쿼리에서 44.7% 지연 감소를 달성했다. 노이즈 많은 환경을 위한 커스텀 GRPO 변형, 2x H100 노드와 데스크톱 Postgres 컨테이너를 활용한 분산 RL, GPT-6 Astra 에이전트 궤적에 대한 오프폴리시 증류가 핵심이다.

하나의 잘못된 추정이 초기 조인에서 발생하면 조인 트리의 나머지 전체로 연쇄되어 다른 모든 추정을 오염시킬 수 있다.

이 날의 다른 글

2026-09-16