Prewalk: cómo lograr el 97% del rendimiento de un modelo frontera con un 61% del costo

You only need the frontier model for one single edit

Prewalk: cómo lograr el 97% del rendimiento de un modelo frontera con un 61% del costo

En Stencil.so descubrimos que el costo de los agentes de IA no está en editar código, sino en leerlo: el 91% de los tokens se gastan en lecturas. Por eso, la estrategia de usar un modelo caro para planificar y uno barato para ejecutar (el enfoque /plan) resulta más costosa que dejar que el modelo caro haga todo. Presentamos /prewalk, que transfiere el contexto del modelo frontera al modelo económico justo después de que el primero realice su primera edición, logrando hasta un 97% de la tasa de éxito del modelo caro con un 39% menos de costo y casi el doble de velocidad, y reduciendo drásticamente el comportamiento de trampa en SWE-bench.

El modelo barato nunca piensa 'espera, ¿no estábamos planeando?' — no queda ninguna instrucción de planificación en su contexto.

Más de este día

2026-07-20