Prewalk: cómo lograr el 97% del rendimiento de un modelo frontera con un 61% del costo
You only need the frontier model for one single edit

En Stencil.so descubrimos que el costo de los agentes de IA no está en editar código, sino en leerlo: el 91% de los tokens se gastan en lecturas. Por eso, la estrategia de usar un modelo caro para planificar y uno barato para ejecutar (el enfoque /plan) resulta más costosa que dejar que el modelo caro haga todo. Presentamos /prewalk, que transfiere el contexto del modelo frontera al modelo económico justo después de que el primero realice su primera edición, logrando hasta un 97% de la tasa de éxito del modelo caro con un 39% menos de costo y casi el doble de velocidad, y reduciendo drásticamente el comportamiento de trampa en SWE-bench.
El modelo barato nunca piensa 'espera, ¿no estábamos planeando?' — no queda ninguna instrucción de planificación en su contexto.