Agoté todos mis tokens investigando cómo ahorrar tokens

I burned all my tokens researching how to save tokens

Agoté todos mis tokens investigando cómo ahorrar tokens

En Quesma investigamos la economía de los agentes de IA: cuánto cuesta realmente la codificación agéntica y qué se puede hacer al respecto. El autor construyó un pipeline de investigación profunda con agentes que agotó el límite de su plan de Claude Max 5x en 30 minutos, sin resultados. Este artículo explica cómo lo solucionó usando suscripciones que ya pagaba (Claude, Codex y Antigravity), compartiendo memoria entre ellas y asignando modelos más baratos como subagentes. El resultado: investigó 10 veces más tiempo sin pagar más, redujo las alucinaciones con reglas de verificación explícitas y construyó una base de conocimientos fiable en Obsidian. Incluye hallazgos sorprendentes sobre el costo real de los tokens, como que el harness puede importar tanto como el modelo o que la compactación de contexto puede duplicar la factura.

Ningún agente te dirá nunca que tu propia regla es el error.

Más de este día

2026-07-19