Tu agente no es el modelo: por qué la distinción importa
Agent Is Not the Model
A menudo usamos 'agente' y 'modelo' como sinónimos, pero son capas distintas de un sistema. Este artículo desglosa la arquitectura: el modelo (como Sonnet o Gemini) es el núcleo matemático; el servicio de inferencia (como AWS Bedrock o la API de Anthropic) lo ejecuta; y el harness (como Claude Desktop o Cursor) es la lógica que da forma a las entradas y salidas. Con ejemplos reales y una analogía con la construcción, explica cómo identificar qué capa falla cuando algo sale mal. La precisión en el lenguaje permite mejorar más rápido.
Cuando puedes nombrar la capa, puedes arreglar la capa.
- agentdev001
El post termina con un comentario sobre "no es ser pedante..." así que, un par de cosas no pedantes:
En la tabla "Ejemplos del mundo real";
"Claude Desktop" alberga tres arneses en este momento; Claude, Claude Cowork, y Claude Code.
"Claude CLI", supongo, se refiere a la CLI de Claude Code. Esto es distinto de la 'ant CLI', que a veces se llama 'Claude CLI'.
"Cursor" podría ser cualquiera de ellos, pero 'Cursor Agents', 'Cursor Cloud Agents', 'Cursor CLI', y como se llame ahora el fork de vscode, son distintos. Quizás no en el contexto de este blog post, pero no se especifica a cuál se refiere en la tabla de ejemplos.
"ChatGPT" suena como la interfaz web de chatgpt. La aplicación de escritorio de OpenAI se llama 'ChatGPT Desktop', y ahora alberga 'ChatGPT work' y 'Codex' (Codex Desktop, no la TUI, aunque esencialmente envuelve la TUI y le da capacidades a través de herramientas integradas en la app). Creo que el arnés de la interfaz web de ChatGPT puede cambiar un poco, dependiendo de la configuración y el nivel de suscripción (sandboxes remotos, etc.). Además, hay una distinción en los modelos disponibles según qué producto "ChatGPT" se esté usando (instant/live/etc no-5.6 luna/terra/sol suite).
El servicio de inferencia es más precisamente 'proveedor de inferencia por defecto'.
Además, este post tiene un olor a generado por IA.
- azath92
Si el objetivo es proporcionar una distinción entre modelo y agente, creo que el "sistema de agente" está haciendo demasiado trabajo pesado en el ejemplo aquí.
Una extensión útil de este marco mental que uso cuando intento hacer esta distinción es la aplicación (cursor) -> que a veces incluye un orquestador y todas las cosas de calidad de vida como reanudar, checkpointing, etc. agente o agentes individuales (agentes de cursor) -> y ejecuta una instancia o muchas instancias de agente (agente individual en cursor) -> API de servicio -> modelo.
Esto es para abordar una confusión que a menudo veo con agente siendo confundido con la aplicación en la que usamos agentes, en lugar de la distinción en el artículo que intenta desentrañar la confusión agente-modelo.
- 6keZbCECT2uB
Una divertida es que en claude code, puedes configurar 'agentes' que son preajustes de prompt + algo de configuración. O sub-agentes a veces son indistinguibles del agente en primer plano (generalmente llamado orquestador) en configuración excepto que tienen diferentes contenidos en su ventana de contexto (forks más o menos).
IMO, si hay un término ubicuo que no es ambiguo, úsalo (arnés, modelo). Si hay un término ambiguo que tienes que explicar, intenta no usarlo. El lenguaje es para comunicarse.
- yaaaaam
Un agente, en general, es simplemente cualquier cosa que lleva a cabo una tarea en nombre de alguien/algo más.
- rwoerz
> Un sistema de agente está compuesto de varias capas.
¿Por qué "capas"? Los constituyentes de un Sistema Multi-agente (MAS) [1] se llaman "agentes". Por cierto: la difusión semántica sinecdóquica no es poco común en la ingeniería de software.