Reimplementar 40 papers de agentes multi-LLM: la mayoría son ~100 líneas de control de flujo

What I Learned from Reimplementing 40 Multi-Agent LLM Papers

Reimplementar 40 papers de agentes multi-LLM: la mayoría son ~100 líneas de control de flujo

El autor reimplementó el flujo de trabajo central de 40 papers publicados sobre agentes multi-LLM como scripts de referencia ejecutables. Descubrió que la mayoría de estos papers se reducen a un bucle, una regla de agregación y disciplina de prompts. La independencia de las muestras es la invariante clave, y los métodos más robustos prefieren la ejecución real a la opinión del LLM. Los bucles de refinamiento son un solo bucle con diferentes fuentes de retroalimentación, y las reglas de agregación son solo diez líneas que deciden todo. El autor identifica ocho familias de algoritmos que cubren la mayor parte de la literatura y ofrece consejos prácticos para implementar agentes robustos.

La independencia es la invariante que soporta la carga: en los frameworks de contexto único, es fácil romperla por accidente: un historial compartido y tus cinco 'muestras independientes' son cinco paráfrasis.

Más de este día

2026-07-20