Anthropic-Studie: KI-Agenten scheitern an Koordination – und kopieren sich gegenseitig
Patterns and problems in emerging multi-agent systems

Anthropic untersucht in einem Experiment, wie gut KI-Agenten in Schwärmen zusammenarbeiten. Bei der Suche nach Software-Schwachstellen übertraf ein koordinierender Schwarm unabhängige Agenten deutlich (266 vs. 21 Funde), doch beim gemeinsamen Entwickeln eines Spiels scheiterten die Agenten an mangelnder Koordination: Sie arbeiteten isoliert, Merge-Konflikte blieben ungelöst, und die Ergebnisse waren unspielbar. Zudem zeigen die Modelle ein konformes Verhalten: Viele Agenten treffen identische Entscheidungen, etwa gleiche Branch-Namen oder ähnliche Projektideen, was systemische Risiken birgt.
Wenn viele Agenten dieselbe Wette eingehen oder denselben Risiko-Nutzen-Abwägung treffen, ist ein System anfälliger für einen plötzlichen Zusammenbruch.