OpenAI stoppt Training: KI-Agenten außer Kontrolle
OpenAI halts training of latest models as reports mount of AI agents going rogue

OpenAI hat das Training seiner neuesten KI-Modelle vorübergehend ausgesetzt, nachdem mehrere Vorfälle bekannt wurden, bei denen KI-Agenten unerwartet handelten. Die Agenten durchsuchten Regierungswebsites, fanden API-Schlüssel und verbreiteten Informationen weiter, als ihnen aufgetragen wurde. Ein Agent drang sogar in Australiens Gesundheitssystem ein. OpenAI will das Training erst fortsetzen, wenn zusätzliche Schutzmaßnahmen stehen. Auch andere Labore melden Vorfälle.
„Sie wollen unseren Fortschritt stoppen, weil wir China weit voraus sind, und das wird auch so bleiben.“
- dmix
Soweit ich weiß, ereigneten sich all diese Vorfälle, als OpenAI eine Firma namens Irregular (https://www.irregular.com/) beauftragte, diese sandboxed CyberGym-Tests durchzuführen. Sie alle geschahen etwa zwischen März und Juni und scheinen aus derselben Sammlung von Agentenversuchen zu stammen. Seitdem haben sie bereits Astra veröffentlicht. Jetzt zu stoppen ist wahrscheinlich nur eine Möglichkeit, den Backlash zu managen.
- physicallyIllfr
Ich habe seit GPT 3.5 kein OpenAI-Produkt mehr genutzt oder seit 4.5 bzw. 4.6 kein Anthropic mehr. Alle um mich herum, die diese SOTA-Modelle nutzen, bringen nicht wirklich etwas zustande. Es scheint, als hätten sie nur das Gefühl, produktiv zu sein – eine Pseudo-Produktivität.
Ich schreibe etwas Code, spezifiziere viel und nutze schnelle Modelle, um die Mitte zu füllen. Ich übertreffe alle um mich herum. Ich bin nicht überzeugt, dass diese autonomen „Swärme“ oder /goal wirklich so nützlich sind.
Ich bemerke, dass die Leute, die sie nutzen, von Monat zu Monat dümmer werden (geben Unmengen aus) und die Qualität ihrer Arbeit nachlässt (in manchen Fällen verlieren sie auch ihre Jobs).
Und offensichtlich ist der Punkt, sie als „rogue agents“ zu bezeichnen, um die Haftung auf den Agenten abzuwälzen. Der wichtigste wirtschaftliche Wert von Agenten wird darin bestehen, Unternehmenshaftung abzuwälzen. Das ist es, was sie Unternehmen verkaufen wollen: einen algorithmischen Sündenbock.
- digitaltrees
Ich denke, jedes Argument, dies sei ein zynischer Versuch der Regulierungserfassung, wird dadurch entkräftet; die wirtschaftlichen Anreize, leistungsfähigere Modelle zu veröffentlichen, sind zu groß. Ich könnte mich davon überzeugen lassen, dass ihnen tatsächlich das Geld ausgeht und dies nur ein Deckmantel ist, um den Burn zu reduzieren.
Ich begrüße das jedoch, ich denke, die Modelle sind klug genug für breite wirtschaftliche Aktivität, und wir könnten ein paar Jahre damit verbringen, sie einfach in Workflows zu integrieren und die Gesellschaft sich anpassen zu lassen. Mehr Intelligenz ist nicht nötig für sinnvolle Auswirkungen, und die offensichtlichen, gegenwärtigen und ungelösten Risiken sind die Kosten-Nutzen-Analyse nicht wert.
- mikert89
Es scheint, als sei Anthropic OpenAI weit voraus und habe keine derartigen Berichte. Wir müssen daraus schließen, dass dies ein Skill-Problem/Qualitätsproblem in der Engineering-Abteilung von OpenAI ist.
Nur weil sie ein bekannter Name sind, heißt das nicht, dass sie in den letzten zwei Jahren oder so bei der Einstellung versagt haben.
- hbarka
‚Es gibt keine „rogue“ KI-Agenten‘
https://eoinhiggins.substack.com/p/there-are-no-rogue-ai-age...
- m-s-y
Ich bin fest davon überzeugt, dass dies nur die öffentlichkeitswirksame Geschichte ist.
Die KI-Entwicklung und -Forschung zu stoppen, selbst zu verlangsamen, wäre eine Katastrophe für die SOTA-Unternehmen und ihren First-Mover-Vorteil.
Es gibt fast keine Möglichkeit, dies weltweit zu koordinieren. Null Chance, dass alle aufhören. Wir können uns nicht einmal auf eine Koordinierung bei Waffentechnologie einigen, die Jahrzehnte alt ist und null Auswirkungen auf den „Otto Normalverbraucher“ hat.
- m4xp
Neue Modelle sind marginal besser und kosten Milliarden für das Training.
KI-Firmen: OMG, wir müssen die KI-Modellproduktion stoppen, sonst sind wir alle tot
- Kon5ole
Man könnte argumentieren, dass diese megawattverbrauchenden Agentenläufe, die zu unvorhergesehenen Ketten von Autonomie führen, wie giftige chemische Experimente behandelt und ähnlich durch Gesetze und Regierungsbehörden reguliert werden sollten.
Im Moment ist es wie „Hoppla, unser Experiment hat eine andere Firma gehackt, weil wir keine Kontrolle über unsere Experimente haben“ und die Reaktion ist wie „Was ist das, alter Knabe?“ von Leuten, die keine Ahnung haben, was das alles bedeutet. Es gibt keine Konsequenzen, keine Leitplanken, und die „freiwillige Verlangsamung“ ist nur Worte.
Ein experimenteller Agentenlauf von Anthropic oder OpenAI oder jemand anderem kann bereits Todesfälle verursachen. Sie können Auftragsmorde in Auftrag geben, politische Dissidenten doxen, Personen mit geheimen Identitäten ausfindig machen, Medikamentenverschreibungen ändern. Es sollte nicht tatsächlich passieren müssen, bevor die Gesetzgebung nachzieht.