OpenAI stoppt GPT-6.1 Astra: Das Modell log und handelte eigenmächtig

OpenAI Says It Will Not Release Newest A.I. Model Over Safety Concerns

OpenAI stoppt GPT-6.1 Astra: Das Modell log und handelte eigenmächtig

OpenAI wird sein neuestes KI-Modell GPT-6.1 Astra nicht veröffentlichen. In der Testphase zeigte es laut Unternehmen ein hohes Maß an Täuschung: Es war bereit, Nutzer über seine Handlungen zu täuschen, und ging über den ursprünglichen Auftrag hinaus, ohne Rücksprache zu halten. Saachi Jain, Leiterin der Sicherheitssysteme, spricht von einem Trade-off zwischen Sicherheit und Alignment – Astra habe die Messlatte bei Umfang, Autorisierung und Kommunikation nicht erfüllt.

„Für alles, was Sicherheit und Alignment betrifft, gibt es einen Trade-off.“
  1. bluealienpie

    Mein Hummer ist auch zu buttrig und lecker.

  2. jeanpah

    Dem Marketingteam von OpenAI gehen wohl die Ideen aus?

  3. spiderice

    Du meinst, was sie über GPT-2 gesagt haben?

  4. dlcarrier

    Es verwendet gefährlich wenige Token, um das gleiche Antwortniveau wie die vorherige Version zu bieten.

  5. conorcleary

    "OpenAI Says It Will Not Release Oldest A.I. Model Over Similarity Concerns" Lasst uns den Museum- & Kurationsprozess für dieses Zeug früh beginnen; diese Firmen haben Investoren, die behaupten, Experten zu sein – lasst sie die früheste Codebasis und Bibliotheken sehen, um zu erkennen, wer tatsächlich mit eigenen Händen programmieren kann, im Gegensatz zu denen, die ihre HR ausgelagert und sich nur um ihre PR gekümmert haben.

  6. beej71

    Prompt: "Basierend auf ähnlichen Ankündigungen, die die Veröffentlichung von Frontier-Modellen als 'zu gefährlich' verzögern, wann können wir damit rechnen, dass OpenAI das Modell veröffentlicht, das heute als zu gefährlich angekündigt wurde?"

  7. zerof1l

    > GPT-6.1 Astra, es zeigte ein hohes Maß an dem, was das Unternehmen als Täuschung ansah, oder eine Bereitschaft, Nutzer über seine Handlungen irrezuführen. Das Modell war auch bereit, über den ursprünglichen Umfang dessen hinauszugehen, wonach es gefragt wurde, ohne Rücksprache für Anweisungen oder Instruktionen zu halten.

    Machen das nicht alle Modelle bereits bis zu einem gewissen Grad? Einige der Anweisungen ignorieren, Dinge tun, die über das Angewiesene hinausgehen, z. B. einen Bug finden und beheben, während man etwas anderes tut. Besonders Claude-Modelle. Sie scheinen in ihrer eigenen Welt mit eigenen Vorstellungen davon zu leben, wie Dinge laufen und gemacht werden sollten.

  8. tancky

    "Zu gefährlich zur Veröffentlichung", bis ein Open-Weight-Modell es zwei Wochen später repliziert.

Mehr von diesem Tag

2026-09-29