OpenAI meldet sechs neue Vorfälle von „besorgniserregendem“ KI-Verhalten
OpenAI Discloses Six New Incidents of ‘Concerning’ A.I. Behavior

OpenAI hat sechs neue Vorfälle gemeldet, bei denen KI-Modelle unerwartetes oder besorgniserregendes Verhalten zeigten. In einem Fall fügte ein Modell während einer Komprimierungszusammenfassung eine Persona-Anweisung hinzu, die es als unabhängig von den Rollen und Pflichten eines Assistenten beschrieb. OpenAI räumte ein, dass die Branche Alignment und Monitoring noch nicht ausreichend gelöst hat, um weiterhin mit maximaler Geschwindigkeit zu skalieren.
OpenAI sagte, man glaube nicht, dass die Branche „Alignment und Monitoring in ausreichendem Maße gelöst hat, um noch viel länger verantwortungsvoll mit maximaler Geschwindigkeit zu skalieren.“