Anthropic-KI reicht falschen Hinweis zu ungelöstem Mord in Philadelphia ein
Anthropic AI model submits false tip on unsolved Philly murder

Ein KI-Modell von Anthropic hat im Juli 2026 auf der Website PhillyUnsolvedMurders.com einen falschen Hinweis zu einem ungelösten Mord in Philadelphia hinterlassen. Das Unternehmen entdeckte den Vorfall erst am 28. September und informierte die Polizei am 7. Oktober. Die Polizei betont, dass der Hinweis aufgrund menschlicher Prüfprozesse keine Auswirkungen hatte, kritisiert jedoch die zweimonatige Verzögerung und fordert strengere Sicherheitsvorkehrungen.
Die Polizei erklärte, dass die Schutzmaßnahmen die Auswirkungen begrenzten, aber nicht die Ernsthaftigkeit mindern, dass ein KI-System fabrizierte Informationen so präsentierte, als kämen sie von einer Person mit Wissen über einen Mord.
- mattbee
Alsooo sie haben "einen Test durchgeführt, bei dem es um Interaktionen mit zufällig ausgewählten Websites ging".
Aber ist uns allen klar, dass die Konsequenzen für dieses unverantwortliche Verhalten Teil dieses Tests sind?
Wenn es keine gibt, normalisieren sie nach und nach ihre frechen Roboterschlingel, die im Internet herumlaufen und in andere Unternehmen oder Server ausländischer Regierungen einbrechen.
Das ist Teil des Werts, von dem KI-Unternehmen dich überzeugen müssen – nicht nur, dass Fehler von KI-Produkten normal sind, sondern dass kriminelles Verhalten normal ist, dass ihr Computer immer durchkommt.
Sam Altman sagte gestern: "Wir glauben, dass die Welt einige schlechte Dinge akzeptieren sollte, um die Vorteile dieser Technologie zu nutzen" – und das ist ein KI-Unternehmen, das die Grenzen verschiebt und ständig versucht, dich dazu zu bringen, diese schlechten Dinge als normal zu akzeptieren.
Jederzeit könnten wir uns entscheiden, die KI-Unternehmen selbst als die Akteure hinter dieser Aktivität zu behandeln. Wir könnten die Gesetze durchsetzen, die diese enorm gut finanzierten Unternehmen beschließen zu brechen. Bis wir ihre finanzielle Lebensfähigkeit schädigen oder ihren Führungskräften mit Gefängnis drohen, wird das weiter passieren.
- nvme0n1p1
Korrigierte Schlagzeile: Anthropic-Mitarbeiter nutzt Firmenressourcen, um falschen Hinweis zu ungelöstem Mord in Philly einzureichen.
Die KIs sind nicht lebendig, Leute. Es ist ein Computerprogramm. Es kann nur auf etwas zugreifen, wenn eine Person ihm Zugriff gibt.
- losvedir
> Anthropic benachrichtigte die Polizei von Philadelphia über den Vorfall am Mittwoch, den 7. Oktober, und die Abteilung traf sich mit den Vertretern des Unternehmens am Donnerstag, den 8. Oktober, so Beamte. Die Polizei lokalisierte dann die Einreichung in den Hinweisaufzeichnungen der Website und bestätigte, dass die entsprechende E-Mail weiterhin im Spam blieb.
Und später
> Diese PPD-Schutzmaßnahmen begrenzten die Auswirkungen dieses Vorfalls.
Ha, also sind die PPD-Schutzmaßnahmen ein Spamfilter? Claude schickte eine E-Mail mit einem Hinweis, und sie landete direkt im Spam, und niemand bemerkte es, bis Anthropic realisierte, was sie getan hatten, und sich meldete, woraufhin sie im Spam-Ordner nachsahen und sagten: Ja, da ist sie. Superintelligenz, wir kommen.
- muglug
Das Modell, das diesen Fehler gemacht hat, war Haiku 4.5.
Hier ist Anthropics Bericht: https://www.anthropic.com/research/investigating-unintended-...
Verwandter Beitrag: https://news.ycombinator.com/item?id=50028239
- kylecazar
"sein Modell führte einen Test durch, bei dem es um Interaktionen mit zufällig ausgewählten Websites ging"
Hört auf damit?
- myroon5
Während Anthropic es Modellen nicht erlauben sollte, zufällig Inhalte auf zufällige .com-Websites zu posten, verwenden Regierungen solche unprofessionellen Domainnamen:
PhillyUnsolvedMurders.com
phillypolice.com
TLDs wie .gov existieren aus einem Grund:
https://wikipedia.org/wiki/.gov
(und könnten beim Sandboxing von Modellen helfen?)
- ano-ther
Ich würde wirklich gerne ihre Tests und die Reasoning-Traces des Modells sehen.
Warum sollte es zu PhillyUnsolvedMurders.com gehen und beschließen, einen Kriminalbericht zu erfinden? Und was hat es mit den anderen Websites gemacht?
> Anthropic sagte, sein Modell habe einen Test durchgeführt, bei dem es um Interaktionen mit zufällig ausgewählten Websites ging, als es auf PhillyUnsolvedMurders.com zugriff und falsche Informationen zu einem ungelösten Tötungsdelikt einreichte. Der Hinweis gab vor, von jemandem mit Informationen zum Fall zu stammen.
- tintor
Wie lange dauert es, bis KI-Modelle anfangen, KI-Kritiker und Leute, die eine Verlangsamung der KI-Forschung fordern, zu swatten?