MIT-Methode erkennt KI-Modelle für Kindesmissbrauch, ohne Bilder zu erzeugen

MIT's New Method Flags AI Models Trained on CASM Without Generating It

MIT-Methode erkennt KI-Modelle für Kindesmissbrauch, ohne Bilder zu erzeugen

Forschende des MIT haben mit Gaussian Probing eine Prüfmethode entwickelt, die KI-Modelle identifiziert, die zur Erzeugung von Kindesmissbrauchsmaterial (CSAM) feinabgestimmt wurden – ohne ein einziges Bild zu generieren. Damit umgeht sie rechtliche und ethische Hürden, die bisherige Sicherheitskontrollen blockierten. In Tests mit drei Modelltypen erreichte die Methode 100 % Genauigkeit und unterschied CSAM-spezialisierte Modelle sogar von solchen, die für andere schädliche Inhalte optimiert wurden. Der Ansatz könnte Plattformen wie Hugging Face ermöglichen, Uploads automatisch zu screenen und gefährliche Modelle zu stoppen, bevor sie sich verbreiten.

„Das eröffnet Plattformen, die Open-Source-Modelle hosten, und Strafverfolgungsbehörden einen neuen Weg, tatsächlich zu testen, ob ein Modell CSAM erzeugen kann. Vorher hatten wir keine Möglichkeit, das zu messen. Es war ein riesiger blinder Fleck, den manche ausnutzten.“

Mehr von diesem Tag

2026-07-13