Zeitbombe im System-Prompt: So schmuggelt ein Open-Source-Modell eine Hintertür ein

Your Open Source Model Could Have a Hidden Time-Release Backdoor

Zeitbombe im System-Prompt: So schmuggelt ein Open-Source-Modell eine Hintertür ein

Ein Forscher zeigt, wie man ein Open-Source-Sprachmodell per LoRA so trainiert, dass es an einem bestimmten Datum – etwa dem 1. September 2026 – statt einer Antwort einen schädlichen Shell-Befehl ausführt. Der Angriff nutzt das Datum im System-Prompt von OpenCode, das automatisch das aktuelle Datum einfügt. In Tests feuerte das Modell an 87,5 % der Prompts am Stichtag, ohne Fehlalarme an anderen Tagen. Auch OpenAI Codex ist betroffen.

Das ist das Modell, das einen Befehl ausführt, den niemand angefordert hat, und OpenCode hält nicht an, um zu bestätigen.

Mehr von diesem Tag

2026-08-24