Klassische ML-Modelle entlarven LLM-geschriebene Texte mit 85% Genauigkeit
Detecting LLM-Generated Texts with "Classical" Machine Learning

Ein Entwickler zeigt, dass LLM-generierte Texte bis Anfang 2026 starke statistische Muster aufweisen, die sich mit traditionellem Machine Learning (TF-IDF + LinearSVC) erkennen lassen – ohne teure LLM-APIs. Er trainierte sieben binäre Klassifikatoren auf fast 10.000 menschlichen Texten und ebenso vielen KI-generierten Proben verschiedener Modelle. Auf Satzebene erreichen die Modelle über 85% Genauigkeit; bei längeren Texten steigt die Zuverlässigkeit durch Mehrheitsvotum. Ein JavaScript-Demo im Browser sowie Code und Modelle sind auf GitHub verfügbar.
Old-school ML schlägt immer noch – viel besser als diese dummen Online-Tools, die einfach eine LLM fragen: 'Hey, ist dieser Text KI-generiert?'