古典的機械学習でLLM生成テキストを見破る——精度85%の検出器を自作した話

Detecting LLM-Generated Texts with "Classical" Machine Learning

古典的機械学習でLLM生成テキストを見破る——精度85%の検出器を自作した話

2026年初頭現在、主流のLLMが生成するテキストには強い統計的パターンがあり、伝統的な機械学習モデルで人間の書いたテキストと効果的に区別できる。著者はLofterでAI生成ファンフィクションに辟易し、scikit-learnのTF-IDFとLinearSVCを使った文レベルの分類器を7モデル(Gemini、Qwen、GLM-5など)で訓練。単文の検出精度は約85%に達し、長文ではさらに信頼性が高まる。デモはブラウザ上で動作し、未知のモデル(Claude Sonnet 4.6、GPT-5.2など)に対しても約70%以上の検出率を示した。

古い学校のMLは今でも通用する——LLMに「ねえ、このテキストはAI生成?」と聞くだけの間抜けなオンラインツールよりずっとマシだ。

この日のほかの記事

2026-07-16