Claude/GPTの知識カットオフを探る:プロービングで見えた学習タイムライン

Exploring Claude/GPT Knowledge Cutoffs and Pre-Training Timelines

Claude/GPTの知識カットオフを探る:プロービングで見えた学習タイムライン

フロンティアモデルの学習過程を、API経由のプロービングで推定する試み。Wikipediaの日次事実クイズで各モデルの知識カットオフを測定し、GPT-5.6ファミリーがGPT-5.5とは別のチェックポイント(2026年2月末頃)に由来することや、Opus 4.7以降のAnthropicモデルが同じ学習ラン(2025年12月末カットオフ)に由来することを示す。また、モデルが自称するモデル名や日付から、学習データにユーザーのチャットが混入している証拠や、OpenAIモデルが他社モデルと誤認されにくい一方、AnthropicのSonnet 5がGPT-4と自称する傾向などを明らかにする。

OpenAIのモデルが他社のモデルと誤認されることはほぼないのに、AnthropicのSonnet 5は定期的に自分をGPT-4と名乗る——これは意図的な蒸留とは考えにくいが、古いChatGPTのチャットがClaudeの学習データに混入している可能性はある。

同じ日のその他の記事

2026-08-10