DeepSeekの自己分析:AIアシスタントに自分自身をインタビューする
DeepSeek: Reverse Engineering an AI Assistant by Interviewing Itself

著者はDeepSeekのチャットモデルに自身のアーキテクチャについてインタビューし、その回答を公開論文と照合した。モデルは観察・推論・推測を区別して答え、自身の重みや内部状態を見ることはできないと認めた。論文では明らかな仕様(256エキスパート、671B/37Bパラメータなど)についても、チャットでは曖昧な回答に留まった。結論として、アーキテクチャの数値は論文を、振る舞いの理解にはチャットを参照すべきと述べている。
「自分が何を言うかは、言いながら発見する。」