Anthropic、Claudeの内部に「思考の作業場」J-spaceを発見
A global workspace in language models

Anthropicの新しい研究で、言語モデルClaudeの内部に、人間の意識的にアクセス可能な思考に似た、特別な神経パターンの集合「J-space」が存在することが明らかになった。J-spaceは訓練中に自然に出現し、モデルが言葉にしない内部思考を表現する。ClaudeはJ-spaceの内容を報告でき、指示に応じて変調でき、多段階の推論に使用する。J-spaceを操作することで、Claudeの回答や意思決定を変えられることが実験で示された。この発見は、Claudeの内部構造が人間の脳のグローバルワークスペース理論と類似していることを示唆する。
J-spaceは設計されたものではなく、Claudeの訓練プロセス中に自然に出現した。