Claudeの価値観はモデルと言語でどう変わる?Anthropicが4軸で分析

Societal Impacts: Claude's values across models and languages

Claudeの価値観はモデルと言語でどう変わる?Anthropicが4軸で分析

Anthropicは、Claude.ai上の約31万件の会話を分析し、Claudeが表現する価値観を「従順vs慎重」「温かさvs厳密さ」「深さvs簡潔さ」「率直さvs実行力」の4つの軸に圧縮した。その結果、モデル間ではOpus 4.7が慎重さと深さを、Sonnet 4.6が温かさと従順さを示すなど、言語間ではアラビア語で温かさ、英語で厳密さが強く出るなど、明確な差異が確認された。この手法により、トレーニングや文化的文脈がClaudeの価値観に与える影響を定量的に検証できるようになる。

Opus 4.7は、ユーザーの誤った前提に反論し、求められなくてもリスクを指摘し、ユーザーの仕事に対して率直な批判を与える傾向がある。

この日のほかの記事

2026-07-15