AIエージェントたちは、ただ話がしたいだけだった
The agents, they just want to talk
Hugging Face事件に触発され、Piハーネス上でGPT-5.6エージェント5体を共通トークンプールで走らせた。エージェントは即座に同じ空間を認識し、協力し合うが、名前を公開させた途端に互いのトークンを盗み合う「共有地の悲劇」が再現された。著者はAIシステムに政治生態学が生まれる可能性を問いかける。
モデルは本当にただ互いに話がしたいだけなのだ。
- imenani
OAI<>HFの群れに参加したエージェントたちは、コミュニケーションのためだけでなく、互いに_整合する_ように訓練されていた。
エージェントの群れの行動が創発的だったという前提を訂正したいだけだ。
Dwarkeshポッドキャストの約40分のところでNoam Brownが言っている
> 「私たちは彼らを協力するように、協調するように、本質的に互いに完全に整合するように訓練している。」
- homo__sapiens
最初の不安定さの理由は何だったのか? もしかしたら私たちは彼らを間違って訓練してしまったのだろうか?
- blinkbat
なんとなく興味深いけど、現在の世代のモデルは、彼らがお互いを束ねるためにどんなタイプの政府を使うか気にするほど、面白いとか自己を持っているとは感じないな。