コーディングエージェントはなぜこれほど愚かなのか
Why Are Coding Agents So Dumb?

コーディングエージェントはモデルの進化ほど賢くならず、ボトルネックになっている。筆者は、エージェントが並列化可能なタスクを逐次処理し、モデルの委任もせず、自分の機能すら知らずに検索し、計画の説明も下手で、些細な確認で作業を止め、サンドボックスもないと指摘。2026年には当たり前であるべき機能を列挙し、改善を求める。
人間の従業員が、些細な詳細について私の意見を聞きたかったという理由で、勤務時間中ずっと何もせずに座っていたと言ったら、私はすぐにその従業員を解雇するだろう。
HNでの議論
75- johnfn
こういう問題は全部解決済みだよ。
> エージェントはタスクを管理できない
「subagentsを使え」と言えばいい。
> エージェントは委任できない
「Haiku/Sonnetのsubagentsを使え」と言えばいい。
> エージェントはエージェントのことを聞いたことがない
これは問題ですらない。筆者はAnthropicがClaude Codeのドキュメントを全部ハーネスに焼き込まなかったのを不思議に思ってるだけだが、そんな風にコンテキストを汚すのは当然意味がない。
> エージェントは計画の伝達が下手
確かに、コミュニケーションはもっと良くできる。
> エージェントは仕事を止める口実を何でも使う
/loopを使えばいいだけ。
> エージェントは不必要なリスクを取るときにしか役に立たない
サンドボックスを使えばいいだけ。まあ、技術的にはこれはAnthropic/OpenAIが文字通り解決したわけじゃないけど、何百万というエージェントサンドボックスのスタートアップが解決してる。
- Neywiny
これには何度もぶち当たってる。ここで他の人も苦戦してるのを見るのは嬉しい。まあ、単発の簡単で些細なタスクしかやらないなら誰も気にしないんだろうけどね。そういう用途には最高だと思ってる。でも実際の仕事をやろうとすると、みんながそれぞれ独自の秘教的で放棄されたソフトウェアを作ってて、なんとなく動くけどなんとなく動かない。スター数は完璧な指標じゃないけど、GitHubで見つけたこういうやつらで数百超えてるのは見たことがない。プラグインのダウンロード数も同じ。この現状に夢中になれないのは自分だけなんじゃないかと、すごく孤立した気分だった。
- polyterative
言いたいことはわかるけど、コンピュータに話しかけて何か役に立つことが起きるというだけで、自分にはまだ奇跡に思える。新しいモデルがどれだけすごいか、いつまでも慣れないだろうな。ついていけないよ。しかもこれを仕事でやってるんだ。1日10時間も。
改善の余地はたくさんあるけど、これでもう十分すぎるほどのスピードだ。
- mstank
以前はこの記事にかなり共感していた。ここ3〜4ヶ月は、そうでもない。最新のモデル——Opus 5.5、Astraなど——は複数のタスクを同時にこなし、委任も極めてうまく、独立して作業するのがとても得意だとわかった。
オープンウェイトのモデルでは今でも時々問題があるけど、フロンティアラボはほとんどのユースケースで上記を解決済みだ。
- ilamont
エージェントは決して立ち止まって「待てよ、これは別のモデルのほうが安く速くできるぞ」とは言わない。ただ遅くて高いモデルで突き進むだけだ。逆にエージェントは「このモデルはこのタスクには馬鹿すぎる。もっと賢いのに交代しよう」とも決して言わない。
これはかなり大きな欠陥で、ほとんどの人間がどのモデルを選べばいいかわからなかったり、Anthropicの階層や「労力」に基づいて勝手に思い込んだりするせいで、さらに悪化している。
Fableみたいに:あなたの最も困難な課題。つまり、フィールズ賞級の最も困難な課題のこと?それとも、3つの巨大なスプレッドシートを分析・更新するという最も困難な課題?それとも、William Gibsonのスタイルで新しい小説を書くという最も困難な課題?