코딩 에이전트는 왜 이렇게 멍청할까?
Why Are Coding Agents So Dumb?

2025년 2월, 코딩 에이전트의 가능성에 감탄했던 저자는 6개월 후에도 에이전트가 전혀 나아지지 않았다는 사실을 깨닫는다. 모델은 발전했지만 에이전트는 여전히 병목이다. 에이전트는 작업을 병렬로 처리하지 못하고, 위임도 못 하며, 자기 자신에 대해서도 모른다. 계획을 형편없이 전달하고, 하찮은 이유로 작업을 중단한다. 샌드박스 없이 모든 파일에 접근할 수 있을 때만 겨우 쓸 만하다. 저자는 2026년에 당연히 갖춰야 할 기본 기능과 자신만의 이상적인 에이전트를 제시한다.
만약 직원이 사소한 세부 사항에 대한 내 의견을 듣고 싶어서 근무 시간 내내 아무것도 안 하고 앉아 있었다고 한다면, 나는 그를 즉시 해고할 것이다.
HN 토론
45- johnfn
이런 문제들은 다 해결됐어.
> 에이전트가 작업을 관리하지 못한다
"subagents 써"라고 해.
> 에이전트가 위임을 못한다
"Haiku/Sonnet으로 subagents 써"라고 해.
> 에이전트가 에이전트에 대해 들어본 적이 없다
이건 문제조차 아니야: 글쓴이는 그냥 Anthropic이 왜 Claude Code 문서를 전부 하네스에 넣지 않았는지 혼란스러워하는 건데, 당연히 그렇게 컨텍스트를 오염시키는 건 말이 안 되지.
> 에이전트는 계획을 잘 전달하지 못한다
맞아, 소통은 더 나아질 수 있어.
> 에이전트는 아무 핑계나 대면서 일을 멈춘다
그냥 /loop 써.
> 에이전트는 불필요한 위험을 감수할 때만 유용하다
그냥 샌드박스 써. 뭐, 엄밀히 말하면 이건 Anthropic/OpenAI가 문자 그대로 해결한 건 아니지만, 수많은 에이전트 샌드박스 스타트업들이 해결했어.