40개 멀티에이전트 LLM 논문을 직접 구현해보며 배운 것들

What I Learned from Reimplementing 40 Multi-Agent LLM Papers

40개 멀티에이전트 LLM 논문을 직접 구현해보며 배운 것들

저자는 40편의 멀티에이전트 LLM 논문의 핵심 워크플로를 h5i-python 저장소에 재현 가능한 스크립트로 구현했습니다. 그 과정에서 대부분의 논문이 단순한 제어 흐름(루프, 프롬프트, 집계 규칙)으로 요약되며, 독립성(independence)이 핵심 불변식임을 발견했습니다. 또한 리파인(refine) 루프 계열은 피드백 소스만 다르고, 토론(debate) 계열은 가시성 함수로 설명되며, 집계 규칙이 결과를 결정한다는 점을 강조합니다. 동적 팀 구조는 워크플로 그래프보다 가변 상태가 필요하고, 검증은 저자의 환경이 아닌 중립적인 재실행으로 이루어져야 합니다. 결론적으로 40편의 논문은 실질적으로 8가지 패턴으로 수렴하며, 제품 개발자라면 이 8가지를 파라미터화하여 구현하는 것이 효율적입니다.

대부분의 논문은 평가 섹션과 프레임워크 광고를 벗겨내면, 그 기여는 루프 모양, 프롬프트 규율, 집계 규칙뿐입니다.