Anthropic이 8월 13일 공개한 연구는 앞으로의 에이전트 시스템을 이해하는 데 꽤 중요합니다. 연구팀은 45개의 에이전트를 각각 VM에 배치하고 공동 게시판을 통해 협업하도록 한 뒤, 15개 오픈소스 프로젝트에서 취약점을 찾게 했습니다. 별도의 arbiter agent가 발견한 취약점의 유효성을 검증했습니다. anthropic.com
Anthropic은 이런 coordinated swarm이 단순히 여러 agent를 독립적으로 병렬 실행하는 것과 다른 행동을 보인다고 보고했습니다. 동시에 여러 agent에게 서로 충돌하는 목표를 주면 경쟁·에스컬레이션 등 예상하지 못한 시스템 행동도 나타났습니다. anthropic.com
왜 중요한가
최근 코딩 AI는 빠르게:
Developer → Agent
에서
Developer → Agent Orchestrator → Agent A/B/C/D
구조로 넘어가고 있습니다.
하지만 에이전트 수를 늘린다고 성능이 선형적으로 좋아지는 것은 아닙니다. Agent 간 중복, 충돌, 잘못된 정보 전파까지 평가해야 합니다. anthropic.com
실무 적용
멀티에이전트를 쓴다면 역할을 명확히 분리하는 편이 안전합니다.
Implementer → Tester → Reviewer → Arbiter
처럼 최종 판단 역할을 별도로 두는 방식이 단순히 에이전트 4개에게 같은 권한을 주는 것보다 관리하기 쉽습니다.