오픈AI 코덱스 개발자 "AI 에이전트 군집은 토큰 낭비"
오픈AI 코덱스 개발자 에릭 프로벤셔는 2개 이상의 병렬 서브 에이전트를 사용하면 품질 향상 없이 토큰만 소모하는 '조정 비용(coordination tax)'이 발생한다고 경고했다. 한 사례에서는 단일 파이썬 파일 리팩토링에 1,393개의 에이전트를 사용해 2만 달러의 토큰 비용이 발생했으며, 단일 에이전트로 훨씬 저렴하게 처리할 수 있었다는 것이다.
오픈AI 코덱스(Codex) 개발자, AI 에이전트 군집(swarm)은 품질 향상 없이 토큰을 대량 낭비한다고 경고
마티아스 바스티안 (2026년 9월 17일)
오픈AI의 코덱스 개발자 에릭 프로벤셔(Eric Provencher)가 에이전트 워크플로에서 무분별한 토큰 지출에 대해 경고했다. 그는 X(구 트위터) 게시물에서 두 개를 초과하는 병렬 서브 에이전트는 거의 항상 품질을 개선하지 못한 채 토큰만 태운다고 주장했다.
에이전트들은 서로를 신뢰하지 않아 결국 "서로의 숙제를 다시 검토하는" 상황에 빠진다. 프로벤셔는 이를 "조정 비용(coordination tax)"이라 부르며, "이렇게 많은 병렬 작업 흐름을 이탈 없이 유지하고 과도한 검증에 토큰을 태우지 않는 것은 정말 어렵다"고 말했다.
누군가 단일 파이썬 파일을 리팩토링하는 데 1,393개의 Fable 에이전트를 사용해 2만 달러 상당의 토큰을 지출한 프로젝트가 공개되자, 그는 단 하나의 Astra 에이전트로도 "비용의 극히 일부"로 처리할 수 있었을 것이라고 지적했다. 에이전트 군집은 시간은 절약할 수 있지만, 토큰 오버헤드는 하나의 '함정'이라는 것이다.
그가 제안한 접근 방식 중 하나는, 상태를 지속적으로 확인(polling)하는 대신 작업을 별도의 스레드에 위임하고 완료 시에만 메인 에이전트에 알리도록 하는 것이다. 또한 시스템 프롬프트(system prompt)도 서브 에이전트 수만큼 누적되며, 충분한 컨텍스트가 없으면 서브 에이전트들이 중복된 도구 호출을 하게 된다. "중복 노력이 가장 큰 문제입니다"라고 프로벤셔는 동의했다. 그는 오픈AI가 이 부분에서 여전히 더 나은 해결책을 내놓아야 한다고 인정했다.