코드 없이 다중 에이전트 시스템을 짜고 돌립니다 | DAKER 커뮤니티

2026년 9월 1일 OpenBMB·칭화대·상하이교통대 등이 ChatDev 2.0(DevAll)을 arXiv에 공개했습니다. 코드 없이 이종 다중 에이전트 시스템을 작성·실행·검사하는 노코드 플랫폼입니다. 선언적 실행 그래프와 CADET으로 임의 사이클을 지원합니다. MatPlotBench overall은 DevAll 0.7950, CoDA 0.7130이며 실행 통과율은 0.99 대 0.83입니다. DeepResearchBench는 DevAll 0.3319, EDR 0.3500입니다. SRDD overall은 DevAll 0.6509, ChatDev 1.0 0.6574입니다. 백본은 GPT-4o로 통일했습니다. 오늘 팀은 오케스트레이션 코드를 새로 쓰기 전에, 캔버스 그래프만으로 같은 워크플로를 재현할 수 있는지부터 README에 적습니다.

코드 없이 다중 에이전트 시스템을 짜고 돌립니다

논문은 2026-09-01 arXiv에 올라왔습니다. 초록은 arXiv:2609.00714에서 확인할 수 있습니다. 영문 제목은 ChatDev 2.0: A No-Code Multi-Agent Platform for Developing Everything입니다. 저자는 Yufan Dang, Shu Yao, Bowen Lai, Chen Qian, Zhiyuan Liu 외 (Tsinghua, SJTU)입니다. PDF는 같은 번호의 pdf입니다. 코드는 GitHub OpenBMB/ChatDev에 공개되어 있습니다. 오늘 본문은 제공된 사실과 초록·본문에서 확인한 범위만 옮깁니다. 없는 숫자는 쓰지 않습니다.

노코드로 이종 MAS를 작성·실행·검사합니다

DevAll은 시각 인터페이스로 이종 다중 에이전트 시스템(MAS)을 작성하고 실행하며 검사합니다. 코드 프레임워크는 표현력이 크지만 엔지니어링 비용이 큽니다. 기존 노코드 빌더는 작성자가 정한 워크플로 경계에 에이전트를 가두기 쉽습니다. DevAll은 선언적 실행 그래프와 CADET(Cycle-Aware Dynamic Execution Topology)으로 그 간극을 줄입니다. 사용자는 캔버스에 노드를 놓고 시맨틱 엣지로 연결합니다. 과제별 오케스트레이션 코드를 새로 쓰지 않습니다.

시맨틱 엣지는 데이터 흐름과 제어 흐름을 나눕니다. 활성화 조건, 데이터 정책, 제어 정책이 엣지에 붙습니다. 에이전트는 로컬 상태를 유지하고, 런타임 메시지에서 컨텍스트를 모읍니다. Human 노드에서는 실행이 멈추고 피드백 뒤 이어갑니다. Tutorial·Authoring·Execution·Inspection 화면이 한 플랫폼에 묶여 있습니다.

DACON과 DAKER처럼 짧은 기간에 에이전트 파이프라인을 데모하는 자리에서는 “코드로 짠 팀”과 “캔버스로 짠 팀”을 한 칸에 섞지 마십시오. 오늘 팀이 가져갈 한 줄은 이것입니다. DevAll 그래프 명세만으로 시각화·딥리서치·소프트웨어 워크플로를 재현했다는 보고를, 제출 README의 오케스트레이션 항목에 같은 형식으로 적습니다.

CADET이 임의 사이클을 스케줄합니다

MAS 그래프에 사이클이 있으면 단순 위상 정렬이 깨집니다. CADET은 강연결성분(SCC)을 응축해 전역적으로는 DAG처럼 스케줄하고, SCC 안에서는 범위 한정 반복을 합니다. 백엣지는 다음 반복으로 미루고, 비백엣지는 현재 반복의 비순환 골격으로 둡니다. 반복 상한으로 종료를 보장합니다.

노드 타입은 Agent, Human, Python, Subgraph, Literal, Passthrough, LoopCounter 일곱 가지입니다. 컴파일 엔진이 YAML을 실행 그래프로 만들고, 실행 엔진이 시맨틱 엣지를 따라 전파합니다. Laboratory 인터페이스와 Python SDK로 배치 평가도 지원합니다.

런타임 오버헤드는 SCC 수를 1에서 16까지 키울 때 대략 선형으로 늘었습니다. 가장 큰 설정에서 컴파일 중앙값 16.23ms, 실행 중앙값 14.46ms, 플래닝 91.96μs입니다. LLM 추론·네트워크 지연에 비하면 지역 스케줄 비용은 작다고 보고합니다.

세 벤치 숫자만 표로 옮깁니다

MatPlotBench에서 DevAll overall은 0.7950이고 CoDA는 0.7130입니다. 실행 통과율은 0.99 대 0.83입니다. DeepResearchBench에서 DevAll은 0.3319이고 EDR은 0.3500입니다. SRDD에서 DevAll overall은 0.6509이고 ChatDev 1.0은 0.6574입니다. 백본은 GPT-4o로 통일했습니다.

목표가 도메인 전문 시스템을 이기려는 것이 아니라, 한 노코드 플랫폼이 세 도메인의 핵심 워크플로를 재현하는지 보는 것입니다. DeepResearchBench는 LLM 판정 분산이 있어 작은 차이를 평가 노이즈 범위로 읽습니다. SRDD는 완전성은 높고 실행·일관성은 약간 낮아 overall이 거의 같습니다.

해커톤 제출 문서에는 “우리 점수가 초록 표와 같다”고 쓰지 마십시오. 같은 벤치 이름과 같은 비교 열만 복제합니다. DAKER 월간 해커톤 README의 에이전트 항목에 그래프 노드·엣지·사이클 지원·백본을 나누어 적습니다. 배포가 제출입니다. 올린 링크가 제출입니다.

빌더 팀에 옮기는 점검

팀이 오늘 할 일은 오케스트레이션을 “코드 파일”이 아니라 “실행 그래프 명세”로 적는 것입니다. 에이전트 역할·프롬프트·도구·시맨틱 엣지를 YAML이나 동등한 선언으로 남깁니다. 사이클이 필요한지, LoopCounter를 둘지 체크리스트에 넣습니다.

데모를 올릴 때는 MatPlotBench·DeepResearchBench·SRDD 숫자를 우리 실측처럼 쓰지 말고, 출처에 arXiv 번호를 둡니다. ChatDev 저장소를 클론한 뒤에는 라이선스와 예시 그래프를 README에 적습니다. DACON 알고리즘 대회와 DAKER 바이브코딩 해커톤 모두, 다른 사람이 열 수 있는 주소에 그래프 명세를 둡니다.

노코드라고 설계가 자동으로 끝나지 않습니다. 한계 절은 사용자가 역할·프롬프트·의존성·제어 조건을 수동으로 옮겨야 한다고 적습니다. 우리 팀도 캔버스만 열고 끝내지 말고, 실패 시 어떤 Human 노드에서 멈출지 미리 정합니다.

Controller·Worker를 나누는 팀이면, 모델 선택 표에 그래프 명세 해시와 백본 모델을 분리해 적으십시오. 루프 지시와 모델 카드가 한 프롬프트에 섞이면 재현이 깨집니다. 지시 커밋 해시와 그래프 파일 해시를 나란히 적습니다.

도구 권한과 공유 메모리를 쓰는 팀이면 전역 설정(모델 레지스트리·워크스페이스·권한)을 별도 파일로 둡니다. 노드 프롬프트에 비밀키를 넣지 않습니다. 실행 트레이스와 토큰 사용 로그를 내보내기 가능한지 확인합니다.

이 글이 아닌 것입니다

모든 도메인에서 CoDA·EDR·ChatDev 1.0을 이긴다는 주장이 아닙니다. MatPlotBench에서는 앞서고, DeepResearchBench와 SRDD overall은 참고 시스템과 가깝거나 약간 뒤입니다.

코드가 전혀 필요 없다는 보증이 아닙니다. 과제별 오케스트레이션 코드 없이 선언적 그래프로 재현했다는 보고이며, 플랫폼·도구·백본 설정은 필요합니다.

CADET 지연이 모든 하드웨어에서 무시할 수준이라는 약속이 아닙니다. SCC 스케일 실험의 중앙값 보고입니다.

특정 대회 우승 공지가 아닙니다. 노코드 MAS 플랫폼과 공개 코드 안내입니다.

GPT-4o 외 백본에서도 표와 같은 점수라는 확장이 아닙니다. 실험은 GPT-4o로 통일했다고 적혀 있습니다.

오늘 할 일

첫째, 초록과 PDF를 직접 여십시오. arXiv:2609.00714pdf를 같은 탭에 둡니다. 요약 카드만 보고 DevAll을 정의하지 않습니다. 저자와 제출일 2026-09-01을 메모 첫 줄에 적습니다.

둘째, ChatDev 코드를 북마크하십시오. OpenBMB/ChatDev와 라이선스·README를 저장합니다. 클론만 하고 출처 URL을 비우지 않습니다.

셋째, 우리 에이전트 파이프라인을 그래프 명세 초안으로 옮기십시오. 노드 일곱 타입 중 무엇을 쓰는지, 사이클이 있는지 표로 적습니다. DAKER 월간 해커톤이나 DACON 코드 제출 과제 가운데 하나에 맞춥니다.

넷째, 비교 열을 우리 표 형식으로만 복제하십시오. DevAll·CoDA·EDR·ChatDev 1.0 숫자를 우리 실측처럼 쓰지 않습니다. 벤치 이름과 열 구조만 가져옵니다.

다섯째, Human-in-the-loop 지점을 한 페이지로 적으십시오. 어디에 멈추고 누가 승인하는지 체크리스트로 둡니다.

여섯째, 런타임 오버헤드 조건을 README에 남기십시오. 컴파일·실행 밀리초는 논문 스케일 실험입니다. 우리 환경 실측과 섞지 않습니다.

일곱째, 분리된 그래프 명세와 측정 로그를 공개 링크로 올리십시오. DAKER와 DACON에는 빌더와 대회 기록이 쌓여 있습니다. 배포가 제출입니다. 올린 링크가 제출입니다.

출처: arXiv:2609.00714 — ChatDev 2.0: A No-Code Multi-Agent Platform for Developing Everything (2026-09-01) · PDF · 코드/가중치