TL;DR

멀티에이전트 하네스에서 QA/리뷰어 에이전트가 다른 에이전트 산출물을 심각도 등급으로 점검하고 수정→재검증 루프를 돌려 단일 에이전트 환각을 팀 레벨에서 억제하는 패턴.

출처별 관점

research/20260617-harness-engineering-multiagent-ttimes

  • harness-100의 각 하네스에는 최소 1명의 리뷰어/QA 에이전트가 포함되며, 다른 에이전트의 산출물을 소비만 한다 [2].
  • 리뷰어는 발견을 🔴Must Fix / 🟡Should Fix / 🟢Note 3단계로 분류하고, 🔴이면 SendMessage로 수정 요청 후 재검증(최대 2회)하는 루프를 갖는다 [2].
  • 산출물 간 관계(전략↔스크립트, 스크립트↔썸네일 등)의 일관성을 점검하는 ‘크로스-체크 매트릭스’가 핵심으로, 단일 에이전트 환각을 구조적으로 억제한다 [2].

research/2026-06-20-claude-code-nested-subagents-business

  • 영상은 구현 agent와 리뷰 agent를 별도 context window로 분리하면 구현 흐름의 편향을 줄일 수 있다고 설명한다 [1].
  • 데모에서는 reviewer가 correctness reviewer를 다시 띄워 nested subagent를 QA specialization 용도로 사용한다 [1].
  • 공식 문서는 read-only reviewer에서 Read-only 도구만 남길 수 있다고 설명하므로, reviewer agent cross-check는 역할뿐 아니라 tool permission으로도 제품화될 수 있다 [2].

관련 개념