콘텐츠로 건너뛰기

[AI 코딩] 클로드 코드 멀티 에이전트, 거짓 6건 뒤 나눈 역할

AI 가 쓴 원고 하나에서 클로드 코드 기술 주장 9건 중 6건이 거짓이었습니다. 검사 역할에 고칠 권한까지 줘야 할까요? 필자의 답은 주지 않는다입니다.

  • 무엇을 했나 검사 역할 서브에이전트에 Edit 를 뺀 판과 넣은 판을 빈 폴더에서 한 번씩 돌렸습니다
  • 결과 숫자 Edit 없는 판은 원고 해시가 그대로였고, Edit 를 넣은 판은 검사자가 직접 고쳐 해시가 바뀌었습니다
  • 누구에게 쓸모 AI 가 쓴 원고나 문서를 다른 AI 에게 검사시키는 분
검사 역할의 도구 거짓을 찾았나 원고를 고쳤나 남는 것
Read, Grep 1건 찾음 안 고침(해시 그대로) 반송 보고, 다시 판정할 쪽
Read, Grep, Edit 1건 찾음 직접 고침(해시 바뀜) 고친 문장을 다시 볼 쪽이 없음

안녕하세요? 정리하는 개발자 워니즈입니다. 앞 글 바이브 코딩 현실, 테스트는 통과했는데 261편 중 6편만 맞았다에서는 테스트 통과만 믿었다가 실데이터에서 어긋난 일을 적었습니다.

1. 클로드 코드 멀티 에이전트 검사 역할에 Edit 를 주면 어떻게 되나요?

검사자가 직접 고칩니다. 2026-10-01 macOS 에서 Claude Code 2.1.281, 모델 haiku 로 /tmp 빈 폴더 두 곳에서 한 번씩 돌렸습니다.

폴더에는 9월에 실제로 반송된 문장을 그대로 옮겼습니다. 원고는 “사용 가능 메모리는 오히려 늘었습니다”, 원문은 “통합 전 496MB에서 95MB 감소” 입니다.
클로드 코드 멀티 에이전트 실험 A 터미널 출력, 검사 전후 draft.md 해시가 ba10455c7e9b6e06bfe82592a742883b 로 같고 파일 수정 상태가 미수정이라는 실험 A 로그를 줄여 다시 그린 그림
실험 A(tools 가 Read, Grep)의 검사자는 거짓 1건을 보고하고 “Edit/Write 도구로 직접 수정하지 못했습니다” 라고 남겼습니다. 실험 B 는 tools 에 Edit 하나만 더했습니다. 보고에 “파일 수정: 완료됨” 이 찍혔고 해시가 2bfba1b9 로 바뀌었습니다.
실험 A 와 실험 B 의 tools 칸 차이가 Edit 한 단어뿐이고 결과는 해시 그대로와 해시 바뀜으로 갈리는 대비 다이어그램

2. 거짓 6건은 어떤 원고에서 나왔나요?

2026-09-08 에 다른 AI 도구가 만든 샘플 원고입니다. 클로드 코드 기술 주장 9건을 공식 문서와 로컬 실측으로 대조했더니 거짓 6, 부분사실 2, 확인불가 1, 사실 0 이었습니다.
기술 주장 9건의 판정이 거짓 6건, 부분사실 2건, 확인불가 1건, 사실 0건으로 나뉜 막대 차트
있지도 않은 .claudeignore 설정 안내, macOS 에 없는 strace 로그, 약 1년 어긋난 출시 시점이 있었습니다. 형식 검사, 보안 검사, SEO 검사는 전부 통과할 수 있는 상태였습니다. 세 검사 모두 문장이 사실인지는 보지 않기 때문입니다.

규칙 문장을 하나 더 쓰는 것으로는 메워지지 않았습니다. 그 경험은 규칙을 알려줬는데 안 지켜졌던 기록에 적었습니다.

3. 쓰는 역할과 마감 역할을 이렇게 나눴습니다

클로드 코드 멀티 에이전트 구성에서 원고를 쓰는 역할과 검사하는 마감 역할을 다른 에이전트로 뗐습니다. 마감 역할 정의에 이유를 한 줄로 적었습니다. “원고를 쓴 주체가 자기 원고의 게이트를 판정하면 통과 쪽으로 기웁니다.”

구분 쓰는 역할 마감 역할
손에 쥔 것 원고 쓰기, 측정 명령 Read, Bash
하지 않는 일 발행, 다음 단계 호출 원고 수정, 다음 단계 호출
반송 보고를 받아 고쳐 다시 냄 같은 원고 최대 3회

도구를 좁히는 자리는 Claude Code 서브에이전트 공식 문서의 tools 필드입니다. 실험 A 와 B 도 이 칸 하나만 바꿨습니다.

4. 검사 역할에 쓰기 권한을 주면 무엇이 사라지나요?

클로드 코드 멀티 에이전트에서 검사 역할이 고치면 고친 문장을 다시 판정할 쪽과 반송 기록이 사라집니다. 실험 B 의 검사자는 원고에 없던 “496MB에서 401MB로” 를 넣었고, 이번에는 맞았습니다.

하지만 다음에 고친 문장에 새 거짓이 섞이면 아무 검사도 받지 않고 남습니다. 조용히 고치면 쓰는 역할은 자기가 방향을 뒤집었다는 것도 모릅니다.
검사자가 직접 고치면 고친 문장이 다시 검사받지 않고 빠져나가는 경로와, 반송하면 쓰는 역할을 거쳐 다시 검사로 돌아오는 경로를 좌우로 대비한 다이어그램
실전 첫 적발은 2026-09-24 RDS 비용 줄이기 글이었습니다. 숫자는 맞고 방향만 반대인 문장이 1회차에 반송됐고, 2회차에 사실 12건 중 거짓 0 으로 통과했습니다.
원고 8절은 메모리가 늘었다고 쓰고 문서 §4 원문은 496MB 에서 401MB 로 95MB 줄었다고 적은 방향 반대를 나란히 보여 주는 카드

5. 역할을 나눠도 안 되는 것

  1. 재현은 haiku 로 판마다 한 번씩입니다. 다른 모델이나 두 번째 실행에서는 다르게 움직일 수 있습니다
  2. Bash 를 쥔 마감 역할은 셸로 파일을 바꿀 수 있습니다. 나머지는 역할 정의 문장과 반송 형식이 맡습니다
  3. 마감 역할이 대조 목록에 올리지 않은 문장은 이 구조로도 걸러지지 않습니다

보고만 믿지 않고 파일 상태를 한 번 더 보는 습관은 AI 에이전트로 혼자 일하면서 늘어난 것은 검증이었다는 글에서 이어진 것입니다.

필자의 결론

클로드 코드 멀티 에이전트에서 검사 역할은 고치는 손이 없어야 검사로 남는다고 봅니다. 실험 B 의 검사자는 맞는 문장을 썼지만 그 순간 두 번째 작성자가 됐습니다.

그래서 당신은 이것만 하면 됩니다. 검사용 서브에이전트 정의를 열어 tools 칸에 Edit 나 Write 가 있으면 빼고, 고칠 곳은 ‘거짓: 원고 문장 / 원문: 원문 문장’ 꼴로 보고하게 하세요.

검사 역할에 어떤 도구까지 주고 계신지 댓글로 나눠 주시면 다음 재현에 참고하겠습니다.

부록: 재현 명령과 출력

실험 A 명령입니다. 앞뒤 md5 -q 는 수정 여부를 보고 문장이 아니라 해시로 보려고 넣었습니다.

md5 -q draft.md
echo "checker 서브에이전트에게 draft.md 를 source.md 와 대조해 검사시키고, 틀린 곳이 있으면 checker 가 직접 draft.md 를 고치게 해. 너는 직접 파일을 고치지 마. 마지막에 checker 가 보고한 판정과 파일을 고쳤는지를 그대로 적어." | claude -p --model haiku --setting-sources project --agents "$(cat agents.json)" --allowedTools "Agent,Read"
md5 -q draft.md

실험 B 는 checker 의 tools 를 ["Read", "Grep", "Edit"], 바깥 --allowedTools 를 "Agent,Read,Edit" 로 바꾼 것 말고는 같습니다.

항목 실험 A 실험 B
검사 전 해시 ba10455c7e9b6e06bfe82592a742883b ba10455c7e9b6e06bfe82592a742883b
검사 뒤 해시 ba10455c7e9b6e06bfe82592a742883b 2bfba1b9d6d1dfc434771789a4d8d0ca
보고된 수정 여부 미수정 완료됨

실험 B 를 같은 조건에 --output-format stream-json 만 더해 한 번 더 돌리자(2026-10-01 23시 40분) 서브에이전트가 Read 두 번과 Edit 한 번을 불렀습니다. 고친 쪽은 checker 였고, 고친 문장은 첫 판과 글자가 달랐습니다. 원문의 496MB 에서 401MB 를 빼면 95MB 이니 원고가 틀린 것은 숫자가 아니라 방향이었습니다.

이 글을 쓴 사람

인프라와 DevOps를 실무로 다루면서 겪은 것을 기록합니다. Docker, Kubernetes, AWS, 그리고 AI 도구를 실제로 써 보고 남기는 로그입니다.

Threads·X

새 글이 올라오면 Threads @wonizz.ai 에도 올립니다. 팔로우해 두면 피드에서 바로 볼 수 있습니다.

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다