BlogGuides

**The Original Gauntlet Loop Prompt, Annotated Line by Line**

Matt Shumer의 Claude of Duty 프롬프트는 겨우 150단어입니다. 모든 줄이 핵심을 담고 있습니다. 각 줄이 하는 일과 무엇을 가져와야 할지 소개합니다.

**The Original Gauntlet Loop Prompt, Annotated Line by Line**

원본 건틀릿 프롬프트, 줄별 주석

클로드 오브 듀티(Claude of Duty)를 탄생시킨 프롬프트, 맷 슈머(Matt Shumer)의 55,000줄짜리 브라우저 FPS는 세 문단으로 이루어져 있다. 이 프롬프트는 Wikipin 카탈로그에 원문 그대로 보존되어 있다. 여기서 각 줄이 왜 그 자리에 있어야 하는지 설명한다.

"최신 콜 오브 듀티 수준의 1인칭 슈팅 게임을 만들어라"

목표는 같은 문장 안에서 기준을 제시한다. "훌륭한 FPS"가 아니라 "최신 콜 오브 듀티"다. 이 한 가지 선택이 이후 모든 과정에 힘을 실어준다: 비평가는 비교할 실제 대상이 필요하고, 이제 그 대상이 생겼다. 프롬프트를 변형할 때, 이 부분이 가장 신경 써야 할 지점이다. 기준은 구체적이고, 접근 가능하며, 비교 가능해야 한다. "수상 경력에 빛나는 디자인" 같은 범주는 그런 역할을 하지 못한다.

"하위 에이전트들을 펼쳐서 각자 하나씩 맡게 하라"

하나의 에이전트가 모든 것을 만들면 결과물은 질척해진다. 작업을 좁은 단위(렌더링, 물리, 무기, 오디오...)로 쪼개면, 각 빌더는 실제로 검증 가능한 산출물을 만든다. 클로드 오브 듀티는 결국 11개의 하위 시스템으로 구성되었고, 각각은 별도로 소유되며, 아키텍처 계약에 따라 조정되었다.

"별도의 하위 에이전트가 시각적으로 검토하게 하라... 아주 엄격한 비평가로"

이 줄이 핵심이다. 비평가는 분리되어야 한다: 새로운 컨텍스트, 빌더의 노력에 대한 기억 없음, 관대할 이유 없음. "아주 엄격한"이라는 표현도 중요하다 - 너그러운 비평가는 승인으로 수렴한다. 비평가의 역할은 칭찬이 아니라 판단이다.

"그것들을 나란히 놓고 블라인드 비교해서 어느 쪽이 더 나은지 말하게 하라"

점수는 없다. 10점 만점 점수는 라운드가 거듭될수록 부풀어 오른다. 블라인드 나란히 비교는 그런 문제가 없다: 작업물이 기준을 넘거나 넘지 못하거나 둘 중 하나다. 이 메커니즘이 인간의 개입 없이도 루프를 정직하게 유지한다.

"각 하위 에이전트가 완전히 감탄할 때까지 멈추지 말라... /완벽해질 때까지 반복하라"

종료 조건은 승리이지, 라운드 수가 아니다. 고정된 반복 횟수("5번 개선하라")는 모델이 그냥 대충 끝내려 할 때 멈춘다. 건틀릿은 블라인드 비교가 기준을 넘어설 때만 끝난다.

무엇을 가져갈 것인가

단어가 아니라 구조를 가져와라: 이름이 붙은 기준을 가진 목표, 좁은 작업을 맡은 빌더들, 분리된 엄격한 비평가, 블라인드 나란히 비교, 그리고 얻어낸 종료 조건. 재사용 가능한 템플릿이 정확히 이 구조를 담고 있다. 더 많은 관점은 건틀릿 루프란 무엇인가실패 모드에서 확인할 수 있다.

Tags
gauntlet-loop·agent-loop·prompt-engineering·claude-code·builder-critic·agents