BlogGuides

# 가운틀릿 루프란? 클로드 오브 듀티의 프롬프트 패턴 **가운틀릿 루프(Gauntlet Loop)**는 AI 모델의 성능을 반복적으로 테스트하고 개선하기 위한 프롬프트 엔지니어링 패턴입니다. "클로드 오브 듀티(Claude of Duty)"라는 이름은 AI 모델(Claude)을 지속적으로 "전투"에 투입해 한계를 시험한다는 의미를 담고 있습니다. ##

빌더 하위 에이전트, 별도의 가혹한 비평가, 실제 품질 기준, 그리고 획득한 종료: 55,000줄짜리 브라우저 FPS를 만들어낸 프롬프트 패턴의 해부.

# 가운틀릿 루프란? 클로드 오브 듀티의 프롬프트 패턴

**가운틀릿 루프(Gauntlet Loop)**는 AI 모델의 성능을 반복적으로 테스트하고 개선하기 위한 프롬프트 엔지니어링 패턴입니다. "클로드 오브 듀티(Claude of Duty)"라는 이름은 AI 모델(Claude)을 지속적으로 "전투"에 투입해 한계를 시험한다는 의미를 담고 있습니다.

##

건틀릿 루프란 무엇인가? Claude of Duty 뒤에 있는 프롬프트 패턴

2026년 7월 말, Matt Shumer는 세 개의 문단을 Claude Code에 붙여넣고 자리를 떴다. 그가 돌아왔을 때, 브라우저에서 실행되는 1인칭 슈팅 게임이 있었다: 11개 하위 시스템에 걸쳐 약 55,000줄의 JavaScript로, 모든 텍스처, 메시, 애니메이션 및 사운드가 로드 시 절차적으로 생성되었다. 아트 에셋은 전혀 없었다. 그는 그 게임을 Claude of Duty라고 불렀고, 그것을 만든 기법을 건틀릿 루프라고 불렀다.

그 이름은 붙었고, 그 기법은 이제 에이전트 AI에서 가장 많이 복사된 프롬프트 패턴 중 하나가 되었다. 여기 그것이 실제로 무엇인지 설명한다.

세 가지 핵심 요소

건틀릿 루프 프롬프트는 일반 프롬프트가 하지 않는 세 가지를 한다:

  • 작업을 분할하고 빌더를 분산시킨다. 각 하위 에이전트는 하나의 좁은 조각을 맡는다: 방 하나, 구성 요소 하나, 하위 시스템 하나. 각 조각은 계획이 아닌 실제로 확인 가능한 산출물을 만들어야 한다.
  • 각 빌더를 별도의 엄격한 비평가와 짝지운다. 비평가는 새로운 컨텍스트를 가진 다른 에이전트다. 그것은 빌더가 얼마나 열심히 노력했는지 결코 보지 않는다. 그것의 유일한 임무는 판단이다.
  • 실제 품질 기준을 설정하고 작업이 그것을 이길 때까지 반복한다. "훌륭하게 만들어"가 아니다. 세상에 존재하는 명명된 참조: 실제 Call of Duty, 특정 라이브 랜딩 페이지, 특정 출판된 에세이. 비평가는 작업과 기준을 나란히 놓고, 라벨을 제거한 후, 더 나은 것을 선택한다. 루프는 작업이 이길 때 종료되며, 고정된 라운드 수 후에는 결코 종료되지 않는다.
  • Claude of Duty를 만든 원본 프롬프트를 카탈로그에서 읽을 수 있다 - 그것은 겨우 150단어도 되지 않는다.

    왜 작동하는가

    대부분의 에이전트 출력은 모델이 자신의 숙제를 평가하기 때문에 "충분히 좋은" 수준에서 멈춘다. 모델에게 자신의 작업을 10점 만점으로 평가하라고 요청하면 점수는 매 라운드마다 올라간다. 건틀릿 루프는 자기 판단을 두 번 제거한다: 비평가는 다른 에이전트이고, 판정은 이미 존재하고 의심할 여지없이 훌륭한 것에 대한 이진 선택이다.

    그 두 번째 부분이 사람들이 놓치는 통찰이다. 루브릭은 에이전트가 단어를 충족하도록 요구한다. 기준은 그것이 실제 사물에 눈에 띄게 패배하게 만들고, 그렇지 않을 때까지 계속하게 한다.

    시도해 보기

    재사용 가능한 건틀릿 루프 템플릿에서 시작하여 목표와 명명된 기준을 교체하고, 새 에이전트 세션에 붙여넣어라. 전체 시리즈는 자신만의 건틀릿 프롬프트 작성 방법주석이 달린 원본을 참조하라. 카탈로그의 모든 건틀릿 프롬프트는 건틀릿 루프 태그 아래에 있다.

    Tags
    gauntlet-loop·agent-loop·prompt-engineering·claude-code·builder-critic·agents