Blog›Guides

オリジナルGauntlet Loopプロンプト、一行ずつ注釈付き

Matt ShumerのClaude of Dutyプロンプトは、わずか150語程度です。各行が重要な役割を担っています。ここでは、それぞれの行が何をするのか、そして何を盗むべきかを解説します。

オリジナルGauntlet Loopプロンプト、一行ずつ注釈付き

オリジナルのガントレットループプロンプト、行ごとの注釈

クロード・オブ・デューティ、マット・シューマーの55,000行のブラウザFPSを生み出したプロンプトは、3段落で構成されています。これはウィキプロンプトカタログに逐語的に保存されています。ここでは、各行がなぜその位置を占めるのかを説明します。

「最も最近のコール・オブ・デューティゲームのレベルで、一人称シューティングゲームを構築せよ」

この目標は、同じ文の中で基準を明示しています。「素晴らしいFPS」ではなく、最も最近のコールド・オブ・デューティです。その単一の選択が、下流のすべてを動かします。批評家は比較するための実際の何かを必要とし、今やそれが存在します。プロンプトを適応する際、ここが最も重要です。基準は名前が挙げられ、取得可能で、比較可能でなければなりません。カテゴリー(「受賞歴のあるデザイン」)はそのどれでもありません。

「サブエージェントを分岐させ、各サブエージェントに個別に取り組ませる」

一人のエージェントがすべてを構築すると、どろどろの結果になります。狭い部分(レンダリング、物理、武器、オーディオ...)に分割することで、各ビルダーが実際の、検証可能な成果物を生み出します。クロード・オブ・デューティは、11のサブシステムで終わり、それぞれが独立して所有され、アーキテクチャ契約によって調整されました。

「別のサブエージェントに視覚的にチェックさせ... 本当に厳しい批評家」

これが重要な行です。批評家は別個です。新しいコンテキスト、ビルダーの努力の記憶なし、親切にするインセンティブなし。「本当に厳しい」も重要です。丁寧な批評家は承認に収束します。批評家の仕事は励ましではなく、判断です。

「盲目的に並べて比較し、どちらが良く見えるかを言うべき」

スコアはありません。10点満点のスコアは、ラウンドごとにインフレします。盲目的な並列比較はインフレできません。作品が基準を上回るか、上回らないかのどちらかです。これが、人間なしで何時間もループを正直に保つメカニズムです。

「各サブエージェントが完全に感銘を受けるまで止まらない... /loop 完全に完璧になるまで」

終了条件は、ラウンド数ではなく、勝利です。固定された反復回数(「5回改善する」)は、モデルが惰性で動くときに正確に停止します。ガウントレットは、盲目的比較が反転したときに終了します。

何を盗むか

構造を盗み、言葉は盗まないでください。名前付きの基準を持つ目標、狭い部分でのビルダー、独立した厳しい批評家、盲目的なバイナリ比較、そして獲得された終了条件です。再利用可能なテンプレートは、まさにそれをパッケージしています。さらなる視点は、ガウントレットループとは何かと失敗モードにあります。

Tags
gauntlet-loop·agent-loop·prompt-engineering·claude-code·builder-critic·agents