Blog›Guides

什么是Gauntlet Loop?Claude of Duty背后的提示词模式

构建子代理、一个独立的严格评审者、真正的质量门槛以及凭实力获得的退出机制:这一提示词模式的剖析,造就了一款55,000行的浏览器FPS游戏。

什么是Gauntlet Loop?Claude of Duty背后的提示词模式

什么是 Gauntlet Loop?Claude of Duty 背后的提示模式

2026年7月下旬,Matt Shumer 将三段文字粘贴到 Claude Code 中,然后走开了。当他回来时,浏览器里已经跑起了一款第一人称射击游戏:大约55,000行 JavaScript,分布在11个子系统中,所有纹理、网格、动画和声音都在加载时程序化生成。没有任何美术素材。他把这款游戏叫做 Claude of Duty,并把产生它的技术称为 gauntlet loop。

这个名字流传开来,如今这项技术已成为 agentic AI 中最常被模仿的提示模式之一。下面就是它的真正原理。

三个关键部分

一个 gauntlet loop 提示做了三件普通提示做不到的事:

  • 它拆分工作并分派构建者。 每个子代理负责一个狭窄的部分:一个房间、一个组件、一个子系统。每个部分必须产出一个真实、可检查的成果,而不是一个计划。
  • 它为每个构建者配一个独立的严苛批评者。 批评者是一个拥有全新上下文的代理。它看不到构建者付出了多少努力。它的唯一职责就是评判。
  • 它设定一个真实的品质标准,并循环直到作品超越它。 不是“做到最好”。而是一个存在于现实中的具体参照:真正的 Call of Duty、一个具体的线上页面、一篇具体的已发表文章。批评者把作品和标准并排放在一起,去掉标签,然后选出更好的那个。循环在作品胜出时结束,而不是在固定轮数后结束。
  • 你可以在目录中阅读产生 Claude of Duty 的原始提示,,它只有大约150个词。

    为什么有效

    大多数代理输出止步于“够用就行”,因为模型给自己打分。让模型给自己的作品打10分制,分数每轮都会虚高。Gauntlet loop 两次消除了自我评判:批评者是一个不同的代理,而且评判是二选一的对比,对手是已经存在且无可争议的优秀作品。

    第二部分正是人们容易忽略的洞察。一份评分标准要求代理满足文字描述;而一个具体参照物则让作品在可见的对比中落败,直到它不再落败。

    试试看

    从可复用的 gauntlet loop 模板开始,替换成你的目标和具体参照物,然后粘贴到一个全新的代理会话中。完整系列请参阅如何编写你自己的 gauntlet 提示以及带注释的原始版本。目录中所有 gauntlet 提示都归在 gauntlet-loop 标签下。

    Tags
    gauntlet-loop·agent-loop·prompt-engineering·claude-code·builder-critic·agents