Blog›Guides

Qu'est-ce que la boucle Gauntlet ? Le modèle de prompt derrière Claude of Duty

Agents sous-traitants de construction, un critique sévère distinct, un véritable niveau de qualité et une sortie méritée : l'anatomie du modèle de prompt qui a produit un FPS navigateur de 55 000 lignes.

Qu'est-ce que la boucle Gauntlet ? Le modèle de prompt derrière Claude of Duty

Qu'est-ce que la boucle Gauntlet ? Le modèle de prompt derrière Claude of Duty

Fin juillet 2026, Matt Shumer a collé trois paragraphes dans Claude Code et s'est éloigné. À son retour, il avait un jeu de tir à la première personne fonctionnant dans le navigateur : environ 55 000 lignes de JavaScript réparties sur 11 sous-systèmes, avec chaque texture, maillage, animation et son générés procéduralement au moment du chargement. Aucun élément artistique du tout. Il a appelé le jeu Claude of Duty, et il a appelé la technique qui l'a produit la boucle Gauntlet.

Le nom est resté, et la technique est désormais l'un des modèles de prompt les plus copiés dans l'IA agentique. Voici ce qu'elle est réellement.

Les trois éléments mobiles

Un prompt de boucle Gauntlet fait trois choses qu'un prompt normal ne fait pas :

  • Il divise le travail et répartit les constructeurs. Chaque sous-agent prend une pièce étroite : une pièce, un composant, un sous-système. Chaque pièce doit produire un artefact réel et vérifiable, pas un plan pour en créer un.
  • Il associe chaque constructeur à un critique séparé et sévère. Le critique est un agent différent avec un contexte frais. Il ne voit jamais à quel point le constructeur a essayé. Son seul travail est le jugement.
  • Il fixe une barre de qualité réelle et boucle jusqu'à ce que le travail la dépasse. Pas "rends-le génial". Une référence nommée qui existe dans le monde : le vrai Call of Duty, une page d'accueil en ligne spécifique, un essai publié spécifique. Le critique met le travail et la barre côte à côte, étiquettes retirées, et choisit le meilleur. La boucle se termine lorsque le travail gagne, jamais après un nombre fixe de tours.
  • Vous pouvez lire le prompt original qui a produit Claude of Duty dans le catalogue - il fait à peine 150 mots.

    Pourquoi cela fonctionne

    La plupart des sorties d'agent s'arrêtent à "assez bien" parce que le modèle évalue ses propres devoirs. Demandez à un modèle de noter son travail sur 10 et le score dérive vers le haut à chaque tour. La boucle Gauntlet supprime l'auto-jugement deux fois : le critique est un agent différent, et le verdict est un choix binaire contre quelque chose qui existe déjà et qui est indéniablement bon.

    Cette deuxième partie est l'aperçu que les gens manquent. Une grille d'évaluation demande à l'agent de satisfaire des mots. Une barre le fait perdre, visiblement, contre une chose réelle, jusqu'à ce qu'il ne perde plus.

    Essayez-la

    Commencez par le modèle de boucle Gauntlet réutilisable, remplacez votre objectif et une barre nommée, et collez-le dans une session d'agent fraîche. Pour la série complète, voir comment écrire votre propre prompt de boucle Gauntlet et l'original annoté. Tous les prompts de boucle Gauntlet dans le catalogue sont sous le tag gauntlet-loop.

    Tags
    gauntlet-loop·agent-loop·prompt-engineering·claude-code·builder-critic·agents