Blog›Guides

Gauntlet Loop contre Prompting à un seul passage : ce qui change réellement

Même modèle, même objectif, résultat très différent. D'où vient mécaniquement l'avantage du gauntlet, ce qu'il coûte, et une règle pratique pour savoir quand utiliser chacun.

Gauntlet Loop contre Prompting à un seul passage : ce qui change réellement

Gauntlet Loop vs. Single-Shot-Prompting: Was sich tatsächlich ändert

Du kannst einen Agenten in einem einzigen Durchlauf um eine Landingpage bitten, oder du schickst ihn durch den Gauntlet. Gleiches Modell, gleiches Ziel. Der Unterschied in der Ausgabequalität ist nicht subtil, und es lohnt sich, präzise zu sein, woher er kommt.

Was dir ein einzelner Durchlauf bringt

Ein Durchlauf der besten Vermutung des Modells über deine Absicht. Bei kleinen, klar umrissenen Aufgaben (ein Regex, eine SQL-Abfrage, ein Absatz) reicht das meistens aus, und ein Gauntlet wäre Verschwendung. Single-Shot scheitert, wenn die Aufgabe groß genug ist, dass "sieht fertig aus" und "ist gut" auseinanderdriften: mehrteilige Seiten, lange Dokumente, ganze Funktionen. Das Modell hat keinen äußeren Druck, also stoppt es bei plausibel.

Was der Gauntlet verändert

Drei Dinge, mechanisch betrachtet:

  • Dekomposition. Builder übernehmen schmale Teile, die prüfbare Artefakte erzeugen. Große Aufgaben hören auf, ein verschwommener Klumpen zu sein.
  • Externe Bewertung. Ein separater strenger Kritiker vergleicht jedes Artefakt blind mit einem echten, benannten Maßstab. "Plausibel" reicht nicht mehr, weil Plausibles im direkten Vergleich verliert.
  • Verdienter Ausstieg. Die Schleife läuft, bis die Arbeit den Vergleich gewinnt. Zeit, nicht Tokens, wird zum Budget: Claude of Duty lief stundenlang und kam mit 55.000 Zeilen und 11 Subsystemen heraus.
  • Die ehrliche Kostenrechnung

    Gauntlets sind teuer: viele Sub-Agent-Läufe, viele Vergleiche, Screenshots, Wiederholungen. Das richtige mentale Modell ist, dass du Tokens gegen die Überprüfungsschleifen eintauschst, die ein menschlicher Redakteur oder Art Director übernommen hätte. Wenn die Ausgabe wichtig ist (eine öffentliche Seite, ein Launch-Post, eine Demo), ist dieser Tausch offensichtlich gut. Wenn es Wegwerfware ist, nutze Single-Shot und mach weiter.

    Eine praktische Entscheidungsregel

    Nutze den Gauntlet, wenn ALLE drei Bedingungen gelten: Die Ausgabe ist groß genug für Qualitätsschwankungen, es existiert ein echter Maßstab und dieser ist abrufbar, und du kannst dir den Lauf leisten. Ansonsten Single-Shot, vielleicht mit einem manuellen Überprüfungsdurchgang. Wenn du den Gauntlet nutzt, starte mit der Vorlage und prüfe die Fehlermodi, bevor du Enter drückst - ein schlechter Gauntlet kostet mehr als ein schlechter Single-Shot und bringt weniger ein.

    Tags
    gauntlet-loop·agent-loop·prompt-engineering·claude-code·builder-critic·agents