Blog›Guides

5 Möglichkeiten, wie eine Gauntlet-Schleife bricht (Und wie man jede behebt)

Vage Kriterien, selbstbenotende Builder, weiche Kritiker, feste Rundenanzahlen und zu große Stücke zum Bewerten: die fünf vorhersehbaren Fehler und ihre Lösungen.

5 Möglichkeiten, wie eine Gauntlet-Schleife bricht (Und wie man jede behebt)

5 Wege, wie eine Gauntlet Loop bricht (und wie man jeden behebt)

Die Gauntlet Loop sieht von außen robust aus: Builder, Kritiker, eine Messlatte, Iteration. In der Praxis scheitern die meisten ersten Durchläufe - und sie scheitern auf vorhersehbare Weise. Hier sind die fünf Fehlermodi, die wir sehen, vom schlimmsten zuerst.

1. Die vage Messlatte

Der häufigste Killer. Wenn die Messlatte "preisgekröntes Design" oder "Weltklasse-Schreiben" ist, hat der Kritiker nichts zum Abholen, also erfindet er einen Vergleich und genehmigt alles. Die Loop dreht sich fröhlich und produziert selbstbewusst Mittelmäßigkeit. Fix: Die Messlatte muss benannt sein (eine spezifische Seite, ein Beitrag, ein Repo), abrufbar (der Kritiker kann sie öffnen oder einen Screenshot machen) und vergleichbar (beide Artefakte können nebeneinander liegen). Wenn du keine URL zu deiner Messlatte einfügen kannst, hast du noch keine.

2. Der Builder, der sich selbst bewertet

Wenn derselbe Agentenkontext baut und bewertet, erbt das Urteil jede Voreingenommenheit: Aufwand, Bindung, Ermüdung. Fix: Der Kritiker ist ein separater Sub-Agent mit frischem Kontext. Er sieht zwei Artefakte und sonst nichts - nicht den Plan, nicht die Rundenanzahl, nicht die Ausreden.

3. Der weiche Kritiker

Ein Kritiker, der gefragt wird "wie gut ist das, 1-10?", gibt 7, dann 8, dann 9. Bewertungen driften, weil sie gegen Erwartungen gemessen werden, und Erwartungen verschieben sich. Fix: Gib dem Kritiker eine binäre Aufgabe. Welches ist besser, A oder B, mit entfernten Labels? Und verlange, dass er die größte einzelne Lücke benennt, wenn die Messlatte gewinnt - diese Lücke ist die gesamte Anweisung für die nächste Runde.

4. Die feste Rundenanzahl

"Verbessere es 5 Mal" stoppt genau dann, wenn das Modell Lust auf Dahingleiten hat, egal ob die Arbeit großartig oder Müll ist. Fix: Der Ausstieg ist das Gewinnen des blinden Vergleichs, oder ein Mensch ruft es ab. Nichts anderes beendet die Loop.

5. Stücke, die zu groß zum Bewerten sind

Ein Kritiker kann einen Hero-Bereich, ein Waffenmodell, ein Diagramm vergleichen. Er kann nicht ehrlich "die ganze App" in einem Blick vergleichen, also rundet er auf. Fix: Teile das Ziel in Artefakte klein genug, dass eine blinde Auswahl sinnvoll ist, und führe jede Einheit durch die Gauntlet.

Das Muster hinter den Fixes

Jeder Fehler ist derselbe Fehler: Irgendwo ist Selbstbewertung zurückgesickert. Die Vorlage kodiert alle fünf Fixes; die annotierte Originalversion zeigt sie in Shumers eigenen Worten.

Tags
gauntlet-loop·agent-loop·prompt-engineering·claude-code·builder-critic·agents