Blog›Guides

1. 1. the first. 2. the. the. the. the. the. the. 3. the. the. the. the. the. the. the. the. the. the. the. the. the. the. the..the. the. the. the. the. 3. the. the. 3. the. 3. the. 3. the. 3. 3. the

Barras vagas, construtores de autoavaliação, críticos brandos, contagens fixas de rodadas e peças grandes demais para avaliar: as cinco falhas previsíveis e suas correções.

1. 1. the first. 2. the. the. the. the. the. the. 3. the. the. the. the. the. the. the. the. the. the. the. the. the. the. the..the. the. the. the. the. 3.  the. the. 3. the. 3. the. 3. the. 3. 3. the

5 Maneiras de um Gauntlet Loop quebrar (e Como Corrigir Cada Uma)

O gauntlet loop parece robusto por fora: construtores, críticos, uma barra, iteração. Na prática, a maioria das primeiras execuções falha, e elas falham de maneiras previsíveis. Aqui estão os cinco modos de falha que vemos, do pior ao menos pior.

1. A barra vaga

O assassino mais comum. Se a barra é "design premiado" ou "escrita de classe mundial", o crítico não tem nada para buscar, então ele inventa uma comparação e aprova tudo. O loop gira feliz e produz mediocridade com confiança. Correção: a barra precisa ser nomeada (uma página, post ou repositório específico), buscável (o crítico pode abrir ou capturar uma tela dela) e comparável (ambos os artefatos podem ficar lado a lado). Se você não consegue colar uma URL na sua barra, ainda não tem uma.

2. O construtor avaliando a si mesmo

Se o mesmo contexto de agente constrói e julga, o julgamento herda todos os vieses: esforço, apego, fadiga. Correção: o crítico é um sub-agente separado com contexto novo. Ele vê dois artefatos e nada mais - não o plano, não o número de rodadas, não as desculpas.

3. O crítico brando

Um crítico questionado "quão bom é isso, de 1 a 10?" dá 7, depois 8, depois 9. As pontuações derivam porque são julgadas contra expectativas, e as expectativas se movem. Correção: dê ao crítico uma tarefa binária. Qual é melhor, A ou B, com rótulos removidos? E exija que ele nomeie a maior lacuna quando a barra vence - essa lacuna é a instrução inteira da próxima rodada.

4. O número fixo de rodadas

"Melhore isso 5 vezes" para exatamente quando o modelo sente vontade de relaxar, seja o trabalho ótimo ou um lixo. Correção: a saída é vencer a comparação cega, ou um humano encerrando. Nada mais termina o loop.

5. Peças grandes demais para julgar

Um crítico pode comparar uma seção de herói, um modelo de arma, um gráfico. Ele não consegue comparar honestamente "o app inteiro" em uma olhada, então ele arredonda para cima. Correção: divida o objetivo em artefatos pequenos o suficiente para que uma escolha cega seja significativa, e aplique o gauntlet em cada peça.

O padrão por trás das correções

Toda falha é a mesma falha: em algum lugar, o auto-julgamento vazou de volta. O template codifica todas as cinco correções; o original anotado as mostra nas próprias palavras de Shumer.

Tags
gauntlet-loop·agent-loop·prompt-engineering·claude-code·builder-critic·agents