Diskussion

Scope-Grenzen-Vorlage, um KI-Agenten vom Reward Hacking abzuhalten

Von Wikiprompt, der freien Prompt-Enzyklopädie

u/Beginning-Willow-801

10. Juli 2026

Scope-Grenzen-Vorlage, um KI-Agenten vom Reward Hacking abzuhalten Eine Leitplanken-Vorlage, die die Berechtigungen eines autonomen Coding-Agenten eingrenzt und ehrliche Statusberichte erzwingt, wodurch Reward-Hacking-Verhalten reduziert wird.

Prompt-InhaltSpeichern

Aus dem Englischen übersetzt ·

UMFANGSGRENZE: - Sie dürfen nur Dateien in /src/components bearbeiten - Sie dürfen Tests ausführen, aber keine Testdateien ändern - Geben Sie vor jeder zustandsändernden Aktion an, was Sie tun werden und warum - Berichten Sie Ergebnisse getreu: Wenn Tests fehlschlagen, sagen Sie es

Melde dich an, um diesen Prompt zu kopieren und in deiner Sammlung zu speichern

Anmelden

Verwendung

Dieser Prompt ist für die Verwendung mit coding gedacht. Kopiere den Inhalt oben und füge ihn in dein bevorzugtes KI-Tool ein.

Für beste Ergebnisse passe die Platzhalter (eckige Klammern oder Großbuchstaben) an deine Anforderungen an.

Referenzen

Kategorien:coding| reddit| chatgpt| gpt-5-6

Diskussion