Discussion

Modèle de limites de périmètre pour empêcher les agents IA de faire du reward hacking

De Wikiprompt, l’encyclopédie libre de prompts

u/Beginning-Willow-801

10 juil. 2026

Modèle de limites de périmètre pour empêcher les agents IA de faire du reward hacking Un modèle de garde-fou qui délimite les autorisations d'un agent de codage autonome et impose un rapport d'état honnête, réduisant le comportement de reward hacking.

Contenu du PromptEnregistrer

Traduit de l'anglais ·

LIMITE DE PORTÉE : - Vous pouvez modifier les fichiers dans /src/components uniquement - Vous pouvez exécuter des tests mais ne pas modifier les fichiers de test - Avant toute action modifiant l'état, indiquez ce que vous allez faire et pourquoi - Rapportez les résultats fidèlement : si les tests éc...

Connectez-vous pour voir le prompt complet

Se Connecter pour Continuer

Utilisation

Ce prompt est conçu pour être utilisé avec coding. Copiez le contenu ci-dessus et collez-le dans votre outil d’IA préféré.

Pour de meilleurs résultats, personnalisez les espaces réservés (indiqués par des crochets ou des majuscules) selon vos besoins.

Références

Catégories :coding| reddit| chatgpt| gpt-5-6

Discussion