976quoi nous avons rendu notre catalogue de prompts entièrement ouvert
Wikipedia a prouvé que publier des dumps complets rend une archive plus essentielle, pas moins. Nous avons appliqué la même logique à notre catalogue de plus de 55 000 prompts, et l'attribution aux auteurs originaux est l'accord qui le fait fonctionner.

Pourquoi Nous Avons Rendu Tout Notre Catalogue de Prompts Ouvert
Chaque semaine, quelqu'un écrit un scraper pour extraire des prompts de wikiprompt.org. Nous le voyons dans les logs : une rafale de requêtes contre /category/creative, puis /category/coding, parcourant chaque page du site comme une personne cliquant sur "suivant" mille fois, sauf que c'est un script et qu'il ne s'ennuie jamais. Nous traitions cela comme une nuisance à limiter par débit. Puis nous nous sommes posé une meilleure question : pourquoi forçons-nous les gens à faire cela ?
La réponse, une fois que nous l'avons admise, n'était pas flatteuse. Nous étions assis sur plus de 55 000 prompts soigneusement sélectionnés, une matière première utile pour quiconque étudie comment les gens parlent réellement aux modèles d'IA, et la seule manière officielle d'en obtenir plus d'un à la fois était de cliquer à travers le site comme si nous étions en 2004. Ce n'est pas ainsi que la connaissance ouverte est censée fonctionner, et nous savons exactement à quoi la connaissance ouverte est censée ressembler, car le meilleur exemple existe depuis 2001.
Le modèle Wikipedia, pris au sérieux
Wikipedia ne se contente pas de vous laisser lire des articles un par un dans un navigateur. Elle publie des dumps complets de la base de données de toute l'encyclopédie, selon un calendrier, gratuitement, sans compte requis. N'importe qui peut télécharger le tout et en faire quelque chose : construire un moteur de recherche, entraîner un modèle, exécuter un miroir hors ligne dans un endroit sans internet, ou simplement étudier comment un article a changé sur dix ans de modifications. Wikipedia ne l'a pas fait à contrecœur. Elle l'a fait parce que le dump *est* la mission. Une encyclopédie qui n'existe que derrière une interface résistante au scraping n'est pas réellement ouverte, peu importe la licence imprimée en bas de page.
L'effet secondaire que personne ne planifie mais dont tout le monde profite : parce que le dump existe, personne n'a besoin de scraper Wikipedia pour obtenir son contenu à grande échelle. Le trafic de scraping qui autrement martèlerait le site en direct est absorbé par un fichier statique à la place, et Wikipedia est citée partout comme une évidence, car la citer est plus facile que de ne pas la citer. L'ouverture n'a pas affaibli la position de Wikipedia comme source canonique. Elle l'a consolidée.
Nous pensons que les prompts méritent le même traitement, pour la même raison. Un bon prompt n'est pas vraiment du "contenu" au sens où un article de blog est du contenu. C'est une technique, un petit morceau de savoir-faire appliqué, généralement construit par essais et erreurs et partagé parce que quelqu'un voulait que d'autres bénéficient de ce qu'il a découvert. Cela ressemble beaucoup plus à un article Wikipedia qu'à une pièce de propriété intellectuelle exclusive. Un portrait souverain de créature préhistorique ou un portrait éditorial mis en scène sur un escalier architectural est la découverte de quelqu'un sur la façon de parler à un modèle d'image, écrite pour que la personne suivante n'ait pas à la redécouvrir de zéro. Verrouiller cela derrière un jardin clos, un mur de connexion, ou un formulaire "contactez-nous pour un accès API" est l'opposé de ce à quoi le contenu sert.
La connaissance collective ne se met pas à l'échelle une requête à la fois
Il y a un mode de défaillance spécifique que nous voulions éviter : les marchés de prompts où le texte réel du prompt est caché jusqu'à ce que vous payiez, ou les communautés où le bon contenu vit dans un serveur Discord que personne en dehors du groupe ne peut rechercher. Ces modèles optimisent pour capturer de la valeur au point d'une transaction unique. Nous pensons qu'ils perdent le prix plus grand, qui est de devenir l'endroit où les gens vont par défaut quand ils veulent savoir comment un bon prompt est construit, comme Wikipedia est devenu l'endroit où vous allez par défaut pour un fait. Vous ne pouvez pas devenir ce point de référence si votre contenu ne peut pas être étudié à grande échelle, indexé correctement, ou construit par-dessus.
Donc le jeu de données fonctionne comme un dump devrait fonctionner : pas de clé API, pas de palier de limite de débit à négocier, CORS grand ouvert, et mis en cache assez fort à la périphérie pour que l'utilisation intensive ne nous coûte pas de sommeil. Frappez https://www.wikiprompt.org/dataset et vous obtenez un manifeste avec total_prompts et le schéma de pagination. Frappez `/dataset/prompts` et vous obtenez le catalogue lui-même en JSON, paginé avec un curseur de clé, jusqu'à 500 enregistrements par page :
curl "https://www.wikiprompt.org/dataset/prompts?limit=500"
Suivez l'URL next de chaque réponse jusqu'à ce qu'elle revienne null et vous avez parcouru tout le catalogue. Chaque enregistrement porte slug, url, title, description, content (le texte du prompt lui-même), category, tags, media, model, metadata structuré, author, original_source, et des horodatages, à travers des catégories allant de créatif et codage à marketing, recherche, et éducation. Si vous préférez interroger plutôt que télécharger en masse, il y a aussi une API de recherche et un serveur MCP pour les agents qui veulent atteindre le catalogue en direct au lieu de tirer une copie statique.
L'ouverture n'est pas la même chose que l'anonymat
Voici la partie qui compte autant que l'accès technique : rien de tout cela n'est à nous pour en retirer le crédit. Chaque prompt du catalogue remonte à une personne réelle qui l'a publié publiquement, que ce soit un esprit de serpent blanc vaincu debout sous la pluie partagé sur Twitter ou une technique déposée dans un fil de subreddit. original_source n'est pas un champ décoratif. C'est l'autre moitié de l'accord. Nous ne revendiquons pas une licence formelle que nous ne détenons pas, et nous ne prétendons pas que les prompts sont à nous pour les re-licencier comme bon nous semble. Nous demandons, simplement, que si vous construisez quelque chose avec ce jeu de données, vous attribuiez wikiprompt.org comme agrégateur et l'auteur original comme source. C'est le même marché que Wikipedia conclut avec quiconque réutilise un article : prenez la connaissance, gardez le crédit attaché.
Les dumps de Wikipedia n'ont pas rendu Wikipedia moins essentielle. Ils l'ont rendue infrastructure. Nous préférerions que wikiprompt.org soit l'endroit ennuyeux et fiable dont tout le monde a déjà une copie plutôt que le site que les gens contournent discrètement avec un scraper. L'ouverture n'a jamais été le risque ici. Le jardin clos l'était.
Related Articles
- Laya vs. Jev: Die Open-Source-Antwort auf die Entscheidungsmodell-Welle
Sep 22, 2026 · 5 min read
- Laya contre Jev : La réponse open-source à la vague des modèles de décision
Sep 22, 2026 · 5 min read
- Laya vs Jev: La respuesta de código abierto a la ola de modelos de decisión
Sep 22, 2026 · 5 min read
- Laya vs Jev: 오픈소스로 답하는 의사결정 모델 물결
Sep 22, 2026 · 5 min read
- लाया बनाम जेव: निर्णय-मॉडल लहर का ओपन-सोर्स उत्तर
Sep 22, 2026 · 5 min read