.nonce de l'ensemble de données ouvert de prompts Wikipédia : plus de 55 000 invites IA, gratuitement
Wikiprompt vient d'ouvrir son catalogue complet en tant que jeu de données gratuit, structuré et sans clé de plus de 55 000 invites IA, prêt à être récupéré en une seule ligne au lieu de scraper le site.

Annonce du jeu de données ouvert de prompts Wikiprompt : plus de 55 000 prompts IA, gratuitement
Aujourd'hui, nous ouvrons l'intégralité du catalogue Wikiprompt. Chaque prompt que nous avons sélectionné pour ChatGPT, Claude, Gemini, GPT Image, Midjourney, Seedance, Veo, Kling, Nano Banana, Grok et d'autres est désormais disponible sous forme de jeu de données public, structuré et gratuit. Aucune inscription, aucune clé API, aucun scraping requis.
Si vous avez toujours voulu un véritable corpus de prompts IA fonctionnels, le genre que d'autres personnes ont réellement utilisés et avec lesquels ils ont obtenu des résultats, plutôt qu'une liste récupérée sur un blog au hasard, c'est ce corpus. Plus de 55 000 prompts, chacun avec son enregistrement complet : titre, description, texte du prompt réel, catégorie, tags, médias, le modèle pour lequel il a été écrit, des métadonnées de qualité structurées, l'auteur, et un lien vers la publication d'origine.
Pourquoi nous faisons cela
Wikiprompt a toujours fonctionné comme un wiki : les gens soumettent des prompts, nous les sélectionnons et les organisons, et le résultat devient une référence publique que tout le monde peut consulter gratuitement. Cela fonctionnait bien comme site web. Cela ne fonctionnait pas aussi bien pour ceux qui voulaient *construire* quelque chose avec les données : s'entraîner dessus, les analyser, en extraire des motifs, les intégrer dans leurs propres outils. Leur seule option était de scraper wikiprompt.org page par page, ce qui est lent, fragile et inutilement exigeant pour nos serveurs.
Nous faisons donc ce que Wikipedia a fait il y a des décennies : publier la sauvegarde. Au lieu de scraper, vous récupérez. Au lieu d'analyser du HTML, vous obtenez du JSON. Tout le catalogue, dans un format prévisible, mis à jour au fur et à mesure que le catalogue grandit.
Ce qu'il contient réellement
Commencez par le jeu de données. Ce point de terminaison est le manifeste : il vous indique total_prompts, les record_fields que vous pouvez attendre sur chaque enregistrement, et comment fonctionne la pagination. Le contenu réel se trouve sur /dataset/prompts, qui renvoie le catalogue lui-même en JSON.
Chaque enregistrement comprend :
slug et url, la page canonique pour ce prompttitle et descriptioncontent, le texte du prompt réel que vous copieriez et utiliseriezcategory et tagsmedia, toutes les URL d'images ou de vidéos d'exemplemodel, le modèle IA pour lequel le prompt a été écrit ou testémetadata, des détails structurés comme le type de média, le rapport d'aspect, le style et une évaluation de qualitéauthor et original_source, un lien vers le tweet ou la publication d'originecreated_at et updated_atSeuls les prompts actifs et nettoyés sont retenus, la même barre éditoriale que nous appliquons au site en direct. Les catégories couvrent la création, le marketing, le personnel, la productivité, le codage, l'éducation, les affaires, la recherche et autres, il y a donc une vraie diversité ici, pas seulement un créneau.
Pour rendre cela concret : le jeu de données est la façon dont un prompt comme ce prompt d'affiche éditoriale fumante ou un prompt d'affiche de voyage en linogravure découpée à la main se retrouve sous forme de ligne de JSON structuré au lieu d'une simple page que vous devriez visiter et copier à la main. Il en va de même pour un prompt de photographie de portrait éthérée de la dynastie Tang, et pour chaque autre prompt du catalogue.
Comment le récupérer en une ligne
C'est la partie qui nous enthousiasme le plus : il n'y a aucune configuration. Une seule commande curl vous donne une page d'enregistrements réels immédiatement.
curl "https://www.wikiprompt.org/dataset/prompts?limit=500"
C'est tout. Pas de clé dans l'en-tête, pas de danse d'authentification. CORS est complètement ouvert (Access-Control-Allow-Origin: *), vous pouvez donc l'appeler directement depuis un navigateur ou une application côté client aussi. C'est également fortement mis en cache en périphérie, ce qui signifie que c'est rapide pour vous et peu coûteux pour nous, une combinaison rare.
Le jeu de données est paginé avec un curseur de jeu de clés plutôt que des numéros de page, ce qui le maintient stable même lorsque de nouveaux prompts sont ajoutés en cours d'exploration. Chaque réponse inclut une URL next ; continuez à la suivre jusqu'à ce que next revienne null. Vous pouvez demander jusqu'à 500 enregistrements par page avec limit, ou prendre la valeur par défaut de 200. Une boucle minimale ressemble à ceci :
import requests
url = "https://www.wikiprompt.org/dataset/prompts?limit=500"
prompts = []
while url:
data = requests.get(url).json()
prompts.extend(data["results"])
url = data.get("next")
print(len(prompts), "prompts fetched")
Exécutez cela et vous aurez le catalogue complet en mémoire en quelques minutes.
Une note sur l'attribution
Chaque prompt de ce jeu de données a été agrégé à partir d'une publication publique de son auteur d'origine. Wikiprompt sélectionne et structure le catalogue, mais nous ne détenons pas de licence formelle sur le contenu lui-même. Si vous construisez quelque chose avec ce jeu de données, publiez des recherches dessus, ou réutilisez des prompts individuels, veuillez créditer wikiprompt.org comme source et, lorsque cela compte, le lien original_source sur l'enregistrement spécifique que vous utilisez. C'est tout ce que nous demandons.
Au-delà de la sauvegarde
Le jeu de données est l'option en masse, mais ce n'est pas la seule voie d'accès. Si vous avez juste besoin de répondre à une seule question, l'API de recherche renvoie du JSON pour toute requête sans télécharger tout le catalogue. Si vous construisez un agent IA, le serveur MCP expose la recherche, la récupération et la soumission comme des outils que Claude et d'autres agents peuvent appeler directement. Et llms.txt donne à tout LLM une carte rapide de ce qui est disponible ici et comment l'utiliser.
Nous avons construit Wikiprompt pour être une référence publique sur la façon dont les gens utilisent réellement ces modèles aujourd'hui. Ouvrir le jeu de données, c'est prendre cette idée au sérieux : tout le catalogue devrait être aussi facile à obtenir qu'à parcourir. Allez le récupérer et voyez ce que vous construisez.
Related Articles
- Laya vs. Jev: Die Open-Source-Antwort auf die Entscheidungsmodell-Welle
Sep 22, 2026 · 5 min read
- Laya contre Jev : La réponse open-source à la vague des modèles de décision
Sep 22, 2026 · 5 min read
- Laya vs Jev: La respuesta de código abierto a la ola de modelos de decisión
Sep 22, 2026 · 5 min read
- Laya vs Jev: 오픈소스로 답하는 의사결정 모델 물결
Sep 22, 2026 · 5 min read
- लाया बनाम जेव: निर्णय-मॉडल लहर का ओपन-सोर्स उत्तर
Sep 22, 2026 · 5 min read