Por Qué Hicimos Público Todo Nuestro Catálogo de Prompts
523 demostró que publicar volcados completos hace que un archivo sea más esencial, no menos. Aplicamos la misma lógica a nuestro catálogo de más de 55,000 indicaciones, y la atribución a los autores originales es el acuerdo que lo hace funcionar.

Por Qué Abrimos Todo Nuestro Catálogo de Prompts
Cada semana, alguien escribe un scraper para extraer prompts de wikiprompt.org. Podemos verlo en los registros: una ráfaga de solicitudes contra /category/creative, luego /category/coding, recorriendo cada página del sitio como una persona que hace clic en "siguiente" mil veces, excepto que es un script y nunca se aburre. Solíamos tratar esto como una molestia a la que poner límite de velocidad. Luego nos hicimos una mejor pregunta: ¿por qué hacemos que la gente haga esto en absoluto?
La respuesta, una vez que lo admitimos, no fue halagadora. Estábamos sentados sobre más de 55,000 prompts curados, material prima útil para cualquiera que estudie cómo la gente realmente habla con los modelos de IA, y la única forma sancionada de obtener más de uno a la vez era hacer clic a través del sitio web como si fuera 2004. Así no es como se supone que funciona el conocimiento abierto, y sabemos exactamente cómo se supone que se ve el conocimiento abierto, porque el mejor ejemplo de ello ha existido desde 2001.
El modelo de Wikipedia, tomado en serio
Wikipedia no solo te deja leer artículos uno a la vez en un navegador. Publica volcados de base de datos completos de toda la enciclopedia, en un horario, gratis, sin necesidad de cuenta. Cualquiera puede descargar todo y hacer algo con ello: construir un motor de búsqueda, entrenar un modelo, ejecutar un espejo sin conexión en un lugar sin internet, o simplemente estudiar cómo un artículo cambió a lo largo de diez años de ediciones. Wikipedia no hizo esto de mala gana. Lo hizo porque el volcado *es* la misión. Una enciclopedia que solo existe detrás de un frontend resistente al scraping no es realmente abierta, sin importar qué licencia esté impresa al pie de la página.
El efecto secundario que nadie planea pero todos aprovechan: debido a que el volcado existe, nadie tiene que hacer scraping de Wikipedia para obtener su contenido a escala. El tráfico de scraping que de otro modo golpearía el sitio en vivo se absorbe con un archivo estático, y Wikipedia se cita en todas partes como algo natural, porque citarla es más fácil que no citarla. La apertura no debilitó la posición de Wikipedia como la fuente canónica. La consolidó.
Creemos que los prompts merecen el mismo trato, por la misma razón. Un buen prompt no es realmente "contenido" en la forma en que una publicación de blog es contenido. Es una técnica, una pequeña pieza de oficio aplicado, generalmente construida por prueba y error y compartida porque alguien quería que otros se beneficiaran de lo que descubrieron. Eso está mucho más cerca de un artículo de Wikipedia que de una pieza de propiedad intelectual. Un retrato soberano de criatura prehistórica o un retrato editorial escenificado en una escalera arquitectónica es el descubrimiento de alguien sobre cómo hablar con un modelo de imagen, escrito para que la siguiente persona no tenga que redescubrirlo desde cero. Encerrar eso detrás de un jardín amurallado, un muro de inicio de sesión o un formulario de "contáctenos para acceso API" es lo opuesto a lo que el contenido es para.
El conocimiento colectivo no escala una solicitud a la vez
Hay un modo de fallo específico que queríamos evitar: mercados de prompts donde el texto real del prompt está oculto hasta que pagas, o comunidades donde lo bueno vive en un servidor de Discord que nadie fuera del grupo puede buscar. Esos modelos optimizan para capturar valor en el punto de una sola transacción. Creemos que pierden el premio más grande, que es convertirse en el lugar al que la gente va por defecto cuando quiere saber cómo se construye un buen prompt, de la manera en que Wikipedia se convirtió en el lugar al que vas por defecto para un dato. No puedes convertirte en ese punto de referencia si tu contenido no puede ser estudiado a escala, indexado correctamente o construido sobre él.
Así que el conjunto de datos funciona como debería funcionar un volcado: sin clave API, sin nivel de límite de velocidad que negociar, CORS completamente abierto, y cacheado lo suficientemente fuerte en el borde que el uso intensivo no nos cuesta sueño. Accede a https://www.wikiprompt.org/dataset y obtienes un manifiesto con total_prompts y el esquema de paginación. Accede a `/dataset/prompts` y obtienes el catálogo en sí como JSON, paginado con un cursor de claves, hasta 500 registros por página:
curl "https://www.wikiprompt.org/dataset/prompts?limit=500"
Sigue la URL next de cada respuesta hasta que devuelva null y habrás recorrido todo el catálogo. Cada registro lleva slug, url, title, description, content (el texto del prompt en sí), category, tags, media, model, metadata estructurado, author, original_source y marcas de tiempo, en categorías que van desde creativa y codificación hasta marketing, investigación y educación. Si prefieres consultar en lugar de descargar en masa, también hay una API de búsqueda y un servidor MCP para agentes que quieran acceder al catálogo en vivo en lugar de extraer una copia estática.
La apertura no es lo mismo que el anonimato
Aquí está la parte que importa tanto como el acceso técnico: nada de esto es nuestro para despojarlo de crédito. Cada prompt en el catálogo se remonta a una persona real que lo publicó públicamente, ya sea un espíritu de serpiente blanca derrotado de pie bajo la lluvia compartido en Twitter o una técnica soltada en un hilo de subreddit. original_source no es un campo decorativo. Es la otra mitad del trato. No estamos reclamando una licencia formal que no poseemos, y no estamos fingiendo que los prompts son nuestros para relicenciar como queramos. Estamos pidiendo, francamente, que si construyes algo con este conjunto de datos, atribuyas a wikiprompt.org como el agregador y al autor original como la fuente. Ese es el mismo trato que Wikipedia hace con cualquiera que reutilice un artículo: toma el conocimiento, mantén el crédito adjunto.
Los volcados de Wikipedia no hicieron que Wikipedia fuera menos esencial. La convirtieron en infraestructura. Preferiríamos que wikiprompt.org sea el lugar aburrido y confiable del que todos ya tienen una copia, en lugar del sitio que la gente silenciosamente rodea con un scraper. La apertura nunca fue el riesgo aquí. El jardín amurallado lo era.
Related Articles
- Laya vs. Jev: Die Open-Source-Antwort auf die Entscheidungsmodell-Welle
Sep 22, 2026 · 5 min read
- Laya contre Jev : La réponse open-source à la vague des modèles de décision
Sep 22, 2026 · 5 min read
- Laya vs Jev: La respuesta de código abierto a la ola de modelos de decisión
Sep 22, 2026 · 5 min read
- Laya vs Jev: 오픈소스로 답하는 의사결정 모델 물결
Sep 22, 2026 · 5 min read
- लाया बनाम जेव: निर्णय-मॉडल लहर का ओपन-सोर्स उत्तर
Sep 22, 2026 · 5 min read