BlogBenchmarks

GPT-6 Astra y Claude Fable 5.1: Semana de Lanzamiento de Frontera, en el Registro

Anthropic, Google y OpenAI lanzaron todos en 72 horas. Qué se lanzó, qué muestran ya nuestras instantáneas de referencia diarias, y por qué el acceso por niveles es el nuevo patrón fronterizo.

GPT-6 Astra y Claude Fable 5.1: Semana de Lanzamiento de Frontera, en el Registro

En los primeros tres días de septiembre de 2026, los tres laboratorios de IA más grandes lanzaron productos: Anthropic publicó Claude Fable 5.1 y Mythos 5.1 el lunes, Google sacó Gemini 3.8 Flash el martes, y OpenAI anunció GPT-6 Astra el miércoles. Aquí está lo que realmente se lanzó, lo que nuestras capturas diarias de benchmarks ya muestran, y qué vigilar en los rankings a continuación.

Qué se lanzó

Claude Fable 5.1 y Mythos 5.1 (1 de septiembre). Anthropic los llama sus modelos más avanzados para codificación y trabajo de conocimiento, con resultados más sólidos que Fable 5 a menor costo para muchas cargas de trabajo. Los dos nombres son un modelo subyacente en dos pistas: Fable se distribuye ampliamente con salvaguardas adicionales sobre capacidades de doble uso, mientras que Mythos se ofrece sin ellas solo a organizaciones verificadas (actualmente un conjunto de ciberdefensores estadounidenses y laboratorios de ciencias de la vida). Contexto sobre el nivel en nuestra wiki: Claude Fable 5 y Mythos 5.

GPT-6 Astra (3 de septiembre). El nuevo buque insignia de OpenAI, descrito como el producto de "años de investigación y grandes apuestas", que se despliega en fases a los planes de pago de ChatGPT, la API y AWS. Lo más destacado no es solo la capacidad: Astra es el primer modelo de OpenAI que alcanza el umbral interno de ciberseguridad "Crítico" de la compañía, y OpenAI está limitando esas capacidades primero a empresas en su programa de seguridad Daybreak. Esto refleja la división Fable/Mythos de Anthropic y convierte el acceso por niveles en el patrón de facto para lanzamientos de frontera. Página wiki: GPT-6 Astra.

Qué muestran ya nuestras capturas

Wikiprompt toma una captura diaria de los principales rankings, así que las semanas de lanzamiento dejan un rastro documental:

  • Fable 5.1 ya está listado en OpenRouter en nuestra captura del 3 de septiembre, dos días después del lanzamiento, incluyendo un nivel de precios por lotes.
  • Claude Fable 5 lidera la arena de desarrollo web en LMArena en la captura de hoy con un Elo de 1628 en general (1663 en tareas HTML), por delante de todos los demás modelos que rastreamos allí.
  • En la arena de texto general, el mejor de hoy es un grupo ajustado de Anthropic: Opus 5 Max (1505), Opus 5 High (1504) y Opus 4.6 High (1503), con Fable 5 en 1494 junto a Gemini 3.7 Flash High (1491).
  • GPT-6 Astra aún no está en las arenas comunitarias. Los despliegues por fases suelen aparecer en días; cuando llegue, la captura diaria lo detectará y el cambio será visible en historial de benchmarks.
  • Por qué importan los niveles de acceso

    El cambio interesante esta semana no es un número de benchmark. Ambos laboratorios ahora distribuyen públicamente sus capacidades más fuertes detrás de una verificación: Mythos a organizaciones aprobadas, las capacidades cibernéticas de Astra a la cohorte Daybreak. Para escritores de prompts, esto significa que el modelo que puedes comprar y el modelo que encabeza las evaluaciones internas ya no son siempre el mismo artefacto, y los rankings comunitarios (que prueban las variantes públicas) son la medida honesta de lo que realmente puedes usar.

    Observa cómo se mueve

  • Foto congelada de hoy: captura de benchmark para el 3 de septiembre de 2026
  • La arena de texto, actualizada diariamente: ranking de texto
  • Donde Fable 5 lidera actualmente: ranking de desarrollo web
  • Cada cambio de clasificación registrado: historial de benchmarks
  • Seguiremos tomando capturas diarias; cuando Astra y Fable 5.1 lleguen a las arenas, los deltas estarán justo ahí.

    Tags
    gpt-6-astra·claude-fable-5-1·openai·anthropic·benchmarks·model-launches