BlogBenchmarks

GPT-6 Astra et Claude Fable 5.1 : Semaine de lancement de la frontière, en direct

Anthropic, Google et OpenAI ont tous lancé en 72 heures. Ce qui a été lancé, ce que nos instantanés de référence quotidiens montrent déjà, et pourquoi l'accès par paliers est le nouveau modèle de frontière.

GPT-6 Astra et Claude Fable 5.1 : Semaine de lancement de la frontière, en direct

Au cours des trois premiers jours de septembre 2026, les trois plus grands laboratoires d'IA ont tous publié leurs modèles : Anthropic a lancé Claude Fable 5.1 et Mythos 5.1 lundi, Google a déployé Gemini 3.8 Flash mardi, et OpenAI a annoncé GPT-6 Astra mercredi. Voici ce qui a réellement été lancé, ce que nos instantanés quotidiens de benchmarks montrent déjà, et ce qu'il faut surveiller sur les classements ensuite.

Ce qui a été lancé

Claude Fable 5.1 et Mythos 5.1 (1er septembre). Anthropic les qualifie de ses modèles les plus avancés pour le codage et le travail de connaissance, avec des résultats plus solides que Fable 5 à un coût inférieur pour de nombreuses charges de travail. Les deux noms désignent un seul modèle sous-jacent sur deux pistes : Fable est largement distribué avec des garde-fous supplémentaires sur les capacités à double usage, tandis que Mythos est proposé sans eux uniquement à des organisations vérifiées (actuellement un ensemble de cyberdéfenseurs américains et de laboratoires en sciences de la vie). Contexte sur le niveau dans notre wiki : Claude Fable 5 et Mythos 5.

GPT-6 Astra (3 septembre). Le nouveau modèle phare d'OpenAI, décrit comme le produit de « années de recherche et de gros paris », déployé par phases vers les plans payants de ChatGPT, l'API et AWS. Le point principal n'est pas seulement la capacité : Astra est le premier modèle d'OpenAI à atteindre le seuil interne de cybersécurité « Critique » de l'entreprise, et OpenAI limite d'abord ces capacités aux entreprises de son programme de sécurité Daybreak. Cela reflète la division Fable/Mythos d'Anthropic et fait de l'accès par niveaux le modèle de lancement de pointe de facto. Page wiki : GPT-6 Astra.

Ce que nos instantanés montrent déjà

Wikiprompt prend un instantané quotidien des principaux classements, donc les semaines de lancement laissent une trace écrite :

  • Fable 5.1 est déjà répertorié sur OpenRouter dans notre instantané du 3 septembre, deux jours après le lancement, y compris un niveau de tarification par lot.
  • Claude Fable 5 mène l'arène de développement web sur LMArena dans l'instantané d'aujourd'hui avec un Elo de 1628 au total (1663 sur les tâches HTML), devant tous les autres modèles que nous suivons là-bas.
  • Sur l'arène de texte générale, le sommet d'aujourd'hui est un groupe serré d'Anthropic : Opus 5 Max (1505), Opus 5 High (1504) et Opus 4.6 High (1503), avec Fable 5 à 1494 aux côtés de Gemini 3.7 Flash High (1491).
  • GPT-6 Astra n'est pas encore sur les arènes communautaires. Les déploiements par phases apparaissent généralement en quelques jours ; quand il arrivera, l'instantané quotidien le capturera et le changement sera visible à historique des benchmarks.
  • Pourquoi les niveaux d'accès comptent

    Le changement intéressant cette semaine n'est pas un chiffre de benchmark. Les deux laboratoires publient désormais publiquement leurs capacités les plus fortes derrière une vérification : Mythos pour les organisations approuvées, les capacités cyber d'Astra pour la cohorte Daybreak. Pour les rédacteurs de prompts, cela signifie que le modèle que vous pouvez acheter et le modèle qui domine les évaluations internes ne sont plus toujours le même artefact, et les classements communautaires (qui testent les variantes publiques) sont la mesure honnête de ce que vous pouvez réellement utiliser.

    Surveillez son évolution

  • Photo figée d'aujourd'hui : instantané de benchmark pour le 3 septembre 2026
  • L'arène de texte, mise à jour quotidiennement : classement de texte
  • Où Fable 5 mène actuellement : classement de développement web
  • Chaque changement de classement enregistré : historique des benchmarks
  • Nous continuerons à prendre des instantanés quotidiennement ; quand Astra et Fable 5.1 arriveront sur les arènes, les écarts seront juste là.

    Tags
    gpt-6-astra·claude-fable-5-1·openai·anthropic·benchmarks·model-launches