BlogBenchmarks

GPT-6 Astra e Claude Fable 5.1: Semana de Lançamento de Fronteira, no Registro

Anthropic, Google e OpenAI todos lançaram em 72 horas. O que foi lançado, o que nossos snapshots diários de benchmark já mostram, e por que o acesso em camadas é o novo padrão de fronteira.

GPT-6 Astra e Claude Fable 5.1: Semana de Lançamento de Fronteira, no Registro

Nos primeiros três dias de setembro de 2026, os três maiores laboratórios de IA lançaram tudo: a Anthropic lançou o Claude Fable 5.1 e o Mythos 5.1 na segunda-feira, o Google lançou o Gemini 3.8 Flash na terça-feira, e a OpenAI anunciou o GPT-6 Astra na quarta-feira. Aqui está o que realmente foi lançado, o que nossos instantâneos diários de benchmarks já mostram, e o que observar nos rankings a seguir.

O que foi lançado

Claude Fable 5.1 e Mythos 5.1 (1º de setembro). A Anthropic os chama de seus modelos mais avançados para codificação e trabalho de conhecimento, com resultados mais fortes que o Fable 5 a um custo menor para muitas cargas de trabalho. Os dois nomes são um único modelo subjacente em duas trilhas: o Fable é lançado amplamente com salvaguardas adicionais em capacidades de uso duplo, enquanto o Mythos é oferecido sem elas apenas para organizações verificadas (atualmente um conjunto de defensores cibernéticos dos EUA e laboratórios de ciências da vida). Contexto sobre a camada em nossa wiki: Claude Fable 5 e Mythos 5.

GPT-6 Astra (3 de setembro). O novo carro-chefe da OpenAI, descrito como o produto de "anos de pesquisa e grandes apostas", sendo lançado em fases para planos pagos do ChatGPT, a API e a AWS. O destaque não é apenas a capacidade: o Astra é o primeiro modelo da OpenAI a atingir o limite interno de segurança cibernética "Crítico" da empresa, e a OpenAI está limitando essas capacidades primeiro a empresas em seu programa de segurança Daybreak. Isso espelha a divisão Fable/Mythos da Anthropic e torna o acesso em camadas o padrão de fato para lançamentos de fronteira. Página da wiki: GPT-6 Astra.

O que nossos instantâneos já mostram

O Wikiprompt tira um instantâneo diário dos principais rankings, então semanas de lançamento deixam um rastro de papel:

  • O Fable 5.1 já está listado no OpenRouter em nosso instantâneo de 3 de setembro, dois dias após o lançamento, incluindo uma camada de preços em lote.
  • O Claude Fable 5 lidera a arena de desenvolvimento web no LMArena no instantâneo de hoje com um Elo de 1628 no geral (1663 em tarefas de HTML), à frente de todos os outros modelos que rastreamos lá.
  • Na arena de texto geral, o topo de hoje é um grupo apertado da Anthropic: Opus 5 Max (1505), Opus 5 High (1504) e Opus 4.6 High (1503), com o Fable 5 em 1494 ao lado do Gemini 3.7 Flash High (1491).
  • O GPT-6 Astra ainda não está nas arenas da comunidade. Lançamentos em fases geralmente aparecem em dias; quando chegar, o instantâneo diário o capturará e a mudança será visível em histórico de benchmarks.
  • Por que as camadas de acesso importam

    A mudança interessante desta semana não é um número de benchmark. Ambos os laboratórios agora lançam publicamente suas capacidades mais fortes atrás de verificação: o Mythos para organizações aprovadas, as capacidades cibernéticas do Astra para o grupo Daybreak. Para escritores de prompts, isso significa que o modelo que você pode comprar e o modelo que lidera as avaliações internas não são mais sempre o mesmo artefato, e os rankings da comunidade (que testam as variantes públicas) são a medida honesta do que você pode realmente usar.

    Observe-o se mover

  • Foto congelada de hoje: instantâneo de benchmark para 3 de setembro de 2026
  • A arena de texto, atualizada diariamente: ranking de texto
  • Onde o Fable 5 lidera atualmente: ranking de desenvolvimento web
  • Cada mudança de classificação registrada: histórico de benchmarks
  • Continuaremos tirando instantâneos diários; quando o Astra e o Fable 5.1 chegarem às arenas, os deltas estarão bem ali.

    Tags
    gpt-6-astra·claude-fable-5-1·openai·anthropic·benchmarks·model-launches