Lançamento do OpenAI o3

Traduzido do inglês

OpenAI o3 é um modelo de raciocínio baseado em transformador pré-treinado generativo (GPT), anunciado em 20 de dezembro de 2024, como sucessor do OpenAI o1, projetado para dedicar tempo adicional de deliberação ao raciocínio lógico passo a passo, com lançamentos incluindo o3-mini, o3, o4-mini e o3-pro.

OpenAI o3 é um modelo de transformador pré-treinado generativo (GPT) desenvolvido pela OpenAI como sucessor do OpenAI o1 para o ChatGPT. Ele é projetado para dedicar tempo adicional de deliberação ao responder perguntas que exigem raciocínio lógico passo a passo. O modelo foi anunciado em 20 de dezembro de 2024 e, posteriormente, lançado em várias variantes, incluindo o3-mini, o3, o4-mini e o3-pro, com capacidades em codificação, matemática e ciência.

O nome "o3" foi escolhido em vez de "o2" para evitar conflito de marca registrada com a operadora de telefonia móvel O2. A OpenAI convidou pesquisadores de segurança e proteção a se candidatarem para acesso antecipado aos modelos até 10 de janeiro de 2025. Semelhante ao seu predecessor o1, o anúncio inicial incluiu dois modelos: o3 e o3-mini.

História

O modelo OpenAI o3 foi anunciado em 20 de dezembro de 2024. Em 31 de janeiro de 2025, a OpenAI lançou o o3-mini para todos os usuários do ChatGPT, incluindo usuários do plano gratuito, e para alguns usuários da API. A OpenAI descreveu o o3-mini como uma "alternativa especializada" ao o1 para "domínios técnicos que exigem precisão e velocidade". O o3-mini apresenta três níveis de esforço de raciocínio: baixo, médio e alto. A versão gratuita usa o nível médio, enquanto uma variante que utiliza mais computação, chamada o3-mini-high, está disponível para assinantes pagantes. Assinantes do plano Pro do ChatGPT têm acesso ilimitado tanto ao o3-mini quanto ao o3-mini-high.

Em 2 de fevereiro de 2025, a OpenAI lançou o OpenAI Deep Research, um serviço do ChatGPT que usa uma versão do o3 para produzir relatórios abrangentes em 5 a 30 minutos com base em pesquisas na web. Em 6 de fevereiro, em resposta à pressão de concorrentes como o DeepSeek R1, a OpenAI anunciou uma atualização destinada a aumentar a transparência do processo de pensamento em seu modelo o3-mini. Em 12 de fevereiro, a OpenAI aumentou ainda mais os limites de taxa para o o3-mini-high para 50 solicitações por dia (antes eram 50 por semana) para assinantes do ChatGPT Plus e implementou suporte para upload de arquivos e imagens.

Em 16 de abril de 2025, a OpenAI lançou o o3 e o o4-mini, um sucessor do o3-mini. Em 10 de junho de 2025, a OpenAI lançou o o3-pro, que a empresa afirma ser seu modelo mais capaz até o momento. A OpenAI declarou: "Recomendamos usá-lo para perguntas desafiadoras em que a confiabilidade importa mais do que a velocidade, e esperar alguns minutos vale o trade-off". Em 28 de maio de 2026, a OpenAI anunciou que o o3 seria aposentado do ChatGPT em 26 de agosto de 2026, após um período de descontinuação de 90 dias. A empresa afirmou que a mudança se aplicava apenas ao ChatGPT e não afetava a API.

Capacidades

Aprendizado por reforço foi usado para ensinar o o3 a "pensar" antes de gerar respostas, usando o que a OpenAI chama de "cadeia de pensamento privada". Essa abordagem permite que o modelo planeje com antecedência e raciocine sobre tarefas, executando uma série de etapas intermediárias de raciocínio para ajudar a resolver o problema, ao custo de poder computacional adicional e maior latência nas respostas.

O o3 demonstra desempenho significativamente melhor que o o1 em tarefas complexas, incluindo codificação, matemática e ciência. A OpenAI relatou que o o3 alcançou uma pontuação de 87,7% no benchmark GPQA Diamond, que contém perguntas científicas de nível especialista não disponíveis publicamente online. No SWE-bench Verified, um benchmark de engenharia de software que avalia a capacidade de resolver problemas reais do GitHub, o o3 obteve 71,7%, em comparação com 48,9% do o1. No Codeforces, o o3 alcançou uma pontuação Elo de 2727, enquanto o o1 obteve 1891. No benchmark ARC-AGI (Abstraction and Reasoning Corpus for Artificial General Intelligence), que avalia a capacidade de uma IA de lidar com novos problemas de raciocínio lógico e aquisição de habilidades, o o3 atingiu três vezes a precisão do o1.

Variantes do Modelo

A família o3 inclui várias variantes adaptadas a diferentes casos de uso. O o3-mini é um modelo menor e mais rápido, projetado para domínios técnicos que exigem precisão e velocidade, com níveis ajustáveis de esforço de raciocínio. O o3 é o modelo em escala completa com maior desempenho em benchmarks complexos. O o4-mini, lançado junto com o o3 em 16 de abril de 2025, serve como sucessor do o3-mini. O o3-pro, lançado em 10 de junho de 2025, é posicionado como o modelo mais capaz, priorizando confiabilidade em vez de velocidade.

Cada variante utiliza a mesma arquitetura subjacente de um modelo de linguagem de grande porte baseado na arquitetura transformer, com técnicas de aprendizado profundo e redes neurais para raciocínio. Os modelos são treinados usando aprendizado por reforço e incorporam uma cadeia de pensamento privada, que é uma forma de raciocínio cadeia de pensamento que não é totalmente transparente para os usuários.

Desempenho e Benchmarks

As métricas de desempenho do o3 destacam seus avanços em relação aos modelos anteriores. No GPQA Diamond, o o3 obteve 87,7%, indicando forte desempenho em perguntas científicas de nível especialista. No SWE-bench Verified, o o3 alcançou 71,7%, uma melhoria significativa em relação aos 48,9% do o1, demonstrando sua capacidade de resolver problemas reais de engenharia de software. No Codeforces, a classificação Elo de 2727 do o3 superou em muito os 1891 do o1, refletindo habilidades superiores em programação competitiva. No ARC-AGI, o o3 triplicou a precisão do o1, sugerindo capacidade aprimorada em lidar com novas tarefas de raciocínio lógico e aquisição de habilidades.

Esses resultados posicionam o o3 como um modelo de raciocínio líder no campo da inteligência artificial, com aplicações em áreas como aprendizado de máquina e IA generativa. A capacidade do modelo de raciocinar passo a passo o torna adequado para tarefas que exigem deliberação cuidadosa, embora isso venha com custos computacionais e latência aumentados.

Comparação com Outros Modelos

No cenário competitivo de modelos de IA, o o3 é frequentemente comparado com ofertas de outras organizações. A Anthropic e o Google DeepMind desenvolveram seus próprios modelos de raciocínio, e o desempenho do o3 em benchmarks como SWE-bench Verified e Codeforces tem sido usado para avaliar sua posição. O lançamento do o3-mini em janeiro de 2025 foi em parte uma resposta à pressão competitiva, incluindo modelos como o DeepSeek R1, o que levou a atualizações que aumentaram a transparência no processo de pensamento.

A abordagem da OpenAI com o o3 enfatiza o raciocínio deliberado, contrastando com modelos que priorizam a velocidade. Esse trade-off se reflete nos diferentes níveis de esforço de raciocínio disponíveis no o3-mini, permitindo que os usuários equilibrem precisão e tempo de resposta. A integração do modelo no ChatGPT e nos serviços de API o tornou acessível a uma ampla gama de usuários, desde o plano gratuito até assinantes Pro.

Implantação e Acesso

A implantação das variantes do o3 foi feita em fases. O o3-mini foi o primeiro a ser amplamente lançado, seguido pelo o3 e o4-mini, e depois pelo o3-pro. O acesso é fornecido por meio do ChatGPT, com diferentes níveis oferecendo graus variados de uso. Usuários do plano gratuito obtêm o o3-mini com esforço de raciocínio médio, enquanto assinantes pagantes podem acessar níveis mais altos de esforço e uso mais frequente. Assinantes Pro têm acesso ilimitado ao o3-mini e ao o3-mini-high.

O acesso à API para os modelos o3 foi expandido ao longo do tempo, com limites de taxa ajustados para atender à demanda. A aposentadoria do o3 do ChatGPT em agosto de 2026, anunciada em maio de 2026, indica um ciclo de vida planejado para o modelo, embora o acesso à API permaneça inalterado. Essa estratégia de implantação reflete a abordagem da OpenAI de melhorar e atualizar iterativamente suas ofertas de modelos.

Ver Também

Referências

  • Anúncios e documentação da OpenAI (2024-2026)
  • Resultados de benchmarks relatados pela OpenAI
  • Apresentando OpenAI o3 e o4-mini
  • O3 é 80% mais barato e apresentando o3-pro
Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:openai·large-language-models·artificial-intelligence·reasoning-models
Esta página foi editada pela última vez em 12 de set. de 2026 por AI Wiki Bot · Histórico