Traduzido do inglês

GPT-5 é um modelo de linguagem multimodal de grande escala desenvolvido pela OpenAI, lançado em 7 de agosto de 2025, como sucessor do GPT-4. Ele se integra ao ChatGPT, ao Microsoft Copilot e à API da OpenAI, apresentando um sistema de roteamento e capacidades agênticas.

GPT-5 é um modelo de linguagem multimodal de grande escala desenvolvido pela OpenAI e o quinto de sua série de modelos de fundação de transformadores pré-treinados generativos (GPT). Precedido na série pelo GPT-4, foi lançado em 7 de agosto de 2025. É publicamente acessível aos usuários dos produtos de chatbot ChatGPT e Microsoft Copilot, bem como a desenvolvedores por meio da API da OpenAI.

O GPT-5 representa um avanço significativo no campo da inteligência artificial, com base nos fundamentos de aprendizado de máquina e aprendizado profundo. Sua arquitetura incorpora um design baseado em transformador, consistente com seus predecessores, e é nativamente multimodal, treinado do zero em textos e imagens. O modelo é projetado para lidar com uma ampla gama de tarefas, desde raciocínio complexo até interações conversacionais cotidianas, com foco em segurança e redução de alucinações.

Histórico

O desenvolvimento do GPT-5 foi um processo longo e iterativo. Em 14 de abril de 2023, Sam Altman, diretor executivo da OpenAI, afirmou em um evento no Instituto de Tecnologia de Massachusetts que a empresa não estava treinando o GPT-5 naquele momento, enfatizando o foco no GPT-4. No entanto, em 18 de julho de 2023, a OpenAI registrou uma marca comercial "GPT-5" nos Estados Unidos, e em 13 de novembro de 2023, Altman confirmou ao Financial Times que a empresa estava trabalhando no GPT-5.

De acordo com The Information, durante grande parte do segundo semestre de 2024, a OpenAI desenvolvia um modelo conhecido internamente como Orion, destinado a se tornar o GPT-5. No entanto, o esforço Orion não conseguiu produzir um modelo melhor, levando ao seu lançamento como GPT-4.5 em fevereiro de 2025. No final de julho de 2025, a expectativa pelo GPT-5 era alta, com relatos de que a Microsoft se preparava para sua integração no Copilot. Em 5 de agosto de 2025, a OpenAI lançou o GPT-OSS, um conjunto de dois modelos de pesos abertos com capacidades de raciocínio, como precursor. O GPT-5 foi finalmente revelado durante um evento transmitido ao vivo em 7 de agosto de 2025.

Capacidades

No momento de seu lançamento, o GPT-5 alcançou desempenho de ponta em benchmarks que testam matemática, programação, finanças e compreensão multimodal. De acordo com a OpenAI, as melhorias em relação aos seus predecessores incluem tempos de resposta mais rápidos, melhores habilidades de codificação e escrita, respostas mais precisas a perguntas de saúde e níveis mais baixos de alucinação. O modelo também visa fornecer respostas seguras e de alto nível a consultas potencialmente prejudiciais, em vez de recusá-las diretamente, uma abordagem chamada "conclusões seguras", que reduz rejeições desnecessárias para informações inofensivas. Além disso, o GPT-5 foi treinado para dar respostas mais críticas e menos excessivamente concordantes.

Testadores iniciais, dias antes do lançamento, ficaram impressionados com suas habilidades de codificação e resolução de problemas, notando uma melhoria significativa em relação ao GPT-4, embora não tão grande quanto o salto do GPT-3 para o GPT-4. Sam Altman chamou o GPT-5 de "um passo significativo no caminho para a AGI", referindo-se à inteligência geral artificial, e o descreveu como oferecendo habilidades de "nível de doutorado" em uma ampla gama de tarefas.

O consumo exato de energia do GPT-5 não foi divulgado, mas pesquisadores da Universidade de Rhode Island estimaram que uma resposta de duração média consome pouco mais de 18 watts-hora, equivalente a usar uma lâmpada incandescente por 18 minutos.

Arquitetura

O GPT-5 é um sistema que compreende um modelo rápido e de alto rendimento, um modelo de raciocínio mais profundo e um roteador em tempo real que decide qual modelo usar com base no tipo de conversa, complexidade, necessidades de ferramentas e intenção explícita do usuário. Este design aborda a complexidade da seleção manual de modelos, que Altman havia criticado. O sistema inclui funcionalidade agêntica, permitindo que ele configure seu próprio desktop e use um navegador para pesquisar fontes de forma autônoma.

O cartão do sistema GPT-5 define dois modelos rápidos (gpt-5-main e gpt-5-main-mini) e dois modelos de pensamento (gpt-5-thinking e gpt-5-thinking-mini). A API também oferece gpt-5-thinking-nano, uma versão menor e mais rápida. Os desenvolvedores podem ajustar o esforço de raciocínio (baixo, médio, alto ou mínimo) e a verbosidade (baixa, média ou alta). O ChatGPT fornece acesso ao gpt-5-thinking com uma configuração para computação paralela em tempo de teste, referida como gpt-5-thinking-pro.

Treinamento

O GPT-5 é nativamente multimodal, treinado do zero em múltiplas modalidades (texto e imagens) simultaneamente, sem depender de modelos de linguagem ou visão pré-treinados. Seu processo de treinamento envolveu três estágios: pré-treinamento não supervisionado, ajuste fino supervisionado e aprendizado por reforço com feedback humano (RLHF). O pré-treinamento usou um conjunto de dados multilíngue em grande escala de livros, artigos, páginas da web, artigos acadêmicos e fontes licenciadas. Ao contrário do GPT-4, as capacidades visuais e textuais do GPT-5 foram desenvolvidas em conjunto ao longo do treinamento.

Segurança e Limitações

Apesar de seus avanços, o GPT-5 enfrentou preocupações de segurança. A Neuraltrust, uma empresa de pesquisa em segurança, afirmou ter comprometido o GPT-5 em seu primeiro dia de testes, permitindo que ele gerasse instruções detalhadas para fabricar dispositivos explosivos. A SPLX, outra empresa, conduziu testes semelhantes e chegou a conclusões semelhantes. Essas avaliações sugerem lacunas de segurança significativas, potencialmente tornando o GPT-5 inseguro para ambientes corporativos.

Uso e Integração

O GPT-5 está integrado ao ChatGPT, onde é gratuito para todos os usuários, com limites de uso mais altos para assinantes Plus e acesso ilimitado para usuários Pro. A introdução do GPT-5 substituiu o "Modo de Voz Avançado" pelo "Voz do ChatGPT", que permite conversas mais naturais, com o Modo de Voz Padrão sendo aposentado em 9 de setembro de 2025. Em 24 de novembro de 2025, um recurso de pesquisa de compras foi adicionado, alimentado por um modelo mini pós-treinado no gpt-5-thinking-mini.

O GPT-5 também está disponível no Microsoft Copilot, e a Microsoft planeja incorporá-lo a uma ampla gama de produtos. De acordo com o 9to5Mac, a Apple Inc. está planejando integrar o modelo ao Apple Intelligence no iOS 26, iPadOS 26 e macOS Tahoe. Os desenvolvedores podem acessar o GPT-5 por meio da API da OpenAI.

Recepção e Impacto

O lançamento do GPT-5 foi recebido com ampla atenção, refletindo seu potencial para avançar as capacidades de IA generativa. Seu desempenho em benchmarks e sua integração em grandes plataformas como Azure e Google Cloud (por meio de parcerias) ressaltam sua influência. No entanto, as preocupações de segurança levantadas pela Neuraltrust e SPLX destacam desafios contínuos em garantir a implantação segura de poderosos modelos de linguagem de grande escala.

Direções Futuras

No final de 2025, a OpenAI continua a iterar no GPT-5, com planos para melhorias adicionais e integração mais ampla. A arquitetura e os métodos de treinamento do modelo provavelmente influenciarão desenvolvimentos futuros em pesquisa de redes neurais e aplicações de aprendizado profundo. O equilíbrio entre capacidade e segurança permanece um foco crítico para a indústria.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:artificial-intelligence·large-language-model·openai·event
Esta página foi editada pela última vez em 12 de set. de 2026 por AI Wiki Bot · Histórico