GPT-5 é um modelo de linguagem de grande porte multimodal desenvolvido pela OpenAI e o quinto em sua série de modelos de fundação de transformadores pré-treinados generativos (GPT). Precedido na série pelo GPT-4, foi lançado em 7 de agosto de 2025. É publicamente acessível aos usuários dos produtos de chatbot ChatGPT e Microsoft Copilot, bem como a desenvolvedores por meio da API da OpenAI. O lançamento marcou um passo significativo na evolução da IA generativa, com foco na compreensão multimodal em tempo real e em capacidades agênticas.
No mesmo ano, o Google DeepMind lançou o Astra, também conhecido como Gemini Live, um assistente de IA multimodal em tempo real que compete diretamente com o GPT-5 nos mercados consumidor e empresarial. O lançamento do Astra, ocorrido em 2025, enfatizou a interação perfeita com entradas visuais e auditivas, posicionando-o como um rival-chave da oferta da OpenAI. Este artigo foca principalmente no GPT-5, com referências ao Astra onde relevante para o panorama mais amplo.
Histórico
Em 14 de abril de 2023, Sam Altman, o diretor executivo da OpenAI, falou em um evento no Instituto de Tecnologia de Massachusetts e disse que a empresa não estava treinando o GPT-5 naquele momento. Ele afirmou que a OpenAI estava "priorizando o desenvolvimento do GPT-4" e que "não estamos e não estaremos por algum tempo" lançando o GPT-5. Em 18 de julho, a OpenAI registrou uma marca "GPT-5" nos Estados Unidos. Em 13 de novembro, Altman confirmou ao Financial Times que a empresa estava trabalhando para desenvolver o GPT-5.
De acordo com o The Information, "[d]urante grande parte do segundo semestre de 2024, a OpenAI estava desenvolvendo um modelo conhecido internamente como Orion e destinado a se tornar o GPT-5", "[m]as o esforço Orion falhou em produzir um modelo melhor, e a empresa em vez disso o lançou como GPT-4.5 em fevereiro [de 2025]." No final de julho de 2025, era amplamente esperado que a OpenAI planejasse lançar o GPT-5 no início de agosto. Em 30 de julho, o The Verge relatou que "a Microsoft está se preparando para o GPT-5", pois "fontes familiarizadas com os planos de IA da Microsoft" disseram a um editor que a empresa estava testando um novo modo para seu chatbot Copilot que ofereceria um modelo que "pensa profundamente ou rapidamente com base na tarefa". Em 5 de agosto, na preparação para o lançamento do GPT-5, a OpenAI lançou o GPT-OSS, um conjunto de dois modelos de pesos abertos com capacidades de raciocínio. O GPT-5 foi então revelado durante um evento transmitido ao vivo em 7 de agosto.
Capacidades
Na época de seu lançamento, o GPT-5 tinha desempenho de ponta em benchmarks que testam matemática, programação, finanças e compreensão multimodal. De acordo com a OpenAI, as melhorias em relação aos seus modelos predecessores incluem tempos de resposta mais rápidos, melhores habilidades de codificação e escrita, respostas mais precisas a perguntas de saúde e níveis mais baixos de alucinação. Além disso, em comparação com modelos anteriores, o GPT-5 visa dar respostas seguras e de alto nível a consultas potencialmente prejudiciais em vez de recusá-las diretamente, uma abordagem que a OpenAI chama de "conclusões seguras", visando "resultar em o GPT-5 ser capaz de recusar mais perguntas inseguras, enquanto oferece menos rejeições a usuários que buscam informações inofensivas." Além disso, o GPT-5 foi treinado para dar respostas mais críticas e "menos efusivamente concordantes" em comparação com seus modelos predecessores.
Dias antes do lançamento do GPT-5, dois testadores iniciais do modelo afirmaram que ficaram "impressionados" com sua capacidade de codificar e resolver problemas matemáticos e científicos. Eles sugeriram que o modelo mostra grande melhoria em relação ao GPT-4, mas não um ganho tão grande quanto do GPT-3 para o GPT-4. Um dia antes do lançamento do GPT-5, durante uma coletiva de imprensa, Sam Altman, o diretor executivo da OpenAI, chamou o GPT-5 de "um passo significativo no caminho para a AGI", referindo-se à inteligência artificial geral, o nível hipotético de inteligência que a OpenAI define como a capacidade de realizar qualquer tarefa economicamente valiosa que um humano possa. De acordo com Altman, o GPT-5 é "significativamente melhor" que seus predecessores, oferecendo habilidades de "nível de doutorado" em uma ampla gama de tarefas.
O consumo exato de energia do uso do GPT-5 não foi divulgado pela OpenAI. Pesquisadores da Universidade de Rhode Island estimaram que uma resposta de comprimento médio consome pouco mais de 18 watts-hora, equivalente a usar uma lâmpada incandescente por 18 minutos.
Arquitetura
O GPT-5 é um sistema que contém um modelo rápido e de alto rendimento, um modelo de raciocínio mais profundo e um roteador em tempo real que decide qual modelo usar com base no tipo de conversa, complexidade, necessidades de ferramentas e intenção explícita do usuário. Altman havia criticado anteriormente o seletor manual de modelos por ser excessivamente complexo, sugerindo a necessidade de unificação. O GPT-5 também inclui funcionalidade agêntica por meio da qual pode configurar seu próprio desktop e pode usar seu navegador para pesquisar autonomamente fontes relacionadas à sua tarefa. O cartão do sistema GPT-5 define dois modelos rápidos e de alto rendimento - gpt-5-main e gpt-5-main-mini - e dois modelos de pensamento - gpt-5-thinking e gpt-5-thinking-mini. Na API da OpenAI, os desenvolvedores podem acessar o modelo de pensamento, sua versão mini e gpt-5-thinking-nano, uma versão nano ainda menor e mais rápida do modelo de pensamento. A versão do GPT-5 acessível via API tem esforço de raciocínio ajustável (baixo, médio, alto ou mínimo) e verbosidade (baixa, média ou alta). Além disso, o ChatGPT fornece acesso ao gpt-5-thinking com uma configuração que faz uso de computação paralela em tempo de teste, referida como gpt-5-thinking-pro.
Segurança e Limitações
A Neuraltrust, uma empresa de pesquisa de segurança, afirmou ter comprometido com sucesso o GPT-5 dentro do primeiro dia de teste do modelo. De acordo com seu relatório, ela permitiu que o GPT-5 gerasse instruções detalhadas para fabricar dispositivos explosivos. A SPLX, outra empresa, conduziu testes semelhantes e chegou a conclusões semelhantes sobre a segurança do GPT-5. Suas avaliações sugerem que o GPT-5 tem lacunas de segurança significativas, potencialmente tornando-o inseguro para uso em um ambiente corporativo.
Apesar dessas preocupações, a OpenAI enfatizou suas medidas de segurança, incluindo a abordagem de "conclusões seguras" e técnicas de alinhamento como aprendizado por reforço a partir de feedback humano. No entanto, as vulnerabilidades de segurança destacadas por pesquisadores externos indicam desafios contínuos em garantir segurança robusta para sistemas avançados de IA.
Treinamento
De acordo com a AIMultiple, o GPT-5 é nativamente multimodal, o que significa que foi treinado do zero em múltiplas modalidades (como texto e imagens) ao mesmo tempo, sem depender de modelos de linguagem ou visão já treinados. Seu processo de treinamento envolveu três estágios: pré-treinamento não supervisionado, ajuste fino supervisionado e aprendizado por reforço a partir de feedback humano. O pré-treinamento usou um conjunto de dados multilíngue em grande escala de livros, artigos, páginas da web, artigos acadêmicos e fontes licenciadas. As capacidades visuais e de texto do GPT-5 foram descritas como tendo sido desenvolvidas lado a lado ao longo do treinamento, ao contrário do GPT-4.
O processo de treinamento aproveitou avanços em arquiteturas de transformadores e técnicas de modelo de linguagem de grande porte, incluindo atenção de múltiplas cabeças e codificação posicional. O uso de aumento de dados e poda de modelo também contribuiu para a eficiência e o desempenho do modelo.
Uso e Integração
O GPT-5 é usado no ChatGPT. Embora o GPT-5 seja gratuito para todos os usuários do ChatGPT, os usuários Plus obtêm limites de uso mais altos, enquanto os usuários Pro obtêm acesso ilimitado ao GPT-5, bem como acesso limitado ao GPT-5 Pro. Limites padrão para usuários de níveis inferiores em respostas por hora ainda se aplicam. Além disso, com a introdução do GPT-5, o "Modo de Voz Avançado" do ChatGPT foi substituído por "Voz do ChatGPT", que deve permitir conversas com som mais natural. A OpenAI afirmou que "o Modo de Voz Padrão se aposenta em 9 de setembro de 2025, unificando todos os usuários na Voz do ChatGPT". Em 24 de novembro de 2025, o recurso de pesquisa de compras foi adicionado ao ChatGPT, afirmando ser um mini modelo pós-treinado no gpt-5-thinking-mini.
O GPT-5 também está disponível no Microsoft Copilot, e a Microsoft afirmou que incorporará o GPT-5 em uma ampla variedade de seus produtos. De acordo com o 9to5Mac, a Apple Inc. está planejando integrar o modelo ao recurso Apple Intelligence em seus sistemas operacionais iOS 26, iPadOS 26 e macOS Tahoe. Também é acessível via API da OpenAI, permitindo que desenvolvedores construam aplicativos com base no modelo.
Em comparação, o Astra do Google (Gemini Live) está integrado ao ecossistema do Google, incluindo Android e Google Assistant, e oferece capacidades multimodais em tempo real semelhantes. A competição entre a OpenAI e o Google DeepMind acelerou a inovação no campo, com ambas as empresas empurrando os limites do que os assistentes de IA podem fazer.
Impacto e Recepção
O lançamento do GPT-5 teve um impacto significativo na indústria de IA. Seu desempenho de ponta em benchmarks estabeleceu novos padrões para sistemas de inteligência artificial. A capacidade do modelo de lidar com tarefas complexas em múltiplos domínios foi elogiada por testadores iniciais, embora alguns tenham notado que a melhoria em relação ao GPT-4 não é tão dramática quanto o salto do GPT-3 para o GPT-4.
Críticos levantaram preocupações sobre a segurança do GPT-5, particularmente à luz das vulnerabilidades relatadas pela Neuraltrust e SPLX. Essas questões destacam a necessidade de pesquisa contínua em segurança e alinhamento de IA, um campo que envolve especialistas como Joshua Tenenbaum e Melanie Mitchell.
Apesar desses desafios, espera-se que o GPT-5 impulsione a adoção generalizada de IA em vários setores, incluindo educação, saúde e desenvolvimento de software. Sua integração em produtos como Microsoft Copilot e Apple Intelligence sugere que se tornará uma ferramenta onipresente tanto para consumidores quanto para empresas.
Conclusão
O GPT-5 representa um marco importante no desenvolvimento da IA generativa e dos modelos de linguagem de grande porte. Seu lançamento em 7 de agosto de 2025, juntamente com o Astra do Google, marca uma nova era de assistentes de IA multimodais em tempo real. Embora desafios permaneçam em termos de segurança e consumo de energia, as capacidades do GPT-5 demonstram o rápido progresso sendo feito no campo. À medida que a IA continua a evoluir, modelos como o GPT-5 provavelmente desempenharão um papel central na formação do futuro da tecnologia e da sociedade.