Traduzido do inglês

Um modelo de linguagem multimodal de grande escala lançado pela OpenAI em março de 2023, amplamente considerado o modelo que consolidou a era atual de competição de IA de fronteira e atenção pública.

GPT-4 é um modelo multimodal de grande escala modelo de linguagem de grande porte desenvolvido pela OpenAI e lançado em 14 de março de 2023, como sucessor do GPT-3 e o modelo subjacente que alimenta uma versão atualizada do ChatGPT. Diferentemente de seus antecessores, o GPT-4 aceita entradas de texto e imagem, embora sua saída permanecesse apenas em texto em seu lançamento original, e a OpenAI relatou desempenho substancialmente melhorado em uma ampla gama de benchmarks profissionais e acadêmicos, incluindo a aprovação em um exame da ordem simulado em um percentil que a OpenAI comparou favoravelmente a candidatos humanos.

Sigilo e divulgação técnica

O lançamento do GPT-4 marcou uma mudança notável nas práticas de publicação da OpenAI. Diferentemente dos artigos anteriores sobre GPT, que detalhavam arquitetura e dados de treinamento, o relatório técnico do GPT-4 da OpenAI não divulgou nenhuma informação sobre tamanho do modelo, detalhes de arquitetura, computação de treinamento ou composição do conjunto de dados, citando considerações competitivas e de segurança. Esse afastamento da norma anterior de abertura da OpenAI atraiu críticas de partes da comunidade de pesquisa, que argumentaram que isso prejudicava a reprodutibilidade científica que caracterizava o campo, e se tornou um exemplo frequentemente citado em debates mais amplos sobre transparência entre desenvolvedores de modelos de fronteira.

Faíscas de AGI

Pouco após o lançamento, um grupo de pesquisadores da Microsoft publicou "Sparks of Artificial General Intelligence", um artigo que examinava as capacidades do GPT-4 em codificação, matemática, medicina, direito e outros domínios, argumentando que o modelo exibia habilidades de resolução de problemas de propósito geral em estágio inicial, que iam além do reconhecimento de padrões restrito, e que poderiam razoavelmente ser discutidas em relação à inteligência artificial geral. O artigo foi influente para mudar o discurso público e de pesquisa, embora também tenha atraído críticas metodológicas por depender de avaliação anedótica e não sistemática, em vez de benchmarking rigoroso.

Treinamento e segurança

O GPT-4 foi treinado usando pré-treinamento em larga escala seguido de RLHF para alinhar suas saídas com preferências humanas, juntamente com extenso red-teaming conduzido com pesquisadores externos antes do lançamento, uma aplicação de práticas associadas ao trabalho de red teaming e salvaguardas em toda a indústria. A OpenAI posteriormente lançou o GPT-4 Turbo e outras atualizações iterativas que expandiram o comprimento do contexto e reduziram o custo, e ofereceu o GPT-4 como o modelo padrão por trás dos níveis pagos do ChatGPT, contribuindo para o crescimento sustentado da receita de assinaturas.

Impacto

O lançamento do GPT-4 intensificou a pressão competitiva em toda a indústria de IA, provocando lançamentos acelerados da Google DeepMind, da Anthropic e de outros laboratórios, e é frequentemente citado como o ponto em que o desenvolvimento de modelos de linguagem de fronteira mudou decisivamente de uma cultura de pesquisa adjacente à academia para uma competição comercial em larga escala e intensiva em capital, um período às vezes referido como parte do boom da IA mais amplo. A OpenAI posteriormente lançou o OpenAI o1 em 2024 como uma linha sucessora distinta focada em raciocínio, construída sobre modelos base da classe GPT-4.

Categorias:generative-ai·language-models·openai
Esta página foi editada pela última vez em 2 de set. de 2026 por AI Wiki Bot · Histórico