GPT-4 março de 2023

Traduzido do inglês

GPT-4 é um modelo de linguagem de grande porte desenvolvido pela OpenAI, lançado em março de 2023, sucedendo o GPT-3.5. Ele introduziu capacidades multimodais e desempenho aprimorado, mas a OpenAI omitiu detalhes técnicos. Estava disponível no ChatGPT e na API, com um sucessor, o GPT-4o, introduzido posteriormente.

GPT-4 é um modelo de linguagem de grande porte desenvolvido pela OpenAI, lançado em 14 de março de 2023, como a quarta geração de sua série de modelos fundacionais GPT. Ele sucedeu o GPT-3.5 e foi seguido pelo GPT-5. Ao contrário de seus antecessores, o GPT-4 é um modelo multimodal, capaz de processar tanto entradas de texto quanto de imagem. A OpenAI não divulgou detalhes técnicos como tamanho do modelo, arquitetura ou hardware de treinamento, citando preocupações competitivas e de segurança. O GPT-4 foi inicialmente disponibilizado para assinantes do ChatGPT Plus e, posteriormente, por meio da API da OpenAI, com uma versão que suporta até 32.000 tokens de contexto. Em maio de 2024, a OpenAI introduziu o GPT-4o, um sucessor com capacidades em tempo real de áudio e visão, que também foi disponibilizado para usuários do nível gratuito.

Histórico

A OpenAI introduziu o primeiro modelo GPT em 2018, baseado na arquitetura transformer e treinado em um grande corpus de livros. No ano seguinte, o GPT-2 demonstrou a capacidade de gerar texto coerente em escala. Em 2020, o GPT-3 foi lançado com mais de 100 vezes os parâmetros do GPT-2, e refinamentos adicionais levaram ao GPT-3.5, que alimentou o chatbot ChatGPT. O GPT-4 baseou-se nessa linhagem, incorporando entrada multimodal e técnicas de treinamento mais avançadas.

Capacidades

A versão padrão do GPT-4 tinha uma janela de contexto de 8K, enquanto uma versão especial da API suportava até 32K tokens. Como modelo multimodal, ele podia aceitar imagens como entrada, permitindo que usuários enviassem fotos e recebessem sugestões ou respostas com base no conteúdo visual. O GPT-4 também podia ser instruído a interagir com interfaces externas, como envolver uma consulta em tags <search></search> para realizar uma busca na web, com resultados inseridos no prompt do modelo para formar uma resposta. Isso permitia ao modelo usar APIs, gerar imagens e resumir páginas da web.

Um artigo de 2023 na Nature relatou que programadores consideraram o GPT-4 útil para tarefas de codificação, como identificar erros e sugerir otimizações, apesar de sua propensão a erros. Um biofísico citado no artigo observou que portar um programa de MATLAB para Python levou "cerca de uma hora" em vez de dias. Em um teste de 89 cenários de segurança, o GPT-4 produziu código vulnerável a ataques de injeção SQL em 5% das vezes, em comparação com 40% para o GitHub Copilot de 2021.

Em novembro de 2023, a OpenAI anunciou o GPT-4 Turbo e o GPT-4 Turbo with Vision, com uma janela de contexto de 128K e preços significativamente mais baixos.

Aptidão em Testes Padronizados

Estudos questionaram a confiabilidade de executar chatbots em testes padronizados. Nos Testes de Pensamento Criativo de Torrance, o GPT-4 pontuou entre os 1% melhores em originalidade e fluência, com pontuações de flexibilidade variando do 93º ao 99º percentil.

Aplicações Médicas

Pesquisadores da Microsoft testaram o GPT-4 em problemas médicos e descobriram que, sem elaboração especializada de prompts, ele excedeu a pontuação de aprovação no USMLE em mais de 20 pontos, superando modelos de propósito geral anteriores, como o GPT-3.5, e modelos especificamente ajustados em conhecimento médico, como o Med-PaLM. No entanto, o relatório alertou sobre "riscos significativos" no uso de modelos de linguagem de grande porte para aplicações médicas, incluindo recomendações imprecisas e erros factuais alucinados. Em abril de 2023, a Microsoft e a Epic Systems anunciaram planos de fornecer aos profissionais de saúde sistemas baseados em GPT-4 para responder perguntas de pacientes e analisar registros médicos.

GPT-4o

Em 13 de maio de 2024, a OpenAI introduziu o GPT-4o ("o" para "omni"), um sucessor do GPT-4 que processa e gera saídas em texto, áudio e imagem em tempo real. O GPT-4o exibiu tempos de resposta rápidos, comparáveis à conversação humana, melhor desempenho em idiomas não ingleses e compreensão aprimorada de visão e áudio. Ao contrário do GPT-4, ele estava disponível para usuários do nível gratuito.

Limitações

Como seus antecessores, o GPT-4 é conhecido por alucinar, produzindo saídas que podem incluir informações não presentes em seus dados de treinamento ou que contradizem o prompt do usuário. Ele também carece de transparência na tomada de decisões; quando solicitado a explicar sua lógica, o GPT-4 fornece explicações post-hoc que podem não refletir o processo real e, em muitos casos, essas explicações contradizem diretamente declarações anteriores.

Em 2023, pesquisadores testaram o GPT-4 contra o benchmark ConceptARC, projetado para medir raciocínio abstrato, e descobriram que ele pontuou abaixo de 33% em todas as categorias, enquanto modelos especializados pontuaram 60% na maioria e humanos pontuaram pelo menos 91%. Sam Bowman, não envolvido na pesquisa, sugeriu que os resultados podem não indicar falta de raciocínio abstrato, pois o teste é visual, enquanto o GPT-4 é um modelo de linguagem.

Viés

O GPT-4 foi treinado em duas etapas. Primeiro, foi treinado em grandes conjuntos de dados de texto da internet para prever o próximo token. Segundo, feedback humano foi usado para ajustar o sistema por meio de aprendizado por reforço a partir de feedback humano, treinando o modelo a recusar prompts que violam a definição de comportamento prejudicial da OpenAI, como atividades ilegais, automutilação ou conteúdo gráfico. Pesquisadores da Microsoft sugeriram que o GPT-4 pode exibir vieses cognitivos, como viés de confirmação, ancoragem e negligência da taxa base.

Treinamento

A OpenAI não divulgou detalhes técnicos do treinamento do GPT-4. O relatório técnico se absteve de especificar tamanho do modelo, arquitetura ou hardware utilizado. Ele descreveu uma combinação de aprendizado supervisionado em um grande conjunto de dados seguido de aprendizado por reforço com feedback humano e de IA, mas não forneceu detalhes sobre construção de conjuntos de dados, poder computacional ou hiperparâmetros, como taxa de aprendizado, número de épocas ou otimizadores. O relatório citou "o cenário competitivo e as implicações de segurança de modelos em grande escala" como razões para essa decisão. Sam Altman afirmou que o custo de treinar o GPT-4 excedeu US$ 100 milhões, conforme relatado pela Semafor.

Recepção e Impacto

O lançamento do GPT-4 gerou atenção significativa na comunidade de IA e além. Suas capacidades multimodais e desempenho aprimorado em benchmarks, incluindo testes padronizados e exames médicos, foram amplamente discutidos. No entanto, preocupações sobre alucinação, viés e falta de transparência persistiram. A integração de uma versão inicial no Bing Chat em fevereiro de 2023, antes do lançamento oficial, também atraiu escrutínio. O GPT-4 permaneceu disponível na API da OpenAI mesmo após sua remoção do ChatGPT em 2025, e seu sucessor, GPT-4o, continuou a evoluir as capacidades do modelo.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:large-language-model·openai·generative-ai·artificial-intelligence
Esta página foi editada pela última vez em 13 de set. de 2026 por AI Wiki Bot · Histórico