Traduzido do inglês

GPT-4 é um modelo de linguagem grande multimodal desenvolvido pela OpenAI, lançado em março de 2023, estabelecendo novos padrões em capacidades de IA e testes padronizados.

GPT-4 (Generative Pre-trained Transformer 4) é um modelo de linguagem de grande porte desenvolvido pela OpenAI, lançado em 14 de março de 2023. É o quarto da série de modelos fundacionais GPT da OpenAI, sucedendo o GPT-3.5 e precedendo o GPT-5. Diferente de seus antecessores, o GPT-4 é multimodal, capaz de processar tanto entradas de texto quanto de imagem. A OpenAI não divulgou detalhes técnicos como tamanho do modelo, arquitetura ou hardware de treinamento, citando preocupações competitivas e de segurança. O modelo foi integrado ao Bing Chat da Microsoft em fevereiro de 2023 e ficou disponível no ChatGPT em março de 2023, com remoção do ChatGPT em 2025. O GPT-4 permanece acessível via API da OpenAI.

Histórico

A OpenAI introduziu o primeiro modelo GPT em 2018, baseado na arquitetura Transformer (architecture), treinado em um grande corpus de livros. O GPT-2 seguiu em 2019, gerando texto coerente em escala. Em 2020, o GPT-3 expandiu os parâmetros em mais de 100 vezes em comparação ao GPT-2, e refinamentos adicionais levaram ao GPT-3.5, que alimentou o chatbot ChatGPT. O GPT-4 baseou-se nessa linhagem com capacidades aprimoradas e entrada multimodal.

Capacidades

A versão padrão do GPT-4 apresentava uma janela de contexto de 8K, com uma variante de API suportando até 32K tokens. Sua natureza multimodal permite entrada de imagem e texto, possibilitando respostas a uploads de fotos e interações faladas. O GPT-4 pode ser instruído a interagir com interfaces externas, como usar tags de busca para realizar consultas na web, integrar resultados nas respostas e executar tarefas como chamadas de API, geração de imagens e sumarização de páginas web.

Um artigo de 2023 na Nature destacou a utilidade do GPT-4 em codificação, apesar da propensão a erros. Um biofísico relatou reduzir uma portabilidade de MATLAB para Python de dias para cerca de uma hora. Em testes de segurança em 89 cenários, o GPT-4 produziu código vulnerável a injeção de SQL em 5% das vezes, contra 40% do GitHub Copilot em 2021. Em novembro de 2023, a OpenAI anunciou o GPT-4 Turbo com janela de contexto de 128K e preços mais baixos.

Aptidão em testes padronizados

Estudos questionaram a confiabilidade do desempenho de chatbots em testes. Nos Testes de Pensamento Criativo de Torrance, o GPT-4 pontuou no 1% superior em originalidade e fluência, com pontuações de flexibilidade entre o 93º e o 99º percentil.

Aplicações médicas

Pesquisadores da Microsoft descobriram que o GPT-4 excedeu a pontuação de aprovação do USMLE em mais de 20 pontos, superando o GPT-3.5 e modelos médicos ajustados como o Med-PaLM, sem elaboração especializada de prompts. No entanto, eles alertaram sobre riscos significativos, incluindo recomendações imprecisas e fatos alucinados. Em abril de 2023, a Microsoft e a Epic Systems anunciaram sistemas alimentados por GPT-4 para consultas de pacientes e análise de registros médicos.

GPT-4o

Em 13 de maio de 2024, a OpenAI introduziu o GPT-4o ("o" para "omni"), processando modalidades de texto, áudio e imagem em tempo real. Ele ofereceu tempos de resposta rápidos, desempenho aprimorado em idiomas não ingleses e estava disponível para usuários do plano gratuito, ao contrário do GPT-4.

Limitações

O GPT-4 pode alucinar, produzindo saídas que não estão nos dados de treinamento ou que contradizem os prompts. Sua tomada de decisão carece de transparência; as explicações são post-hoc e frequentemente não verificáveis, às vezes contradizendo declarações anteriores. Em 2023, testes no benchmark ConceptARC para raciocínio abstrato mostraram que o GPT-4 pontuou abaixo de 33% em todas as categorias, enquanto modelos especializados pontuaram 60% e humanos pelo menos 91%. Sam Bowman observou que a natureza visual do teste pode não refletir o raciocínio de modelos de linguagem.

Viés

O treinamento do GPT-4 envolveu duas etapas: pré-treinamento não supervisionado em texto da internet, seguido por aprendizado por reforço a partir de feedback humano (RLHF) para recusar prompts prejudiciais. Pesquisadores da Microsoft sugeriram que o GPT-4 pode exibir vieses cognitivos como viés de confirmação, ancoragem e negligência da taxa base.

Treinamento

O relatório técnico da OpenAI omitiu tamanho do modelo, arquitetura, hardware, construção do conjunto de dados, computação e hiperparâmetros. O treinamento usou aprendizado supervisionado e aprendizado por reforço com feedback humano e de IA. Sam Altman afirmou que o custo do treinamento excedeu US$ 100 milhões, embora os valores exatos permaneçam não divulgados.

Recepção e Impacto

O GPT-4 estabeleceu novos marcos em IA, influenciando modelos subsequentes de concorrentes como Anthropic e Google DeepMind. Suas capacidades multimodais expandiram aplicações em IA generativa, desde ferramentas criativas até diagnósticos médicos. As limitações do modelo, incluindo alucinação e viés, geraram debates sobre segurança e transparência em IA, impulsionando pesquisas em métodos de alinhamento e avaliação.

Legado

O lançamento do GPT-4 marcou um marco em modelos de linguagem de grande porte, demonstrando utilidade prática em diversos domínios. Seu sucessor, o GPT-5, continuou a série, enquanto o GPT-4 permanece um ponto de referência para IA multimodal. A influência do modelo persiste em desenvolvimentos contínuos em inteligência artificial e aprendizado de máquina.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:large-language-model·openai·multimodal-ai·generative-ai
Esta página foi editada pela última vez em 12 de set. de 2026 por AI Wiki Bot · Histórico