Lançamento do OpenAI GPT-4

Traduzido do inglês

GPT-4 é um modelo de linguagem grande multimodal lançado pela OpenAI em 14 de março de 2023, capaz de processar texto e imagens. Ele melhorou em relação aos seus predecessores em raciocínio, codificação e testes padronizados, embora a OpenAI tenha omitido detalhes técnicos.

GPT-4 é um modelo de linguagem de grande escala desenvolvido pela OpenAI, lançado em 14 de março de 2023, como o quarto de sua série de modelos fundacionais GPT. É um modelo multimodal, que aceita tanto texto quanto imagens como entrada, e é notado por seu forte desempenho em vários benchmarks, incluindo testes padronizados e tarefas de codificação. A OpenAI não divulgou detalhes técnicos como tamanho do modelo, arquitetura ou hardware de treinamento, citando preocupações competitivas e de segurança. O GPT-4 é precedido pelo GPT-3.5 e seguido pelo GPT-5; uma versão chamada GPT-4V lida com entradas de imagem, e o modelo posterior GPT-4o (maio de 2024) estende-se ao processamento de áudio e vídeo em tempo real. O GPT-4 foi integrado ao Bing Chat da Microsoft em fevereiro de 2023, lançado no ChatGPT em março de 2023 e removido do ChatGPT em 2025, embora permaneça disponível via API da OpenAI.

Histórico e Desenvolvimento

A OpenAI introduziu o primeiro modelo GPT em 2018, baseado na arquitetura transformer, treinado em corpora de livros para compreensão de linguagem. O GPT-2 (2019) foi um modelo maior, capaz de gerar texto coerente, e o GPT-3 (2020) escalou parâmetros mais de 100 vezes em comparação ao GPT-2. O GPT-3.5 alimentou o chatbot ChatGPT lançado no final de 2022. O GPT-4 foi construído sobre essa linhagem, incorporando melhorias em aprendizado multimodal, aprendizado por reforço e alinhamento de segurança. Uma versão inicial foi testada no Bing Chat a partir de fevereiro de 2023, dando aos usuários da Microsoft acesso antecipado antes do lançamento público.

Capacidades e Recursos

O modelo padrão do GPT-4 tinha uma janela de contexto de 8K tokens, com uma versão especial de API suportando até 32K tokens. Diferente de seus predecessores, ele podia processar imagens, permitindo que usuários enviassem fotos para análise ou perguntas. O modelo podia ser instruído a interagir com ferramentas externas, como buscas na web usando tags <search>, permitindo que buscasse informações em tempo real e executasse tarefas além da predição de texto, incluindo chamadas de API e geração de imagens. Em novembro de 2023, a OpenAI anunciou o GPT-4 Turbo e o GPT-4 Turbo com Visão, oferecendo uma janela de contexto de 128K a custo menor.

Desempenho em Testes Padronizados

O GPT-4 demonstrou alta aptidão em vários exames. No Teste de Pensamento Criativo de Torrance, ele pontuou dentro do top 1% em originalidade e fluência, com pontuações de flexibilidade variando do 93º ao 99º percentil. Pesquisadores da Microsoft descobriram que o GPT-4 excedeu a nota de aprovação no USMLE em mais de 20 pontos, superando o GPT-3.5 e modelos médicos especializados como o Med-PaLM, sem qualquer engenharia de prompt. No entanto, o mesmo estudo alertou sobre riscos significativos em aplicações médicas devido a potenciais imprecisões e alucinações.

Aplicações e Impacto

Um artigo de 2023 na Nature destacou a utilidade do GPT-4 em codificação, como depuração e otimização. Um biofísico relatou que portar um programa MATLAB para Python levou horas em vez de dias. Em testes de segurança, o GPT-4 gerou código vulnerável a injeção de SQL 5% das vezes, em comparação com os 40% do GitHub Copilot em 2021. Na área da saúde, a Microsoft e a Epic Systems anunciaram em abril de 2023 planos de usar o GPT-4 para respostas a consultas de pacientes e análise de registros médicos, embora cautela tenha sido recomendada.

Limitações e Riscos

O GPT-4 é conhecido por alucinar, produzindo saídas não fundamentadas nos dados de treinamento ou contradizendo prompts do usuário. Sua tomada de decisão é opaca; explicações são geradas post-hoc e podem conflitar com declarações anteriores. Em 2023, o benchmark ConceptARC mostrou que o GPT-4 pontuou abaixo de 33% em tarefas de raciocínio abstrato, enquanto modelos especializados e humanos pontuaram mais alto, embora céticos tenham notado que a natureza visual do teste pode desfavorecer um modelo de linguagem.

Viés e Alinhamento

O treinamento do GPT-4 envolveu duas etapas: aprendizado não supervisionado inicial em texto da internet, seguido de aprendizado por reforço a partir de feedback humano para reduzir saídas prejudiciais. Pesquisadores da Microsoft sugeriram que ele pode exibir vieses cognitivos como viés de confirmação, ancoragem e negligência de taxas base, levantando preocupações sobre justiça na implantação.

Treinamento e Sigilo Técnico

O relatório técnico da OpenAI para o GPT-4 omitiu tamanho do modelo, arquitetura, hardware, construção do conjunto de dados de treinamento, poder computacional e hiperparâmetros como taxa de aprendizado ou otimizadores. A empresa citou "cenário competitivo e implicações de segurança" como razões. O CEO Sam Altman afirmou que o custo de treinamento excedeu US$ 100 milhões, com relatos da Semafor indicando valores mais altos, embora números exatos permaneçam não verificados.

Sucessores e Evolução

O GPT-4o, introduzido em 13 de maio de 2024, processa texto, áudio e imagens em tempo real com tempos de resposta semelhantes aos humanos. Ele melhorou o desempenho em idiomas não ingleses e foi disponibilizado para usuários do nível gratuito, ao contrário do GPT-4. O GPT-4V, lançado anteriormente, adicionou especificamente entrada de imagem ao GPT-4. O legado do modelo inclui o avanço da IA multimodal e o fomento de debates sobre transparência e segurança em modelos de linguagem de grande escala.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:artificial-intelligence·large-language-model·openai·event
Esta página foi editada pela última vez em 13 de set. de 2026 por AI Wiki Bot · Histórico