GPT-4chan é um modelo de linguagem de grande porte desenvolvido pelo YouTuber e pesquisador de IA Yannic Kilcher em junho de 2022. Ele foi criado por meio do ajuste fino do modelo transformador de código aberto GPT-J em um conjunto de dados com mais de 100 milhões de postagens do quadro /pol/ do 4chan, um fórum online anônimo conhecido por hospedar conteúdo odioso e extremista. O modelo aprendeu a imitar o estilo e o tom dos usuários do /pol/, produzindo textos frequentemente intencionalmente ofensivos e niilistas. Kilcher implantou o modelo no próprio quadro /pol/, onde ele interagiu com usuários sem revelar sua identidade, e também o disponibilizou publicamente no Hugging Face até ser removido. O projeto gerou controvérsia e debate significativos na comunidade de inteligência artificial sobre ética, legalidade e impacto social.
Desenvolvimento
O desenvolvimento do GPT-4chan começou em maio de 2022, quando Kilcher anunciou o projeto em seu canal no YouTube. Ele pretendia criar um modelo de linguagem de grande porte capaz de gerar texto realista e coerente no estilo do /pol/, uma das comunidades online mais notórias. Kilcher foi inspirado pelo sucesso do GPT-3, um modelo poderoso da OpenAI, e do GPT-J, um modelo de código aberto com desempenho comparável lançado pela EleutherAI. Ele escolheu o GPT-J como modelo base e o ajustou usando o conjunto de dados Raiders of the Lost Kek, que continha mais de 100 milhões de postagens do /pol/ abrangendo de junho de 2016 a novembro de 2019.
Kilcher ajustou o GPT-J nesses dados, demonstrando resultados que variavam de opiniões políticas e teorias da conspiração a piadas, insultos e ameaças, além de textos criativos como poemas e código. Ele expressou curiosidade sobre como o modelo interagiria com usuários reais do /pol/ e ficou impressionado com sua fluência e diversidade.
Implantação e Lançamento
Em junho de 2022, Kilcher implantou o GPT-4chan no quadro /pol/ usando um bot que postava e respondia a tópicos de forma autônoma, sem revelar sua identidade ou supervisão humana. Ele descreveu isso como um experimento natural para observar o comportamento do modelo em um ambiente do mundo real, testando sua robustez contra trollagem, provocações e moderação.
Simultaneamente, Kilcher disponibilizou o modelo publicamente no Hugging Face, uma plataforma para compartilhamento de modelos de IA. Ele forneceu acesso por meio de uma interface web e uma API, junto com um repositório no GitHub contendo o código e os dados. Ele afirmou que esperava inspirar outros e gerar discussão sobre as implicações éticas de tais modelos.
Controvérsia e Recepção
No quadro /pol/, as postagens do GPT-4chan atraíram a atenção de usuários que, em sua maioria, não sabiam de sua identidade. Alguns elogiaram sua inteligência e humor, enquanto outros o desafiaram ou tentaram trollá-lo. As interações do modelo frequentemente levavam a debates acalorados e conflitos entre os usuários.
No Hugging Face, a página do modelo recebeu tráfego e feedback significativos. Devido a preocupações sobre danos potenciais, o acesso foi restrito e eventualmente desativado. A intervenção do CEO do Hugging Face, Clément Delangue, nas páginas de discussão foi notável, pois se desviou das práticas típicas de moderação de conteúdo.
O lançamento também atraiu cobertura da mídia e atenção pública. Uma petição condenando a implantação do GPT-4chan reuniu mais de 300 assinaturas de especialistas em tecnologia. Os críticos levantaram questões como a disseminação de discurso de ódio, a responsabilidade de desenvolvedores e plataformas de IA, a necessidade de regulamentação e o papel do código aberto e da transparência na pesquisa de IA.
Implicações Éticas e Sociais
A controvérsia do GPT-4chan destacou questões mais amplas sobre o desenvolvimento e a distribuição de modelos de IA que podem gerar conteúdo prejudicial. Ela ressaltou a tensão entre o compartilhamento de código aberto e o potencial de uso indevido. O incidente contribuiu para discussões contínuas sobre a governança da IA generativa, incluindo a necessidade de diretrizes éticas e mecanismos de supervisão. Também enfatizou a importância de considerar o impacto social dos sistemas de IA, especialmente aqueles treinados em dados online tóxicos.
Legado
O GPT-4chan permanece como um estudo de caso em ética de IA, frequentemente citado em debates sobre políticas de lançamento de modelos e moderação de conteúdo. Ele demonstrou a facilidade com que modelos de linguagem de grande porte podem ser ajustados para fins específicos e potencialmente prejudiciais, e os desafios que as plataformas enfrentam ao equilibrar abertura e segurança. O incidente influenciou discussões posteriores sobre o desenvolvimento responsável de IA e o papel do feedback da comunidade na formação de práticas de implantação de IA.