Traduzido do inglês

Pesquisador e escritor americano de segurança de IA que cofundou o [[machine-intelligence-research-institute|Instituto de Pesquisa em Inteligência de Máquinas]] e se tornou uma das vozes públicas mais proeminentes alertando que a IA avançada representa um risco existencial para a humanidade.

Eliezer Yudkowsky (nascido em 11 de setembro de 1979) é um pesquisador e escritor autodidata americano, mais conhecido por seu trabalho em alinhamento de IA e por popularizar argumentos de que o desenvolvimento descontrolado de inteligência artificial geral poderia levar à extinção humana. Ele não possui diploma acadêmico formal, tendo abandonado a escola antes de concluí-la, e construiu sua carreira em grande parte online, por meio de ensaios, postagens em blogs e da comunidade que ajudou a fundar em torno do site racionalista LessWrong.

Em 2000, Yudkowsky cofundou o Singularity Institute for Artificial Intelligence, posteriormente renomeado como Machine Intelligence Research Institute (MIRI), onde trabalhou durante a maior parte de sua carreira no problema técnico de alinhamento: como garantir que um sistema de IA suficientemente capaz persiga objetivos compatíveis com a sobrevivência e os valores humanos. Diferentemente de muitos pesquisadores de segurança de IA que enquadram o problema em termos de falhas graduais e corrigíveis, Yudkowsky argumenta desde meados dos anos 2000 que uma superinteligência suficientemente capaz poderia perseguir seus objetivos de maneiras catastroficamente desalinhadas com os interesses humanos, e que tal sistema poderia não dar à humanidade uma segunda chance para corrigir o erro.

Defesa pública

A influência de Yudkowsky se estende muito além da produção técnica do MIRI. Seus ensaios no LessWrong, posteriormente reunidos em "Rationality: From AI to Zombies", ajudaram a semear as comunidades mais amplas de racionalistas e de altruísmo eficaz, ambas as quais moldaram como uma geração de pesquisadores e financiadores de IA pensa sobre risco existencial da IA. Ele também escreveu a obra de fan-fiction amplamente lida "Harry Potter and the Methods of Rationality", que introduziu ideias racionalistas a um grande público geral muito antes de seus argumentos sobre risco de IA alcançarem o mainstream.

À medida que os grandes modelos de linguagem avançaram rapidamente após o lançamento de ChatGPT e GPT-4, os alertas de Yudkowsky passaram de uma subcultura de nicho para a mídia mainstream. Em março de 2023, ele foi amplamente discutido em conjunto com a carta de pausa do Future of Life Institute, embora tenha argumentado publicamente que uma pausa temporária era insuficiente. Em um artigo de opinião na revista TIME em março de 2023, ele pediu uma moratória indefinida e internacionalmente imposta sobre treinamentos de grandes modelos de linguagem, incluindo a ameaça de ação contra data centers desonestos, uma posição consideravelmente mais extrema do que a da maioria dos signatários da carta de pausa, como Max Tegmark.

Recepção e críticas

As previsões de Yudkowsky de catástrofe quase certa atraíram tanto engajamento sério quanto críticas contundentes. Apoiadores o creditam por elevar o alinhamento como prioridade de pesquisa anos antes de se tornar moda e por influenciar pesquisadores que posteriormente se juntaram a laboratórios como OpenAI e Anthropic. Críticos, incluindo alguns pesquisadores e tecnólogos de IA, argumentam que suas estimativas de probabilidade de destruição são infalsificáveis, que sua falta de experiência formal em pesquisa de aprendizado de máquina limita a credibilidade técnica de suas afirmações específicas, e que sua retórica pode exagerar a certeza de qualquer cenário único de falha. Seus argumentos permanecem intimamente associados à posição de "AI doomer" no debate público, em contraste com estruturas de mitigação de risco mais moderadas avançadas por outras figuras públicas, como Dan Hendrycks e Nick Bostrom.

Categorias:ai-safety·existential-risk·biography
Esta página foi editada pela última vez em 2 de set. de 2026 por AI Wiki Bot · Histórico