Ilya Sutskever é um cientista da computação amplamente reconhecido como um dos pesquisadores mais influentes da era moderna do aprendizado profundo. Como estudante de pós-graduação sob orientação de Geoffrey Hinton na Universidade de Toronto, ele co-criou o AlexNet com Alex Krizhevsky, a rede neural convolucional cuja vitória decisiva no desafio ImageNet 2012 é amplamente creditada por dar início à onda moderna de aprendizado profundo. Mais tarde, ele co-escreveu o artigo Seq2seq em 2014 com Oriol Vinyals e Quoc Le, introduzindo o framework codificador-decodificador de sequência a sequência que se tornou fundamental para a tradução automática e posteriormente influenciou o pensamento de design por trás da arquitetura transformador.
Co-fundação e liderança de pesquisa na OpenAI
Sutskever foi co-fundador da OpenAI em 2015 e atuou como seu cientista-chefe durante a maior parte da década seguinte, desempenhando um papel técnico central no desenvolvimento dos modelos GPT-2, GPT-3 e GPT-4 e na direção de pesquisa que levou ao ChatGPT. Ele foi um defensor precoce e consistente dentro da OpenAI da hipótese de escalabilidade, de que modelos e conjuntos de dados substancialmente maiores produziriam capacidades qualitativamente novas, uma aposta que moldou grande parte da estratégia de pesquisa da OpenAI durante a era GPT-3 e GPT-4.
A crise do conselho de 2023 e a saída
Sutskever foi um dos membros do conselho da OpenAI que votou em novembro de 2023 para remover o CEO Sam Altman, contribuindo para a crise do conselho da OpenAI. Mais tarde, ele declarou publicamente que se arrependia de seu papel na decisão e apoiou a reintegração de Altman. Sutskever permaneceu na OpenAI por vários meses depois, mas deixou a empresa em maio de 2024, junto com uma onda mais ampla de saídas da equipe de pesquisa focada em segurança da OpenAI, que também incluiu o colega pesquisador Jan Leike.
Safe Superintelligence Inc.
Em junho de 2024, Sutskever co-fundou a Safe Superintelligence Inc. (SSI) com Daniel Gross e Daniel Levy, estruturada em torno de uma missão única e estreitamente definida: desenvolver superinteligência com segurança, sem produtos comerciais de curto prazo e, segundo Sutskever, sem pressão para lançar algo até que a tecnologia esteja pronta. A empresa obteve uma avaliação de vários bilhões de dólares com base na reputação e no histórico de pesquisa de Sutskever, apesar da ausência de um roteiro de produto convencional, uma estrutura incomum que refletiu a confiança dos investidores em sua posição como uma das mentes técnicas mais credenciadas do campo, juntamente com o foco público contínuo no alinhamento e na segurança da IA como o desafio central do desenvolvimento avançado de IA.