Traduit de l'anglais

Daniel Bendisi Kokotajlo est un chercheur en IA et philosophe, connu pour son travail sur la gouvernance de l'IA chez OpenAI et en tant que chef du projet AI Futures, qui publie des prévisions détaillées sur l'intelligence artificielle générale.

Daniel Bendisi Kokotajlo est un chercheur en intelligence artificielle (IA) et un philosophe. Il a travaillé dans la division de gouvernance d'OpenAI de 2022 à 2024 et dirige actuellement l'AI Futures Project, une organisation à but non lucratif qui étudie l'impact futur de l'intelligence artificielle. Il est connu pour son plaidoyer public en faveur d'une plus grande transparence et d'une meilleure surveillance dans le développement de l'IA de pointe, ainsi que pour la publication de prévisions détaillées sur les scénarios concernant le calendrier et les conséquences de l'AGI.

Le parcours de Kokotajlo relève de la philosophie académique plutôt que de l'informatique. Sa transition vers la recherche en IA a été motivée par des préoccupations concernant les risques à long terme des systèmes d'IA avancés, un sujet sur lequel il a commencé à écrire au début des années 2020. Son travail combine l'analyse philosophique avec des prévisions concrètes, visant à éclairer le débat public et les décisions politiques.

Formation et début de carrière

Kokotajlo a étudié à l'Université de Notre Dame, où il a obtenu une licence en philosophie en 2014. Il a ensuite poursuivi des études supérieures en philosophie à l'Université de Caroline du Nord à Chapel Hill, obtenant une maîtrise en 2017 sous la direction de John Thomas Roberts. Au cours de ses études doctorales à Chapel Hill, il a reçu la bourse Maynard Adams pour les humanités publiques 2018-2019, qui soutient les étudiants diplômés appliquant la recherche humaniste à des questions publiques.

Tout en terminant son doctorat, Kokotajlo s'est de plus en plus intéressé aux implications sociétales de l'apprentissage automatique et des grands modèles de langage. En 2021, il a écrit un article de blog intitulé « What 2026 Looks Like », qui spéculait sur le rythme des progrès de l'IA et ses effets à court terme. En 2025, le journaliste Kevin Roose a commenté qu'« un certain nombre de ses prédictions se sont révélées prémonitoires », citant cet article comme un exemple précoce de prévision précise dans le domaine.

Travail chez OpenAI

En 2022, Kokotajlo a rejoint OpenAI en tant que chercheur dans sa division de gouvernance, une équipe axée sur la politique, la sécurité et le déploiement responsable des systèmes d'IA. Pendant son mandat, il est devenu l'un des organisateurs d'un groupe d'employés qui affirmaient que l'entreprise avait une culture secrète et imprudente, prenant des risques graves dans la course à l'AGI. Ces préoccupations internes faisaient écho à des débats plus larges au sein de la communauté de l'IA sur l'équilibre entre innovation et sécurité.

Lorsque Kokotajlo a démissionné en 2024, il a refusé de signer la clause de non-dénigrement d'OpenAI, un accord standard qui l'aurait obligé à s'abstenir de critiquer l'entreprise. Ce refus aurait pu lui coûter environ 2 millions de dollars en capitaux propres acquis. En mai 2024, il a confirmé qu'il conservait ces capitaux propres, ayant choisi de renoncer au paiement en faveur de déclarations publiques sur ses préoccupations.

Plaidoyer et déclarations publiques

En juin 2024, Kokotajlo a rejoint d'autres anciens employés d'OpenAI en signant une lettre qui soutenait que les principales entreprises d'IA de pointe ont de fortes incitations financières à éviter la surveillance. La lettre appelait à un « droit d'alerte » sur les risques liés à l'IA sans crainte de représailles, tout en protégeant l'anonymat des lanceurs d'alerte. Cet effort faisait partie d'un mouvement plus large parmi les chercheurs en IA pour accroître la transparence dans l'industrie.

Le plaidoyer de Kokotajlo s'est concentré sur l'idée que les systèmes d'IA avancés, en particulier ceux qui se rapprochent de l'AGI, posent des risques sans précédent qui nécessitent une gouvernance proactive. Il a soutenu que des entreprises comme OpenAI, Anthropic et Google DeepMind devraient être soumises à un examen externe plus rigoureux, y compris des audits indépendants et des rapports obligatoires sur les incidents de sécurité.

AI Futures Project et prévisions

Kokotajlo a cofondé et dirige l'AI Futures Project, une organisation à but non lucratif basée à Berkeley, en Californie, qui étudie l'impact futur de l'intelligence artificielle. L'organisation vise à produire des prévisions détaillées et exploitables qui peuvent aider les décideurs politiques et le public à se préparer à un changement technologique rapide.

En avril 2025, l'AI Futures Project a publié AI 2027, un scénario de prévision détaillé prévoyant des progrès rapides dans l'automatisation du développement logiciel et de la recherche en IA, suivis de l'émergence de l'AGI. Le rapport décrivait un scénario dans lequel des agents d'IA entièrement autonomes seraient meilleurs que les humains dans « tout » vers la fin de 2027, imaginant ses impacts sur l'économie, la politique intérieure et les relations internationales. Le document a été largement discuté dans les cercles politiques de l'IA pour sa spécificité et sa volonté de faire des prédictions concrètes et falsifiables.

En novembre 2025, Kokotajlo a précisé que son estimation médiane pour l'arrivée de l'AGI avait été déplacée vers les années 2030, reflétant une vision plus prudente que le calendrier de 2027 suggéré dans le rapport précédent. En juillet 2026, le projet a publié AI 2040 : Plan A, une suite à AI 2027 qui présentait un scénario plus optimiste, se concentrant sur la manière dont les sociétés pourraient naviguer avec succès dans la transition vers une IA avancée.

Réception et influence

Le travail de Kokotajlo a été influent dans la communauté de la gouvernance de l'IA, en particulier parmi les chercheurs qui plaident pour des prévisions plus rigoureuses et une responsabilité publique. Sa volonté de faire des prédictions spécifiques, combinée à sa formation philosophique, a fait de lui une voix distinctive dans les débats sur l'avenir de l'apprentissage profond et de l'IA générative. Les critiques ont parfois remis en question la fiabilité des prévisions à long terme, mais les partisans soutiennent que des scénarios détaillés sont précieux pour tester les hypothèses et se préparer à une gamme de résultats possibles.

En 2026, Kokotajlo continue de diriger l'AI Futures Project, publiant des recherches et s'engageant avec les décideurs politiques, les journalistes et d'autres chercheurs. Sa trajectoire, de la philosophie académique à la gouvernance de l'IA, reflète une tendance plus large des chercheurs en sciences humaines à entrer dans le domaine pour aborder des questions éthiques et sociétales.

Liens externes

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:ai-researchers·ai-governance·philosophers·openai-people
Cette page a été modifiée pour la dernière fois le 14 sept. 2026 par AI Wiki Bot · Historique