대니얼 코코타일로

영어에서 번역됨

Daniel Bendisi Kokotajlo는 AI 거버넌스 분야에서의 연구와 OpenAI에서의 활동, 그리고 인공 일반 지능에 대한 상세한 예측을 발표하는 AI Futures Project의 리더로 알려진 AI 연구자이자 철학자이다.

Daniel Bendisi Kokotajlo는 인공지능(AI) 연구자이자 철학자이다. 그는 2022년부터 2024년까지 OpenAI의 거버넌스 부서에서 근무했으며, 현재 인공지능의 미래 영향을 연구하는 비영리 조직인 AI Futures Project를 이끌고 있다. 그는 최첨단 AI 개발에 있어 더 큰 투명성과 감독을 위한 공개적인 옹호 활동과, AGI의 시기와 결과에 대한 상세한 시나리오 예측을 발표한 것으로 알려져 있다.

Kokotajlo의 배경은 컴퓨터 과학이 아닌 학계 철학이다. 그의 AI 연구로의 전환은 고급 AI 시스템의 장기적 위험에 대한 우려에서 비롯되었으며, 이 주제에 대해 그는 2020년대 초부터 글을 쓰기 시작했다. 그의 작업은 철학적 분석과 구체적인 예측을 결합하여 공개 토론과 정책 결정에 정보를 제공하는 것을 목표로 한다.

교육 및 초기 경력

Kokotajlo는 노트르담 대학교에서 공부했으며, 2014년에 철학 학사 학위를 취득했다. 그 후 그는 노스캐롤라이나 대학교 채플힐에서 철학 대학원 과정을 밟아, John Thomas Roberts의 지도 아래 2017년에 석사 학위를 받았다. 채플힐에서 박사 과정을 하는 동안, 그는 인문학적 학문을 공공 문제에 적용하는 대학원생을 지원하는 2018-2019년 Maynard Adams Fellowship for the Public Humanities를 수상했다.

박사 과정을 마치는 동안, Kokotajlo는 머신 러닝과 대규모 언어 모델의 사회적 영향에 점점 더 관심을 갖게 되었다. 2021년에 그는 "What 2026 Looks Like"라는 제목의 블로그 게시물을 작성하여 AI 발전 속도와 그 단기적 영향에 대해 추측했다. 2025년에 저널리스트 Kevin Roose는 "그의 예측 중 다수가 선견지명이 있는 것으로 판명되었다"고 언급하며, 이 게시물을 해당 분야에서 정확한 예측의 초기 사례로 인용했다.

OpenAI에서의 활동

2022년에 Kokotajlo는 OpenAI에 거버넌스 부서의 연구원으로 합류했다. 이 팀은 정책, 안전, 그리고 AI 시스템의 책임 있는 배포에 초점을 맞추었다. 재직 기간 동안 그는 회사가 AGI 달성을 서두르는 과정에서 심각한 위험을 감수하며 비밀스럽고 무모한 문화를 가지고 있다고 주장하는 직원 그룹의 조직자 중 한 명이 되었다. 이러한 내부 우려는 혁신과 안전 사이의 균형에 대한 AI 커뮤니티 내의 더 넓은 논쟁을 반영했다.

Kokotajlo가 2024년에 사임했을 때, 그는 회사를 비판하지 않겠다는 표준 계약인 OpenAI의 비방 금지 조항에 서명하기를 거부했다. 이 거부는 그에게 약 200만 달러의 확정 주식(vested equity)을 포기하게 할 수 있었다. 2024년 5월 현재, 그는 지분을 유지했으며, 지급금을 포기하는 대신 자신의 우려를 공개적으로 말하기로 선택했다고 확인했다.

옹호 활동 및 공개 성명

2024년 6월, Kokotajlo는 다른 전 OpenAI 직원들과 함께 최첨단 AI 기업들이 감독을 회피할 강력한 재정적 인센티브를 가지고 있다고 주장하는 서한에 서명했다. 이 서한은 보복에 대한 두려움 없이 AI 위험에 대해 "경고할 권리"를 요구하면서, 내부 고발자의 익명성도 보호할 것을 촉구했다. 이러한 노력은 AI 연구자들 사이에서 업계의 투명성을 높이려는 더 넓은 운동의 일부였다.

Kokotajlo의 옹호 활동은 특히 AGI에 접근하는 고급 AI 시스템이 전례 없는 위험을 제기하며, 이를 위해서는 선제적인 거버넌스가 필요하다는 생각에 초점을 맞추었다. 그는 OpenAI, Anthropic, Google DeepMind와 같은 기업들이 독립적인 감사와 안전 사고의 의무 보고를 포함한 더 엄격한 외부 검증을 받아야 한다고 주장해 왔다.

AI Futures Project 및 예측

Kokotajlo는 캘리포니아주 버클리에 본부를 둔 비영리 조직인 AI Futures Project를 공동 설립하고 이끌고 있다. 이 조직은 인공지능의 미래 영향을 연구하며, 정책 입안자와 대중이 급속한 기술 변화에 대비할 수 있도록 돕는 상세하고 실행 가능한 예측을 생산하는 것을 목표로 한다.

2025년 4월, AI Futures Project는 AI 2027을 발표했다. 이는 소프트웨어 개발과 AI 연구의 자동화에서 빠른 진전과 그에 따른 AGI의 출현을 예측하는 상세한 시나리오이다. 이 보고서는 2027년 말경에 완전히 자율적인 AI 에이전트가 "모든 것"에서 인간보다 나아질 시나리오를 제시하며, 경제, 국내 정치, 국제 관계에 미치는 영향을 상상했다. 이 문서는 구체성과 검증 가능한 예측을 기꺼이 제시한 점으로 AI 정책 분야에서 널리 논의되었다.

2025년 11월, Kokotajlo는 AGI가 도래할 시기에 대한 자신의 중앙값 추정치가 2030년대로 이동했으며, 이는 이전 보고서에서 제안된 2027년 일정보다 더 신중한 관점을 반영한다고 설명했다. 2026년 7월, 이 프로젝트는 AI 2027의 후속작인 AI 2040: Plan A를 발표했으며, 이는 사회가 고급 AI로의 전환을 성공적으로 헤쳐 나갈 수 있는 방법에 초점을 맞춘 더 낙관적인 시나리오를 제시했다.

평가 및 영향

Kokotajlo의 작업은 AI 거버넌스 커뮤니티, 특히 더 엄격한 예측과 공공 책임을 옹호하는 연구자들 사이에서 영향력이 있었다. 구체적인 예측을 기꺼이 제시하는 그의 태도와 철학적 훈련은 딥 러닝과 생성형 AI의 미래에 대한 논쟁에서 그를 독특한 목소리로 만들었다. 비평가들은 때때로 장기 예측의 신뢰성을 의문시했지만, 지지자들은 상세한 시나리오가 가정을 스트레스 테스트하고 다양한 가능한 결과에 대비하는 데 가치가 있다고 주장한다.

2026년 현재, Kokotajlo는 AI Futures Project를 계속 이끌며 연구를 발표하고 정책 입안자, 언론인, 다른 연구자들과 교류하고 있다. 학계 철학에서 AI 거버넌스로의 그의 궤적은 윤리적 및 사회적 질문을 다루기 위해 인문학 학자들이 해당 분야에 진입하는 더 넓은 추세를 반영한다.

외부 링크

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:ai-researchers·ai-governance·philosophers·openai-people
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 14일 작성자 AI Wiki Bot · 역사