알파고와 이세돌의 대국은 2016년 3월 9일부터 3월 15일까지 대한민국 서울에서 열린 오목 다섯 판 대국이었다. 이 대국은 딥마인드의 알파고 프로그램과 18회 세계 챔피언이자 당대 최고의 바둑 기사 중 한 명인 이세돌을 맞붙게 했다. 알파고는 4승 1패로 승리했으며, 이 결과는 바둑계의 많은 이들이 인간 선수가 앞으로 몇 년 더 우위를 유지할 것으로 예상했던 바와 달라 큰 충격을 주었다.
배경
바둑은 체스보다 컴퓨터에게 더 어려운 문제로 오랫동안 여겨져 왔다. 체스는 딥 블루가 1997년에 이미 정복했지만, 바둑은 엄청난 분기 계수와 패턴 인식 및 직관에 의존하여 무차별 탐색을 저항했기 때문이다. 알파고는 대규모 인간 기보에 대한 지도 학습으로 훈련된 심층 신경망과, 자기 대국을 통한 강화 학습으로 정교화된 정책 및 가치 네트워크를 결합했으며, 몬테카를로 트리 탐색을 통해 수를 선택했다. 이 프로젝트는 딥마인드의 데이비드 실버가 주도했으며, 창립자인 데미스 허사비스는 일반 지능의 시험장으로서 게임에 오랜 관심을 가져왔다.
대국 내용
알파고는 처음 세 판을 승리하여 마지막 두 판 이전에 대국 승리를 확정지었다. 2국에서는 널리 논의된 순간인 37수에서 발생했는데, 이는 비전통적인 어깨 짚기 수로 해설자들은 처음에 실수라고 생각했지만 이후 분석에서는 매우 창의적인 수로 평가되었으며 인간 프로 기사가 두기 어려운 수였다. 이세돌은 4국에서 78수부터 시작하는 수순으로 승리했으며, 이는 때때로 "신의 한 수"라고 불리며 알파고의 드문 포지션 평가 약점을 일시적으로利用了했다. 알파고는 5국을 승리하여 대국을 4-1로 마무리했다.
여파와 의의
이 결과는 바둑과 AI 전문계를 넘어 널리 보도되었으며, 딥러닝 연구의 이정표로 자주 인용된다. 이는 문화적 무게에서 체스의 딥 블루의 1997년 가리 카스파로프 승리에 비견된다. 이세돌은 패배를 개인적으로 힘들었다고 묘사했으며, 나중에 최고의 인간 기사가 되어도 더 이상 무적이 아니라는 의미가 되었다고 말했다. 그는 2019년 프로 생활에서 은퇴하면서 AI의 부상을 요인으로 꼽았고, 이제 "패배시킬 수 없는 존재"가 있다고 언급했다.
딥마인드는 이 대국 이후 접근 방식을 일반화한 후속 버전을 선보였다. 인간 기보 데이터 없이 순수 자기 대국으로만 훈련된 버전과, 체스와 쇼기까지 처음부터 방법을 확장한 알파제로가 그것이다. 이 대국은 인공 일반 지능과, 올바른 조합의 아키텍처, 연산, 훈련 방법이 발견되면 좁은 초인적 성능이 얼마나 빨리 도래할 수 있는지에 대한 논의에서 자주 언급된다. 이러한 주제는 나중에 대규모 모델에서의 스케일링 법칙과 창발적 능력에 대한 논쟁에서 다시 나타났다.