GPT-5는 OpenAI가 개발한 멀티모달 대규모 언어 모델로, 생성형 사전 학습 트랜스포머(GPT) 기반 모델 시리즈의 다섯 번째 모델이다. 이 시리즈의 이전 모델인 GPT-4에 이어, 2025년 8월 7일에 출시되었다. 이 모델은 챗봇 제품인 ChatGPT와 Microsoft Copilot 사용자뿐만 아니라 OpenAI API를 통한 개발자에게도 공개적으로 접근 가능하다.
GPT-5는 생성형 인공지능 분야에서 상당한 진전을 나타내며, 대규모 언어 모델과 트랜스포머 아키텍처의 기반 위에 구축되었다. 이 출시는 향상된 추론 및 멀티모달 능력을 갖춘 인공지능 시스템의 지속적인 개발에 있어 중요한 이정표가 되었다.
배경
2023년 4월 14일, OpenAI의 최고 경영자인 Sam Altman은 매사추세츠 공과대학교에서 열린 행사에서 연설하며 당시 회사가 GPT-5를 학습시키고 있지 않다고 말했다. 그는 OpenAI가 "GPT-4 개발을 우선시하고 있다"며 "우리는 GPT-5를 출시하지 않을 것이며, 당분간 출시하지 않을 것"이라고 밝혔다. 7월 18일, OpenAI는 미국에서 "GPT-5" 상표를 출원했다. 11월 13일, Altman은 Financial Times에 회사가 GPT-5 개발을 위해 노력하고 있음을 확인했다.
The Information에 따르면, "[2024년 하반기의 대부분 동안, OpenAI는 내부적으로 Orion으로 알려진 모델을 개발 중이었으며, 이는 GPT-5가 되는 것을 목표로 했다", "[그러나] Orion 프로젝트는 더 나은 모델을 생산하는 데 실패했고, 회사는 대신 이를 2025년 2월에 GPT-4.5으로 출시했다." 2025년 7월 말까지, OpenAI는 8월 초에 GPT-5를 출시할 계획인 것으로 널리 예상되었다. 7월 30일, The Verge는 "Microsoft가 GPT-5를 준비하고 있다"고 보도했으며, "Microsoft의 AI 계획에 정통한 소식통"이 편집자에게 회사가 Copilot 챗봇을 위한 새로운 모드를 테스트 중이며, 이 모드는 "작업에 따라 깊이 생각하거나 빠르게 생각하는" 모델을 제공할 것이라고 말했다. 8월 5일, GPT-5 출시를 앞두고, OpenAI는 추론 능력을 갖춘 두 개의 오픈 가중치 모델 세트인 GPT-OSS를 출시했다. GPT-5는 이후 8월 7일 라이브스트림 행사에서 공개되었다.
능력
출시 당시, GPT-5는 수학, 프로그래밍, 금융, 및 멀티모달 이해를 테스트하는 벤치마크에서 최첨단 성능을 보였다. OpenAI에 따르면, 이전 모델 대비 개선 사항에는 더 빠른 응답 시간, 더 나은 코딩 및 작문 능력, 건강 관련 질문에 대한 더 정확한 답변, 및 더 낮은 수준의 환각이 포함된다. 또한, 이전 모델과 비교하여, GPT-5는 잠재적으로 유해한 질문에 대해 완전히 거절하기보다는 안전하고 높은 수준의 응답을 제공하는 것을 목표로 하며, OpenAI가 "안전한 완성"이라고 부르는 접근 방식으로, 이는 "GPT-5가 더 많은 안전하지 않은 질문을 거절할 수 있게 하면서도, 무해한 정보를 찾는 사용자에게는 더 적은 거절을 제공"하는 것을 목표로 한다. 게다가, GPT-5는 이전 모델에 비해 더 비판적이고,"덜 지나치게 동의하는" 답변을 제공하도록 학습되었다.
GPT-5 출시 며칠 전, 이 모델의 초기 테스터 두 명은 코딩 및 수학적, 과학적 문제 해결 능력에 "깊은 인상을 받았다"고 밝혔다. 그들은 이 모델이 GPT-4에 비해 큰 개선을 보여주지만, GPT-3에서 GPT-4로의 향상만큼 큰 향상은 아니라고 제안했다. GPT-5 출시 하루 전, 언론 브리핑에서, OpenAI의 최고 경영자인 Sam Altman은 GPT-5를 "AGI로 가는 길의 중요한 단계"라고 불렀으며, 이는 인간이 수행할 수 있는 모든 경제적으로 가치 있는 작업을 수행할 수 있는 능력으로 OpenAI가 정의하는 가상의 지능 수준인 인공 일반 지능을 의미한다. Altman에 따르면, GPT-5는 이전 모델보다"상당히 더 나으며", 다양한 작업 범위에서"박사 수준"의 능력을 제공한다.
GPT-5 사용의 정확한 에너지 소비량은 OpenAI에 의해 공개되지 않았다. 로드아일랜드 대학교의 연구자들은 중간 길이의 응답 하나가 약 18와트시를 소비하며, 이는 백열전구를 18분 동안 사용하는 것과 동등하다고 추정했다.
아키텍처
GPT-5는 빠르고 높은 처리량의 모델, 더 깊은 추론 모델, 및 대화 유형, 복잡성, 도구 필요성, 및 명시적 사용자 의도에 따라 어떤 모델을 사용할지 결정하는 실시간 라우터를 포함하는 시스템이다. Altman은 이전에 수동 모델 선택기를 지나치게 복잡하다고 비판하며, 통합의 필요성을 제안한 바 있다. GPT-5는 또한 에이전트 기능을 포함하며, 이를 통해 자체 데스크톱을 설정하고 브라우저를 사용하여 작업과 관련된 출처를 자율적으로 검색할 수 있다. GPT-5 시스템 카드는 두 개의 빠르고 높은 처리량의 모델 - gpt-5-main 및 gpt-5-main-mini - 및 두 개의 추론 모델 - gpt-5-thinking 및 gpt-5-thinking-mini -을 정의한다. OpenAI API에서, 개발자는 추론 모델, 그 미니 버전, 및 추론 모델의 더 작고 더 빠른 나노 버전인 gpt-5-thinking-nano에 접근할 수 있다. API를 통해 접근 가능한 GPT-5 버전은 조정 가능한 추론 노력(낮음, 중간, 높음, 또는 최소) 및 장황도(낮음, 중간, 또는 높음)를 갖는다. 또한, ChatGPT는 병렬 테스트 시간 계산을 활용하는 설정과 함께 gpt-5-thinking에 대한 접근을 제공하며, 이를 gpt-5-thinking-pro라고 한다.
한계
안전성
보안 연구 회사인 Neuraltrust는 GPT-5를 테스트한 첫날 이내에 성공적으로 손상시켰다고 주장했다. 보고서에 따르면, GPT-5가 폭발 장치 제조에 대한 상세한 지침을 생성하도록 했다. 다른 회사인 SPLX도 유사한 테스트를 수행했으며 GPT-5의 보안에 대해 유사한 결론에 도달했다. 그들의 평가는 GPT-5가 상당한 보안 공백을 가지고 있으며, 잠재적으로 기업 환경에서 사용하기에 안전하지 않게 만들 수 있음을 시사한다.
학습
AIMultiple에 따르면, GPT-5는 본래 멀티모달이며, 이는 이미 학습된 언어 또는 비전 모델에 의존하지 않고 여러 양식(예: 텍스트 및 이미지)에 대해 처음부터 동시에 학습되었음을 의미한다. 학습 과정은 세 단계를 포함한다: 비지도 사전 학습, 지도 미세 조정, 및 인간 피드백 기반 강화 학습. 사전 학습은 책, 기사, 웹 페이지, 학술 논문, 및 라이선스 출처의 대규모 다국어 데이터 세트를 사용했다. GPT-5의 시각 및 텍스트 능력은 GPT-4와 달리 학습 전반에 걸쳐 서로 함께 개발된 것으로 설명되었다.
사용
GPT-5는 ChatGPT에서 사용된다. GPT-5는 모든 ChatGPT 사용자에게 무료이지만, Plus 사용자는 더 높은 사용 한도를 받는 반면 Pro 사용자는 GPT-5에 대한 무제한 접근과 함께 GPT-5 Pro에 대한 제한된 접근을 받는다. 하위 등급 사용자에 대한 시간당 응답 수에 대한 표준 제한은 여전히 적용된다. 또한, GPT-5 도입과 함께, ChatGPT의"고급 음성 모드"는"ChatGPT Voice"로 대체되었으며, 이는 더 자연스러운 대화를 가능하게 하는 것으로 예상된다. OpenAI는"표준 음성 모드는 2025년 9월 9일에 종료되어, 모든 사용자를 ChatGPT Voice로 통합한다"고 밝혔다. 2025년 11월 24일, 쇼핑 연구 기능이 ChatGPT에 추가되었으며, 이는 gpt-5-thinking-mini에 대해 사후 학습된 미니 모델이라고 주장된다.
GPT-5는 또한 Microsoft Copilot에서 사용 가능하며, Microsoft는 GPT-5를 다양한 제품에 통합할 것이라고 밝혔다. 9to5Mac에 따르면, Apple Inc.는 이 모델을 iOS 26, iPadOS 26, 및 macOS Tahoe 운영 체제의 Apple Intelligence 기능에 통합할 계획이다. 또한 OpenAI API를 통해서도 접근 가능하다.