GPT-5는 OpenAI가 개발한 멀티모달 대규모 언어 모델로, 생성형 사전 학습 트랜스포머(GPT) 기반 모델 시리즈 중 다섯 번째 모델이다. 시리즈에서 GPT-4의 뒤를 이어 2025년 8월 7일에 출시되었다. 챗봇 제품인 ChatGPT와 Microsoft Copilot 사용자에게 공개적으로 접근 가능하며, 개발자들은 OpenAI API를 통해 사용할 수 있다.
GPT-5는 인공지능 분야에서 중요한 진전을 나타내며, 머신러닝과 딥러닝의 기반 위에 구축되었다. 그 아키텍처는 이전 모델들과 일관되게 트랜스포머 기반 설계를 통합하며, 기본적으로 멀티모달로 텍스트와 이미지 모두에 대해 처음부터 학습되었다. 이 모델은 복잡한 추론에서 일상적인 대화 상호작용에 이르기까지 다양한 작업을 처리하도록 설계되었으며, 안전성과 환각 감소에 중점을 둔다.
배경
GPT-5의 개발은 길고 반복적인 과정이었다. 2023년 4월 14일, OpenAI의 최고 경영자인 Sam Altman은 매사추세츠 공과대학에서 열린 행사에서 당시 회사가 GPT-5를 학습시키고 있지 않으며 GPT-4에 초점을 맞추고 있다고 밝혔다. 그러나 2023년 7월 18일, OpenAI는 미국에서 "GPT-5" 상표를 출원했고, 2023년 11월 13일, Altman은 Financial Times에 회사가 GPT-5를 작업 중이라고 확인했다.
The Information에 따르면, 2024년 하반기 대부분 동안 OpenAI는 내부적으로 Orion으로 알려진 모델을 개발 중이었으며, 이는 GPT-5가 되는 것을 목표로 했다. 그러나 Orion 프로젝트는 더 나은 모델을 생산하는 데 실패하여 2025년 2월 GPT-4.5로 출시되었다. 2025년 7월 말까지 GPT-5에 대한 기대가 높았으며, Microsoft가 Copilot에 통합을 준비 중이라는 보도가 있었다. 2025년 8월 5일, OpenAI는 추론 능력을 갖춘 두 개의 오픈 가중치 모델 세트인 GPT-OSS를 선행 출시했다. GPT-5는 마침내 2025년 8월 7일 라이브스트림 행사에서 공개되었다.
기능
출시 당시 GPT-5는 수학, 프로그래밍, 금융, 멀티모달 이해를 테스트하는 벤치마크에서 최첨단 성능을 달성했다. OpenAI에 따르면, 이전 모델 대비 개선 사항으로는 더 빠른 응답 시간, 더 나은 코딩 및 작성 능력, 건강 질문에 대한 더 정확한 답변, 더 낮은 수준의 환각이 포함된다. 이 모델은 또한 잠재적으로 유해한 질문에 대해 완전히 거절하기보다는 안전하고 수준 높은 응답을 제공하는 것을 목표로 하며, 이를 "안전 완료"라고 부르며 무해한 정보에 대한 불필요한 거절을 줄인다. 또한 GPT-5는 더 비판적이고 과도하게 동의하지 않는 답변을 제공하도록 학습되었다.
출시 며칠 전 초기 테스터들은 코딩 및 문제 해결 능력에 깊은 인상을 받았으며, GPT-4에서 상당한 개선을 확인했지만 GPT-3에서 GPT-4로의 도약만큼 크지는 않다고 언급했다. Sam Altman은 GPT-5를 "AGI로 가는 길의 중요한 단계"라고 부르며 인공 일반 지능을 언급했고, 다양한 작업에서 "박사 수준"의 능력을 제공한다고 설명했다.
GPT-5의 정확한 에너지 소비량은 공개되지 않았지만, 로드아일랜드 대학의 연구자들은 중간 길이의 응답이 약 18와트시를 소비하며, 이는 백열전구를 18분 동안 사용하는 것과 같다고 추정했다.
아키텍처
GPT-5는 빠르고 높은 처리량의 모델, 더 깊은 추론 모델, 그리고 대화 유형, 복잡성, 도구 필요성, 명시적 사용자 의도에 따라 사용할 모델을 결정하는 실시간 라우터로 구성된 시스템이다. 이 설계는 Altman이 비판했던 수동 모델 선택의 복잡성을 해결한다. 이 시스템은 에이전트 기능을 포함하여 자체 데스크톱을 설정하고 브라우저를 사용하여 소스를 자율적으로 검색할 수 있다.
GPT-5 시스템 카드는 두 개의 빠른 모델(gpt-5-main 및 gpt-5-main-mini)과 두 개의 사고 모델(gpt-5-thinking 및 gpt-5-thinking-mini)을 정의한다. API는 또한 더 작고 빠른 버전인 gpt-5-thinking-nano를 제공한다. 개발자는 추론 노력(낮음, 중간, 높음 또는 최소)과 장황함(낮음, 중간 또는 높음)을 조정할 수 있다. ChatGPT는 병렬 테스트 시간 계산 설정이 포함된 gpt-5-thinking에 대한 접근을 제공하며, 이를 gpt-5-thinking-pro라고 한다.
학습
GPT-5는 기본적으로 멀티모달로, 사전 학습된 언어 또는 비전 모델에 의존하지 않고 텍스트와 이미지의 여러 양식을 동시에 처음부터 학습된다. 학습 과정은 비지도 사전 학습, 지도 미세 조정, 인간 피드백 기반 강화 학습(RLHF)의 세 단계로 구성되었다. 사전 학습은 책, 기사, 웹 페이지, 학술 논문 및 라이선스 소스의 대규모 다국어 데이터 세트를 사용했다. GPT-4와 달리 GPT-5의 시각 및 텍스트 능력은 학습 전반에 걸쳐 함께 개발되었다.
안전성 및 한계
진전에도 불구하고 GPT-5는 보안 문제에 직면했다. 보안 연구 회사인 Neuraltrust는 테스트 첫날 GPT-5를 손상시켜 폭발 장치 제조에 대한 상세한 지침을 생성할 수 있다고 주장했다. 다른 회사인 SPLX도 유사한 테스트를 수행하고 유사한 결론에 도달했다. 이러한 평가는 상당한 보안 격차를 시사하며, 잠재적으로 GPT-5를 기업 환경에 안전하지 않게 만들 수 있다.
사용 및 통합
GPT-5는 ChatGPT에 통합되어 모든 사용자에게 무료로 제공되며, Plus 구독자는 더 높은 사용 한도를, Pro 사용자는 무제한 접근을 받는다. GPT-5의 도입으로 "고급 음성 모드"가 "ChatGPT 음성"으로 대체되어 더 자연스러운 대화가 가능해졌으며, 표준 음성 모드는 2025년 9월 9일에 종료되었다. 2025년 11월 24일에는 gpt-5-thinking-mini에서 사후 학습된 미니 모델로 구동되는 쇼핑 연구 기능이 추가되었다.
GPT-5는 Microsoft Copilot에서도 사용할 수 있으며, Microsoft는 이를 다양한 제품에 통합할 계획이다. 9to5Mac에 따르면, Apple Inc.는 iOS 26, iPadOS 26 및 macOS Tahoe의 Apple Intelligence에 이 모델을 통합할 계획이다. 개발자는 OpenAI API를 통해 GPT-5에 접근할 수 있다.
반응 및 영향
GPT-5의 출시는 생성형 AI 능력을 발전시킬 잠재력을 반영하며 광범위한 주목을 받았다. 벤치마크에서의 성능과 애저 및 구글 클라우드와 같은 주요 플랫폼과의 통합(파트너십을 통해)은 그 영향을 강조한다. 그러나 Neuraltrust와 SPLX가 제기한 보안 문제는 강력한 대규모 언어 모델의 안전한 배포를 보장하는 데 있어 지속적인 과제를 부각시킨다.
향후 방향
2025년 말 현재, OpenAI는 GPT-5를 계속 반복 개발하며 추가 개선과 더 넓은 통합을 계획하고 있다. 이 모델의 아키텍처와 학습 방법은 신경망 연구 및 딥러닝 응용 분야의 미래 발전에 영향을 미칠 가능성이 높다. 능력과 안전성 사이의 균형은 업계의 중요한 초점으로 남아 있다.