GPT-5와 GPT-6 Astra는 OpenAI의 연속적인 릴리스로, 대규모 언어 모델 기술과 멀티모달 상호작용에서 중요한 진전을 나타낸다. 2025년 8월 7일에 출시된 GPT-5는 생성형 사전 훈련 트랜스포머 시리즈의 5세대 모델로, GPT-4의 뒤를 잇는다. 이후 출시된 GPT-6 Astra는 실시간, 에이전트형, 멀티모달 경험에 초점을 맞춰 이 기반을 구축하며, 일상적인 워크플로와 기기에 더 깊이 통합되는 것을 목표로 한다.
이러한 출시는 CEO 샘 알트만이 GPT-5 공개 중에 설명한 바와 같이, OpenAI의 인공 일반 지능을 향한 더 넓은 궤적의 일부이다. 이 모델들은 ChatGPT와 Microsoft Copilot을 통해 공개적으로 접근할 수 있으며, 개발자를 위한 OpenAI API를 통해서도 사용할 수 있다. 이 문서는 이 시스템들의 배경, 기능, 아키텍처, 훈련, 사용 및 한계를 상세히 다루며, 출시일 기준으로 공개된 보고와 기술 문서를 참조한다.
배경
2023년 4월 14일, 샘 알트만은 매사추세츠 공과대학에서 연설하며 OpenAI가 당시 GPT-5를 훈련하지 않고 있다고 밝히고, GPT-4 개발에 집중하고 있음을 강조했다. 그러나 같은 해 7월 18일, OpenAI는 미국에서 "GPT-5" 상표를 출원했고, 11월 13일에는 알트만이 파이낸셜 타임스에 GPT-5 작업이 진행 중임을 확인했다.
The Information에 따르면, 2024년 하반기의 상당 부분은 GPT-5가 되기 위한 내부 모델인 Orion에 관한 것이었다. 이 노력은 더 나은 모델을 생산하는 데 실패한 것으로 알려졌으며, 결국 2025년 2월 GPT-4.5로 출시되었다. 2025년 7월 말에는 8월 초 GPT-5 출시에 대한 기대가 커졌고, The Verge는 7월 30일 Microsoft가 새 모델을 위해 Copilot 챗봇을 준비 중이라고 보도했다.
2025년 8월 5일, OpenAI는 전조로서 추론 기능을 갖춘 두 개의 오픈 가중치 모델 세트인 GPT-OSS를 출시했다. GPT-5는 8월 7일 라이브스트림 이벤트에서 공개되었다. 이후 GPT-6 Astra는 2025년 후반에 소개되었으며, 공개적인 사전 준비는 적었지만 초기 배포에서 얻은 교훈을 바탕으로 멀티모달 및 에이전트형 상호작용에 더 강한 초점을 두었다.
기능
출시 당시 GPT-5는 수학, 프로그래밍, 금융 및 멀티모달 이해를 테스트하는 벤치마크에서 최첨단 성능을 달성했다. OpenAI는 이전 모델 대비 개선된 점으로 더 빠른 응답 시간, 더 나은 코딩 및 작문 능력, 더 정확한 건강 관련 답변, 그리고 감소된 환각 비율을 보고했다. 이 모델은 또한 "안전한 완성" 접근 방식을 도입하여, 잠재적으로 유해한 질문에 대해 완전히 거부하는 대신 안전하고 높은 수준의 응답을 제공함으로써 무해한 정보에 대한 거부를 줄였다.
GPT-5는 이전 모델보다 더 비판적이고 과도하게 동의하지 않도록 훈련되었다. 출시 며칠 전 초기 테스터들은 GPT-4 대비 눈에 띄는 개선을 보였지만 GPT-3에서 GPT-4로의 도약만큼 크지는 않다고 언급하며, 코딩 및 수학 문제 해결 능력에 깊은 인상을 받았다. 알트만은 GPT-5를 "AGI로 가는 길의 중요한 단계"라고 부르며, 광범위한 작업에서 "박사 수준"의 능력을 제공한다고 말했다.
GPT-6 Astra는 향상된 실시간 멀티모달 처리를 통해 이러한 기능을 확장하여 더 자연스러운 음성, 시각 및 텍스트 통합을 가능하게 한다. 이는 GPT-5에서 도입된 아키텍처를 기반으로 자율적인 웹 브라우징 및 데스크톱 관리와 같은 에이전트 기능을 지원한다. GPT-5의 에너지 소비는 공개되지 않았지만, 로드아일랜드 대학의 연구자들은 중간 길이 응답이 약 18와트시를 소비하며, 이는 백열전구가 18분 동안 켜진 것과 유사하다고 추정했다.
아키텍처
GPT-5는 빠르고 높은 처리량의 모델, 더 깊은 추론 모델, 그리고 대화 유형, 복잡성, 도구 필요성 및 명시적 사용자 의도에 따라 적절한 모델을 선택하는 실시간 라우터로 구성된 시스템이다. 이 통합 설계는 수동 모델 선택기에 대한 알트만의 이전 비판을 해결한다. 시스템 카드는 두 개의 빠른 모델(gpt-5-main 및 gpt-5-main-mini)과 두 개의 추론 모델(gpt-5-thinking 및 gpt-5-thinking-mini)을 정의한다.
OpenAI API에 접근하는 개발자는 추론 모델, 미니 버전 및 더 작고 빠른 변형인 gpt-5-thinking-nano를 사용할 수 있다. 조정 가능한 추론 노력(낮음, 중간, 높음 또는 최소) 및 응답 길이 설정(낮음, 중간 또는 높음)이 제공된다. ChatGPT 사용자는 병렬 테스트 시간 계산을 갖춘 gpt-5-thinking에 접근할 수 있으며, 이를 gpt-5-thinking-pro라고 한다.
GPT-6 Astra는 유사한 라우팅 아키텍처를 채택하지만, 교차 주의 메커니즘을 사용하여 오디오, 시각 및 텍스트 입력을 실시간으로 융합함으로써 지각과 추론 사이의 더 긴밀한 결합을 강조한다. 이 설계는 사용자 상호작용으로부터의 지속적인 학습을 지원하지만, 내부 모델 변형에 대한 세부 사항은 이 글을 쓰는 시점에서 여전히 부족하다.
훈련
GPT-5는 GPT-4가 별도로 훈련된 구성 요소에 의존했던 것과 달리, 텍스트와 이미지를 동시에 처음부터 훈련한 본질적으로 멀티모달 모델이다. 훈련은 비지도 사전 훈련, 지도 미세 조정, 인간 피드백 기반 강화 학습의 세 단계로 진행되었으며, 책, 기사, 웹 페이지, 학술 논문 및 라이선스 소스를 포함한 대규모 다국어 데이터 세트를 사용했다.
GPT-6 Astra는 유사한 3단계 과정을 따랐지만, 사전 훈련 말뭉치를 더 다양한 오디오 및 비디오 데이터로 확장했다. OpenAI는 인간 피드백 기반 강화 학습을 사용하여 응답을 사용자 의도에 맞추었으며, 안전성 및 환각 감소를 위한 추가 미세 조정을 수행했다. 회사는 또한 커리큘럼 학습을 사용하여 훈련 중 작업 복잡성을 점진적으로 증가시켜 모달리티 간 일반화를 개선했다.
2025년 후반 현재, OpenAI는 훈련에 사용된 정확한 계산 자원을 공개하지 않았지만, 업계 추정치는 AMD 또는 nvidia? 공급업체와의 협력을 포함할 수 있는 대규모 특수 하드웨어 클러스터를 시사하지만, 공식 확인은 없다.
사용
GPT-5는 모든 ChatGPT 사용자에게 무료로 제공되며, Plus 구독자는 더 높은 사용 한도를 받고 Pro 사용자는 무제한 접근 권한을 얻으며, 제한된 GPT-5 Pro 접근도 포함된다. GPT-5와 함께 ChatGPT의 "고급 음성 모드"는 "ChatGPT 음성"으로 대체되어 더 자연스러운 대화를 가능하게 한다. 표준 음성 모드는 2025년 9월 9일에 종료되었다. 2025년 11월 24일, 쇼핑 검색이 ChatGPT에 추가되었으며, 이는 gpt-5-thinking-mini에서 사후 훈련된 미니 모델이라고 주장된다.
GPT-5는 또한 Microsoft Copilot에 통합되어 있으며, Microsoft는 더 넓은 제품 통합을 계획하고 있다. Apple Inc.는 iOS 26, iPadOS 26 및 macOS Tahoe용 Apple Intelligence에 GPT-5를 통합하기 위해 작업 중인 것으로 알려졌다. GPT-6 Astra는 ChatGPT 및 API에서 사용할 수 있으며, 모바일 및 임베디드 애플리케이션에 초점을 맞추고 있으며, 삼성 및 기타 파트너의 기기에서 기능을 지원할 것으로 예상된다.
안전성 및 한계
Neuraltrust 및 SPLX를 포함한 보안 연구 회사들은 테스트 첫날 내에 GPT-5를 손상시켜 폭발물 제조에 대한 상세한 지침을 생성할 수 있게 했다고 주장했다. 이러한 평가는 상당한 보안 격차를 시사하며, 추가 보호 장치 없이는 기업 환경에서 GPT-5가 안전하지 않을 수 있음을 나타낸다. OpenAI는 한계를 인정하고 안전 조치를 계속 개선하고 있다.
GPT-6 Astra는 유사한 문제에 직면하며, 초기 테스트는 유해한 질문에 대한 거부율이 개선되었지만 가장자리 사례에서 가끔 실패가 발생함을 보여준다. 모델은 또한 훈련 데이터에서 물려받은 편향을 나타내며, OpenAI는 지속적인 외부 감사 및 레드 팀링을 권장한다.
수용 및 영향
이러한 출시는 AI 개발 속도에 대한 논쟁을 촉발했으며, 일부 전문가들은 더 강력한 규제를 요구하고 있다. 스탠포드 AI 연구소 및 버클리 AI 연구와 같은 학술 그룹은 모델의 추론 능력을 연구하고 있으며, 초기 결과는 진전을 보여주지만 아직 인간과 같은 이해에는 미치지 못한다. 이 출시는 또한 유사한 시스템을 개발 중인 Anthropic 및 Google DeepMind와의 경쟁을 강화했다.
산업 파트너십은 확장되고 있으며, 오라클 클라우드 및 Microsoft Azure는 배포를 위한 클라우드 인프라를 제공하고, ARM 및 Qualcomm은 온디바이스 추론을 위한 잠재적 파트너로 간주된다. 2025년 후반 현재, GPT-5와 GPT-6 Astra는 OpenAI의 전략의 중심에 있으며, 지속적인 업데이트가 예상된다.