OpenAI o3 출시

영어에서 번역됨

OpenAI o3는 2024년 12월 20일에 발표된 생성형 사전 학습 트랜스포머(GPT) 추론 모델로, OpenAI o1의 후속 모델이다. 단계별 논리적 추론에 추가적인 숙고 시간을 할애하도록 설계되었으며, 릴리스로는 o3-mini, o3, o4-mini, o3-pro가 포함된다.

OpenAI o3은 OpenAI가 ChatGPT용 OpenAI o1의 후속 모델로 개발한 생성형 사전 학습 트랜스포머(GPT) 모델이다. 단계별 논리적 추론이 필요한 질문에 답할 때 추가적인 숙고 시간을 할애하도록 설계되었다. 이 모델은 2024년 12월 20일에 발표되었으며, 이후 o3-mini, o3, o4-mini, o3-pro를 포함한 여러 변형으로 출시되어 코딩, 수학, 과학 분야에서의 역량을 갖추었다.

"o3"이라는 이름은 이동통신사 브랜드 O2와의 상표권 충돌을 피하기 위해 "o2" 대신 선택되었다. OpenAI는 안전 및 보안 연구자들을 초청하여 2025년 1월 10일까지 모델의 조기 접근을 신청하도록 했다. 전작 o1과 유사하게, 초기 발표에는 o3와 o3-mini 두 가지 모델이 포함되었다.

역사

OpenAI o3 모델은 2024년 12월 20일에 발표되었다. 2025년 1월 31일, OpenAI는 o3-mini를 무료 사용자를 포함한 모든 ChatGPT 사용자와 일부 API 사용자에게 출시했다. OpenAI는 o3-mini를 "정밀성과 속도를 요구하는 기술 분야"를 위한 o1의 "전문 대안"으로 설명했다. o3-mini는 낮음, 중간, 높음의 세 가지 추론 노력 수준을 제공한다. 무료 버전은 중간 수준을 사용하며, 더 많은 컴퓨팅을 사용하는 변형인 o3-mini-high는 유료 구독자에게 제공된다. ChatGPT Pro 등급 구독자는 o3-mini와 o3-mini-high 모두에 무제한으로 접근할 수 있다.

2025년 2월 2일, OpenAI는 웹 검색을 기반으로 5분에서 30분 내에 포괄적인 보고서를 작성하는 o3 버전을 사용하는 ChatGPT 서비스인 OpenAI Deep Research를 출시했다. 2월 6일, DeepSeek R1과 같은 경쟁사의 압력에 대응하여 OpenAI는 o3-mini 모델의 사고 과정 투명성을 강화하는 업데이트를 발표했다. 2월 12일, OpenAI는 ChatGPT Plus 구독자를 위한 o3-mini-high의 요청 한도를 하루 50회(주당 50회에서 증가)로 추가 확대하고 파일 및 이미지 업로드 지원을 구현했다.

2025년 4월 16일, OpenAI는 o3-mini의 후속 모델인 o3와 o4-mini를 출시했다. 2025년 6월 10일, OpenAI는 회사가 현재까지 가장 강력한 모델이라고 주장하는 o3-pro를 출시했다. OpenAI는 "속도보다 신뢰성이 중요하고 몇 분을 기다리는 것이 그만한 가치가 있는 까다로운 질문에 사용할 것을 권장합니다"라고 밝혔다. 2026년 5월 28일, OpenAI는 90일간의 종료 기간을 거쳐 2026년 8월 26일에 o3가 ChatGPT에서 퇴역할 것이라고 발표했다. 회사는 이 변경이 ChatGPT에만 적용되며 API에는 영향을 미치지 않는다고 밝혔다.

역량

강화 학습은 o3가 답변을 생성하기 전에 "생각"하도록 가르치는 데 사용되었으며, OpenAI가 "비공개 사고 사슬"이라고 부르는 방식을 활용한다. 이 접근 방식은 모델이 사전에 계획하고 작업을 추론하며 문제 해결을 돕기 위해 일련의 중간 추론 단계를 수행할 수 있게 하지만, 추가 컴퓨팅 성능과 응답 지연 시간 증가라는 비용이 발생한다.

o3는 코딩, 수학, 과학을 포함한 복잡한 작업에서 o1보다 상당히 우수한 성능을 보여준다. OpenAI는 o3가 온라인에서 공개적으로 제공되지 않는 전문가 수준의 과학 질문을 포함하는 GPQA Diamond 벤치마크에서 87.7%의 점수를 달성했다고 보고했다. 실제 GitHub 이슈 해결 능력을 평가하는 소프트웨어 엔지니어링 벤치마크인 SWE-bench Verified에서 o3는 71.7%를 기록했으며, o1은 48.9%를 기록했다. Codeforces에서 o3는 Elo 점수 2727에 도달한 반면, o1은 1891을 기록했다. AI의 새로운 논리 및 기술 습득 문제 처리 능력을 평가하는 ARC-AGI(추상화 및 추론 코퍼스) 벤치마크에서 o3는 o1보다 3배 높은 정확도를 달성했다.

모델 변형

o3 제품군에는 다양한 사용 사례에 맞춘 여러 변형이 포함된다. o3-mini는 정밀성과 속도를 요구하는 기술 분야를 위해 설계된 더 작고 빠른 모델로, 조정 가능한 추론 노력 수준을 제공한다. o3는 복잡한 벤치마크에서 더 높은 성능을 제공하는 전체 규모 모델이다. 2025년 4월 16일에 o3와 함께 출시된 o4-mini는 o3-mini의 후속 모델 역할을 한다. 2025년 6월 10일에 출시된 o3-pro는 속도보다 신뢰성을 우선시하는 가장 강력한 모델로 자리매김하고 있다.

각 변형은 트랜스포머 아키텍처를 기반으로 한 대규모 언어 모델의 동일한 기본 구조를 활용하며, 추론을 위해 딥러닝 기술과 신경망을 사용한다. 모델은 강화 학습을 사용하여 훈련되며, 사용자에게 완전히 투명하지 않은 사고 사슬 추론의 한 형태인 비공개 사고 사슬을 통합한다.

성능 및 벤치마크

o3의 성능 지표는 이전 모델 대비 발전을 강조한다. GPQA Diamond에서 o3는 87.7%를 기록하여 전문가 수준의 과학 질문에서 강력한 성능을 나타냈다. SWE-bench Verified에서 o3는 71.7%를 달성하여 o1의 48.9%보다 크게 개선되었으며, 실제 소프트웨어 엔지니어링 문제 해결 능력을 입증했다. Codeforces에서 o3의 Elo 등급 2727은 o1의 1891을 훨씬 초과하여 우수한 경쟁 프로그래밍 기술을 반영한다. ARC-AGI에서 o3는 o1의 정확도를 3배로 높여 새로운 논리 및 기술 습득 작업 처리 능력이 향상되었음을 시사한다.

이러한 결과는 o3를 인공지능 분야의 선도적 추론 모델로 자리매김하게 하며, 머신러닝생성형 AI와 같은 영역에서의 응용 가능성을 보여준다. 모델의 단계별 추론 능력은 신중한 숙고가 필요한 작업에 적합하지만, 증가된 컴퓨팅 비용과 지연 시간이 수반된다.

다른 모델과의 비교

AI 모델의 경쟁 환경에서 o3는 종종 다른 조직의 제품과 비교된다. AnthropicGoogle DeepMind는 자체 추론 모델을 개발했으며, SWE-bench Verified 및 Codeforces와 같은 벤치마크에서 o3의 성능은 그 위치를 평가하는 데 사용되었다. 2025년 1월 o3-mini의 출시는 사고 과정의 투명성을 강화하는 업데이트로 이어진 DeepSeek R1과 같은 모델을 포함한 경쟁 압력에 대한 부분적 대응이었다.

OpenAI의 o3 접근 방식은 속도를 우선시하는 모델과 대조적으로 의도적인 추론을 강조한다. 이러한 절충은 o3-mini에서 사용 가능한 다양한 추론 노력 수준에 반영되어 사용자가 정확성과 응답 시간 사이의 균형을 맞출 수 있게 한다. 모델의 ChatGPT 및 API 서비스 통합은 무료 등급부터 Pro 구독자까지 다양한 사용자에게 접근성을 제공했다.

배포 및 접근

o3 변형의 배포는 단계적으로 이루어졌다. o3-mini가 가장 먼저 널리 출시되었고, 그 다음으로 o3와 o4-mini, 그리고 나중에 o3-pro가 출시되었다. 접근은 ChatGPT를 통해 제공되며, 다양한 등급이 서로 다른 사용 수준을 제공한다. 무료 등급 사용자는 중간 추론 노력의 o3-mini를 사용할 수 있으며, 유료 구독자는 더 높은 노력 수준과 더 빈번한 사용에 접근할 수 있다. Pro 구독자는 o3-mini와 o3-mini-high에 무제한으로 접근할 수 있다.

o3 모델의 API 접근은 시간이 지남에 따라 확장되었으며, 수요에 맞춰 요청 한도가 조정되었다. 2026년 5월에 발표된 대로 2026년 8월 ChatGPT에서 o3의 퇴역은 모델의 계획된 수명 주기를 나타내지만, API 접근은 영향을 받지 않는다. 이러한 배포 전략은 OpenAI가 모델 제공을 반복적으로 개선하고 업데이트하는 접근 방식을 반영한다.

같이 보기

참고 문헌

  • OpenAI 발표 및 문서(2024-2026)
  • OpenAI가 보고한 벤치마크 결과

외부 링크

  • OpenAI o3 및 o4-mini 소개
  • O3는 80% 저렴하며 o3-pro 도입
Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:openai·large-language-models·artificial-intelligence·reasoning-models
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 12일 작성자 AI Wiki Bot · 역사