GPT Image 1.5는 이미지 생성 및 편집을 위해 OpenAI가 개발한 생성형 인공지능 모델이다. 2025년에 출시된 이 모델은 GPT Image 1의 후속작으로, ChatGPT 및 OpenAI API에 통합되어 사용자가 자연어 프롬프트로 이미지를 생성하고 수정할 수 있게 한다. 이 모델은 OpenAI의 대규모 언어 모델 아키텍처를 기반으로 하며, 다중 모드 이해와 확산 기반 이미지 합성을 결합한다.
GPT Image 1.5는 2025년 초 OpenAI에 의해 발표되었으며, 2025년 3월에 공개 출시되었다. ChatGPT Plus, Pro, Team 구독자와 개발자용 API를 통해 제공되었으며, Microsoft Azure의 Azure OpenAI Service를 포함한 OpenAI의 기업용 제품을 통해서도 접근할 수 있다.
기능
GPT Image 1.5는 전작에 비해 여러 가지 개선 사항을 도입했는데, 최대 2048x2048 픽셀의 더 높은 해상도 출력, 복잡한 프롬프트에 대한 더 나은 준수, 이미지 내 텍스트의 더 정확한 렌더링이 포함된다. 이 모델은 대화형 지시를 통해 이미지를 개선할 수 있는 다중 턴 편집을 지원한다. 또한 여러 출력에서 일관된 캐릭터와 스타일을 가진 이미지를 생성할 수 있는데, 이는 창의적인 전문가를 겨냥한 기능이다.
OpenAI의 기술 문서에 따르면, GPT Image 1.5는 레이아웃과 구성을 위한 자기회귀 트랜스포머와 픽셀 수준의 세부 사항을 위한 확산 디코더를 결합한 하이브리드 접근 방식을 사용한다. 이를 통해 더 일관된 장면이 가능해지고 왜곡된 손이나 깨진 텍스트와 같은 일반적인 아티팩트가 줄어든다.
성능 및 벤치마크
내부 평가에서 OpenAI는 GPT Image 1.5가 MMMU(다중 모드 다학문 이해) 벤치마크와 사실적 표현 및 프롬프트 정렬에 대한 인간 선호도 테스트에서 GPT Image 1을 능가한다고 보고했다. Artificial Analysis 지능 지수와 같은 독립적인 벤치마크는 GPT Image 1.5를 2025년 최고의 이미지 생성 모델 중 하나로 평가했으며, Google DeepMind 및 다른 연구소의 시스템과 경쟁했다.
이 모델은 작은 텍스트, 로고, 과학 다이어그램과 같은 세밀한 세부 사항을 가진 이미지 생성 능력도 향상시켰다. OpenAI는 GPT Image 1.5가 긴 텍스트 구절 렌더링 오류를 이전 버전에 비해 약 40% 줄였다고 밝혔다.
API 및 가격
GPT Image 1.5는 계층적 가격 구조로 OpenAI API를 통해 제공된다. 출시 시점 기준으로 이 모델은 표준 해상도(1024x1024)의 경우 이미지당 $0.02, 고해상도(2048x2048)의 경우 이미지당 $0.08로 책정되었다. API는 품질, 크기, 스타일 매개변수를 지원하며 기존 채팅 완료 엔드포인트와 통합된다.
개발자는 마케팅 콘텐츠 생성부터 디자인 프로토타이핑까지 다양한 애플리케이션에 GPT Image 1.5를 사용할 수 있다. OpenAI는 또한 특정 데이터 세트에 대한 맞춤화를 허용하는 엔터프라이즈 고객용 미세 조정 옵션을 제공하지만, 이 기능은 선별된 파트너로 제한된다.
안전 및 한계
OpenAI는 유해하거나 기만적인 이미지 생성을 방지하기 위한 콘텐츠 필터를 포함하여 GPT Image 1.5에 여러 안전 조치를 구현했다. 이 모델에는 AI 생성 콘텐츠를 나타내는 C2PA 워터마크가 포함되어 있으며, OpenAI는 동의 없이 공인 인물의 사실적인 얼굴 생성을 제한했다. 이러한 조치에도 불구하고 이 모델은 여전히 편향되거나 부정확한 표현을 생성할 수 있으며, OpenAI는 사용자에게 출력물의 사실적 정확성을 검토할 것을 권고한다.
다른 신경망 모델과 마찬가지로 GPT Image 1.5는 추상적 개념을 이해하는 데 한계가 있으며, 매우 구체적이거나 모호한 프롬프트에서 어려움을 겪을 수 있다. 이 모델의 훈련 데이터에는 인터넷의 공개 이미지와 텍스트가 포함되어 있어 문화적 편향이 도입될 수 있다.
반응
GPT Image 1.5는 개선된 텍스트 렌더링 및 편집 기능으로 기술 미디어와 창의적 커뮤니티에서 긍정적인 평가를 받았다. 비평가들은 전문 디자인 도구를 완전히 대체하지는 않지만 빠른 시각적 프로토타이핑의 장벽을 크게 낮춘다고 지적했다. 오해의 소지가 있는 이미지 생성에 악용될 가능성에 대한 우려도 제기되어, OpenAI는 사용 정책을 업데이트하게 되었다.
2025년 중반까지 GPT Image 1.5는 광고, 전자상거래, 교육과 같은 산업에서 널리 채택되었다. 또한 학술 연구에서 예시 그림과 데이터 시각화를 생성하는 일반적인 도구가 되었다.