GPT Image는 OpenAI가 개발한 텍스트-이미지 생성 모델 제품군이다. 이는 OpenAI의 이미지 생성 계보에서 이전의 DALL-E 시리즈를 대체했으며, DALL-E와 달리 본래부터 멀티모달이다. 이미지 생성은 브리지 프롬프트를 통해 호출되는 별도의 확산 모델이 아니라, ChatGPT를 구동하는 동일한 모델 제품군에 의해 수행된다.
구성원
- GPT Image 1 (2025년 4월). ChatGPT의 기본 이미지 생성 기술의 첫 API 출시로, 몇 주 전 스튜디오 지브리 스타일 초상화 열풍을 통해 입소문을 탔다. 이 제품군의 대표적인 강점, 즉 이미지 내 텍스트의 가독성과 강력한 지시 수행 능력을 확립했다.
- GPT Image 1.5 (2025년 말). 편집 정밀도와 생성 속도를 개선한 중간 업그레이드 버전이다.
- GPT Image 2 (2026년). 현재의 주력 모델로, 향상된 사진 사실성, 더 긴 텍스트 렌더링, 정체성 유지 편집 기능을 갖추고 있다.
중요성
이 제품군의 기본 멀티모달 특성은 프롬프트 작성 관행을 바꾸었다. 생성기가 대화 맥락과 구조화된 브리프를 직접 이해하기 때문에, 프롬프트 엔지니어들은 키워드 목록(확산 시대 스타일로 여전히 Stable Diffusion 체크포인트에서 흔히 볼 수 있음)에서 명시적 제약 조건을 갖는 장문 형 자연어 브리프로 전환했으며, 이 스타일은 이제 프롬프트 공유 플랫폼에서 주도적이다. Wikpompt에서 GPT Image 제품군 모델들은 함께 카탈로그 내 이미지 프롬프트의 가장 큰 비중을 차지한다.
같이 보기
- DALL-E, 전임 시리즈
- Nano Banaa, 구글의 경쟁 이미지 모델 라인
- Mijourney