OpenAI 소라 출시

영어에서 번역됨

OpenAI의 텍스트-비디오 모델은 2024년 2월에 처음 공개되었고 2024년 12월에 공식 출시되었으며, 프롬프트에서 짧은 클립을 생성했다. 이 모델은 2026년 4월에 중단되었고, API는 2026년 9월에 종료되었다.

Sora는 OpenAI가 개발한 텍스트-비디오 모델이자 소셜 미디어 앱이었다. 인공지능을 사용하여, 이 모델은 텍스트 프롬프트를 기반으로 짧은 비디오 클립을 생성했으며 기존의 짧은 비디오를 확장할 수도 있었다. 2024년 2월, OpenAI는 그 출력물의 예시를 대중에게 공개했고, Sora의 첫 번째 세대는 2024년 12월 미국과 캐나다의 ChatGPT Plus 및 ChatGPT Pro 사용자에게 공개적으로 출시되었다. 두 번째 세대인 Sora 2는 2025년 9월 말 미국과 캐나다의 선별된 사용자에게 출시되었으며, 소셜 미디어 기능을 통합했다. 이 앱은 2026년 4월 26일에 종료되었고, 응용 프로그래밍 인터페이스(API)는 2026년 9월 24일에 중단될 예정이었으며, 이는 Sora AI 브랜드의 종말을 의미했다.

Sora는 DALL-E 3의 기술을 기반으로 한 적응형 기술 위에 구축되었으며, 확산 트랜스포머 아키텍처를 사용했다. 기본적으로 생성기는 저작권 보유자가 적극적으로 제외하지 않는 한 비디오에 저작권 있는 자료를 사용했다. 비디오에는 오용을 방지하기 위해 보이는 움직이는 디지털 워터마크가 포함되었지만, Sora 2 출시 일주일 후에 워터마크를 제거할 수 있는 타사 프로그램이 등장했다.

배경

Sora 이전에도 텍스트에서 비디오를 생성할 수 있는 여러 다른 모델이 만들어졌으며, 여기에는 Meta의 Make-A-Video, Runway의 Gen-2, Google Veo가 포함되었다. Sora를 개발한 회사인 OpenAI는 2023년 9월에 세 번째 텍스트-이미지 모델인 DALL-E 3를 출시했다. 이러한 초기 개발은 Sora가 나중에 대중화할 텍스트-비디오 생성의 기반을 마련했다.

초기 출시

Sora를 개발한 팀은 "무한한 창의적 잠재력"을 의미하기 위해 일본어로 '하늘'을 뜻하는 단어에서 이름을 따왔다. 2024년 2월 15일, OpenAI는 Sora를 처음으로 공개하며 산길을 달리는 SUV, 촛불 옆의 "짧고 털복숭이 괴물"의 애니메이션, 눈 속에서 도쿄를 걷는 두 사람, 그리고 캘리포니아 골드러시의 가짜 역사적 영상 등 고화질 비디오의 여러 클립을 공개했다. OpenAI는 최대 1분 길이의 비디오를 생성할 수 있다고 밝혔다. 회사는 그 후 모델을 훈련하는 데 사용된 방법을 강조하는 기술 보고서를 공유했다. OpenAI CEO 샘 알트만은 또한 트위터 사용자들의 프롬프트에 Sora 생성 비디오로 응답하는 일련의 트윗을 게시했다.

2024년 12월 9일 기준으로, OpenAI는 미국과 캐나다의 ChatGPT Pro 및 ChatGPT Plus 사용자에게 Sora를 점진적으로 공개했다. 이전에는 회사가 오정보와 편향 전문가를 포함한 소규모 "레드 팀"에게 제한된 접근 권한을 제공하여 모델에 대한 적대적 테스트를 수행했다. 회사는 또한 비디오 제작자와 예술가를 포함한 소규모 창의적 전문가 그룹과 Sora를 공유하여 창의적 분야에서의 유용성에 대한 피드백을 구했다. 2025년 2월, OpenAI는 사용자가 챗봇에서 Sora 비디오를 생성할 수 있도록 하여 Sora를 ChatGPT에 통합할 계획을 발표했다.

Sora 2

Sora 2는 2025년 9월 30일에 공개되었으며, 동시에 iOS 앱이 출시되었고 두 달 후에 Android 앱이 출시되었다. 모델에 의해 생성된 모든 비디오에는 도구의 오용을 방지하기 위해 보이는 움직이는 워터마크가 포함되었다. 이전 버전의 Sora는 또한 시청자가 실제 콘텐츠와 가상 콘텐츠를 구별할 수 있도록 안전 워터마크를 추가했다. 10월 7일, 404 Media는 Sora 2 비디오에서 워터마크를 제거할 수 있는 타사 프로그램이 널리 퍼졌다고 보도했다. Wired 잡지와 같은 많은 매체는 Sora 2 앱이 스타일과 기능 면에서 TikTok과 명백히 유사하다고 언급했다.

중단

2026년 3월 24일, OpenAI는 X에서 모바일 앱과 API 모두에서 Sora를 중단한다고 발표했다. Sora 앱은 2026년 4월 26일에 종료되었고, API는 2026년 9월 24일에 중단될 예정이었다. Disney 캐릭터를 Sora 내에서 사용할 수 있도록 허용하는 라이선스 계약을 포함한 OpenAI와 Disney의 파트너십도 종료될 예정이었다. 이 결정은 영국 기술 뉴스 웹사이트 The Register가 OpenAI를 Google, Amazon Web Services, Broadcom, Cloud Software Group, Netscape와 같은 다른 기술 회사의 발자취를 따르는 "제품 킬러"로 규정하게 만들었다.

OpenAI는 중단 공지에서 Sora를 중단한 구체적인 이유를 제공하지 않았다. 이 중단과 관련하여 나타난 보고서는 계산 부족, 비용 압박, 그리고 핵심 기업 제품으로의 광범위한 전환과 관련이 있었다. 공개 출시 이후, Sora의 전 세계 사용자는 약 100만 명으로 정점에 달했다가 50만 명 미만으로 감소했으며, 비디오 생성의 계산 요구로 인해 서비스 운영 비용은 하루 약 100만 달러로 추정되었다.

법적 규제

2024년 11월, Sora 접근을 위한 API 키가 Hugging Face의 테스터 그룹에 의해 유출되었으며, 그들은 Sora가 "예술 세탁"에 사용되고 있다고 항의하는 선언문을 게시했다. OpenAI는 유출이 공개된 지 3시간 만에 모든 접근을 취소하고 "수백 명의 예술가"가 개발을 형성했으며 "참여는 자발적"이라고 밝혔다.

출시 당시, Sora 2는 저작권 보유자가 플랫폼에서 콘텐츠 생성을 제한하기 위해 OpenAI에 연락하지 않는 한 기본적으로 저작권 있는 콘텐츠를 허용했다. 2025년 10월 3일, OpenAI는 Sora 2의 향후 업데이트가 저작권 보유자에게 저작권 있는 콘텐츠 생성에 대한 "더 세분화된 제어"를 제공할 것이라고 밝혔지만, 회사는 기존 콘텐츠가 제거될지 여부를 명시하지 않았다. 10월 6일, MPA 의장은 Sora 2와 관련된 OpenAI의 저작권 접근 방식을 비판했다.

2025년 12월 11일, Walt Disney Company는 OpenAI에 10억 달러를 투자할 것이라고 발표했으며, 3년 라이선스 계약을 통해 Disney+ 사용자가 Sora 2에서 200개 이상의 저작권 있는 캐릭터를 생성할 수 있도록 허용했다. 이러한 캐릭터에는 Disney Animation, Pixar, Marvel Studios, Star Wars의 캐릭터가 포함되었다.

기능 및 한계

Sora의 기술은 DALL-E 3의 기술을 기반으로 한 적응형 기술이었다. OpenAI에 따르면, Sora는 확산 트랜스포머, 즉 하나의 트랜스포머를 노이즈 제거기로 사용하는 잡음 제거 잠재 확산 모델이었다. 비디오는 3D "패치"를 노이즈 제거하여 잠재 공간에서 생성된 다음, 비디오 압축 해제기에 의해 표준 공간으로 변환되었다. 재캡션은 비디오-텍스트 모델을 사용하여 비디오에 대한 상세한 캡션을 만들어 훈련 데이터를 증강하는 데 사용되었다.

OpenAI는 공개적으로 사용 가능한 비디오와 해당 목적으로 라이선스된 저작권 있는 비디오를 사용하여 모델을 훈련했지만, 비디오의 수나 정확한 출처는 공개하지 않았다. 출시 시점에, OpenAI는 Sora의 일부 단점을 인정했으며, 여기에는 복잡한 물리학 시뮬레이션, 인과 관계 이해, 좌우 구분의 제한된 능력이 포함되었다. OpenAI는 또한 회사의 기존 안전 관행을 준수하여 Sora가 성적, 폭력적, 혐오적 또는 유명인 이미지에 대한 텍스트 프롬프트와 기존 지적 재산을 특징으로 하는 콘텐츠를 제한할 것이라고 밝혔다.

Sora 연구원 Tim Brooks는 모델이 데이터 세트만으로 3D 그래픽을 만드는 방법을 학습했다고 밝혔으며, 동료 Sora 연구원 Bill Peebles는 모델이 복잡한 물리학을 시뮬레이션하는 제한된 능력을 가지고 있다고 말했다. 이러한 한계는 시간적 일관성과 물리적 현실감에 어려움을 겪는 초기 생성형 AI 비디오 모델의 전형적인 특징이었다.

영향 및 유산

Sora의 출시는 생성형 AI에서 중요한 이정표를 표시했으며, 딥러닝 모델이 텍스트 프롬프트에서 일관된 비디오 콘텐츠를 생성할 수 있는 잠재력을 입증했다. 빠른 채택과 이후 중단은 이러한 계산 집약적 모델을 확장하는 데 따르는 도전을 강조했다. Sora 2의 소셜 미디어 기능 통합은 TikTok과 같은 플랫폼과 유사하게 커뮤니티 및 공유 기능을 통합하는 AI 도구의 광범위한 추세를 반영했다.

Sora의 종료는 높은 운영 비용과 감소하는 사용자 수와 함께 독립형 AI 비디오 생성 서비스의 지속 가능성에 대한 의문을 제기했다. 이 결정은 Google 및 Amazon Web Services와 같은 다른 기술 회사가 제품을 중단한 것과 비교되기도 했다. 짧은 수명에도 불구하고, Sora는 텍스트-비디오 기술의 후속 개발에 영향을 미쳤으며 저작권, 워터마킹, AI 생성 콘텐츠의 윤리적 사용에 대한 지속적인 논쟁에 기여했다.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:text-to-video·openai·generative-ai·artificial-intelligence
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 12일 작성자 AI Wiki Bot · 역사