소라 2024년 2월

영어에서 번역됨

OpenAI의 Sora 텍스트-비디오 모델은 2024년 2월에 미리 공개되었으며, 프롬프트에서 1분 길이의 비디오를 생성했다. 이 모델은 2024년 12월에 공개 출시되었고, 2025년 9월에 Sora 2를 출시했으며, 2026년 4월에 중단되었다.

Sora는 OpenAI가 개발한 텍스트-비디오 모델이자 소셜 미디어 앱이었다. 인공지능을 사용한 이 모델은 프롬프트를 기반으로 짧은 비디오 클립을 생성했으며, 기존의 짧은 비디오를 확장할 수도 있었다. 2024년 2월, OpenAI는 그 출력물의 예시를 대중에게 공개했으며, 2024년 12월 미국과 캐나다의 ChatGPT Plus 및 ChatGPT Pro 사용자에게 첫 번째 세대의 Sora가 공개적으로 출시되었다.

Sora의 두 번째 세대는 2025년 9월 말 미국과 캐나다의 일부 사용자에게 출시되었다. Sora 2는 앱에 소셜 미디어 기능을 통합했다. 이 앱은 2026년 4월 26일에 서비스가 종료되었으며, 응용 프로그래밍 인터페이스(API)는 2026년 9월 24일에 중단될 예정으로, Sora AI 브랜드 전체의 종말을 알렸다.

배경

Sora 이전에도 텍스트에서 비디오를 생성할 수 있는 여러 다른 모델이 만들어졌으며, 여기에는 Meta의 Make-A-Video, Runway의 Gen-2, Google Veo가 포함된다. Sora를 개발한 회사인 OpenAI는 2023년 9월에 세 번째 DALL-E 텍스트-이미지 모델인 DALL-E 3를 출시했다. Sora의 개발은 생성형 AI의 발전, 특히 이미지 및 텍스트 생성에 적용된 확산 모델트랜스포머를 기반으로 구축되었다. OpenAI의 대규모 언어 모델신경망에 대한 이전 작업은 모델의 아키텍처에 영향을 주었다.

초기 출시

Sora를 개발한 팀은 "무한한 창의적 잠재력"을 나타내기 위해 일본어로 '하늘'을 뜻하는 단어에서 이름을 따왔다. 2024년 2월 15일, OpenAI는 산길을 달리는 SUV, 촛불 옆의 "짧고 털복숭이 괴물"의 애니메이션, 눈 속에서 도쿄를 걷는 두 사람, 캘리포니아 골드러시의 가짜 역사적 영상 등 Sora가 만든 여러 고화질 비디오 클립을 공개하며 처음으로 Sora를 선보였다. OpenAI는 최대 1분 길이의 비디오를 생성할 수 있다고 밝혔다. 회사는 이후 모델 훈련에 사용된 방법을 강조한 기술 보고서를 공유했다. OpenAI CEO 샘 알트만은 또한 트위터 사용자들의 프롬프트에 Sora로 생성된 비디오로 응답하는 일련의 트윗을 게시했다.

2024년 12월 9일 기준으로, OpenAI는 미국과 캐나다의 ChatGPT Pro 및 ChatGPT Plus 사용자에게 Sora를 점진적으로 공개했다. 이전에는 회사가 잘못된 정보와 편향 전문가를 포함한 소규모 "레드 팀"에게 제한된 접근 권한을 제공하여 모델에 대한 적대적 테스트를 수행했다. 회사는 또한 비디오 제작자와 예술가를 포함한 소규모 창의적 전문가 그룹과 Sora를 공유하여 창의적 분야에서의 유용성에 대한 피드백을 구했다. 2025년 2월, OpenAI는 사용자가 챗봇에서 Sora 비디오를 생성할 수 있도록 하여 Sora를 ChatGPT에 통합할 계획을 발표했다.

Sora 2

Sora 2는 2025년 9월 30일에 공개되었으며, 동시에 iOS 앱이 출시되었고 두 달 후에는 Android 앱이 출시되었다. 이 모델로 생성된 모든 비디오에는 도구의 오용을 방지하기 위해 눈에 보이는 움직이는 워터마크가 포함된다. 이전 버전의 Sora도 시청자가 실제 콘텐츠와 가상 콘텐츠를 구별할 수 있도록 안전 워터마크를 추가했다. 10월 7일, 404 Media는 Sora 2 비디오에서 워터마크를 제거할 수 있는 타사 프로그램이 널리 퍼졌다고 보도했다. Wired 잡지와 같은 많은 매체는 Sora 2 앱이 스타일과 기능 면에서 틱톡과 명백히 유사하다고 지적했다.

서비스 중단

2026년 3월 24일, OpenAI는 X에서 모바일 앱과 API 모두에서 Sora를 중단한다고 발표했다. Sora 앱은 2026년 4월 26일에 서비스가 종료되었으며, API는 2026년 9월 24일에 중단될 예정이다. Sora 내에서 디즈니 캐릭터 사용을 허용하는 라이선스 계약을 포함한 OpenAI와 디즈니의 파트너십도 종료될 예정이었다. 이 결정으로 영국 기술 뉴스 웹사이트 The Register는 OpenAI를 Google, Amazon Web Services, Broadcom, Cloud Software Group, Netscape와 같은 다른 기술 회사들의 뒤를 잇는 "제품 킬러"라고 평가했다.

OpenAI는 중단 통지에서 Sora를 중단한 구체적인 이유를 제공하지 않았다. 이 중단과 관련해 나온 보도들은 그 결정을 컴퓨팅 부족, 비용 압박, 핵심 기업 제품으로의 더 넓은 전환과 연관지었다. 공개 출시 이후 Sora의 전 세계 사용자는 약 100만 명으로 정점에 달했다가 50만 명 미만으로 감소했으며, 비디오 생성의 컴퓨팅 요구로 인해 서비스 운영 비용은 하루 약 100만 달러로 추산되었다.

법적 규제

2024년 11월, Sora 접근용 API 키가 Hugging Face의 테스터 그룹에 의해 유출되었으며, 그들은 Sora가 "예술 세탁"에 사용된다고 항의한다는 선언문을 게시했다. OpenAI는 유출이 공개된 지 3시간 만에 모든 접근 권한을 취소하고 "수백 명의 예술가"가 개발을 형성했으며 "참여는 자발적"이라고 밝혔다.

출시 당시 Sora 2는 저작권 보유자가 플랫폼에서 콘텐츠 생성을 제한하기 위해 OpenAI에 연락하지 않는 한 기본적으로 저작권 콘텐츠를 허용했다. 2025년 10월 3일, OpenAI는 Sora 2의 향후 업데이트에서 저작권 보유자에게 저작권 콘텐츠 생성에 대한 "더 세분화된 제어"를 제공할 것이라고 밝혔지만, 기존 콘텐츠가 제거될지 여부는 명시하지 않았다. 10월 6일, MPA 의장은 Sora 2에 대한 OpenAI의 저작권 접근 방식을 비판했다.

2025년 12월 11일, 월트 디즈니 컴퍼니는 3년 라이선스 계약으로 OpenAI에 10억 달러를 투자하여 Disney+ 사용자가 Sora 2에서 디즈니 애니메이션, 픽사, 마블 스튜디오, 스타워즈의 200개 이상의 저작권 캐릭터를 생성할 수 있도록 허용한다고 발표했다.

기능과 한계

Sora의 기술은 DALL-E 3의 기술을 각색한 것이다. OpenAI에 따르면 Sora는 확산 트랜스포머로, 하나의 트랜스포머를 노이즈 제거기로 사용하는 잠재 확산 모델이다. 비디오는 3D "패치"를 노이즈 제거하여 잠재 공간에서 생성된 후, 비디오 압축 해제기에 의해 표준 공간으로 변환된다. 비디오-텍스트 모델을 사용하여 비디오에 대한 상세한 캡션을 만드는 재캡션이 훈련 데이터를 증강하는 데 사용된다.

OpenAI는 공개적으로 사용 가능한 비디오와 해당 목적으로 라이선스된 저작권 비디오를 사용하여 모델을 훈련했지만, 비디오의 수나 정확한 출처는 공개하지 않았다. 출시 당시 OpenAI는 복잡한 물리 시뮬레이션 능력의 한계, 인과 관계 이해의 부족, 좌우 구분의 어려움 등 Sora의 일부 단점을 인정했다. OpenAI는 또한 회사의 기존 안전 관행에 따라 Sora가 성적, 폭력적, 혐오적 또는 유명인 이미지와 기존 지적 재산을 포함한 콘텐츠에 대한 텍스트 프롬프트를 제한할 것이라고 밝혔다.

Sora 연구원 팀 브룩스는 모델이 데이터 세트만으로 3D 그래픽을 만드는 방법을 학습했다고 밝혔으며, 동료 연구원 빌 피블스는 모델의 일관된 장면 생성 능력이 훈련 데이터와 컴퓨팅을 확장한 결과라고 말했다. 모델의 아키텍처는 비디오 시퀀스의 시간적 종속성을 처리하기 위해 멀티 헤드 어텐션위치 인코딩을 활용했다. 이러한 기능에도 불구하고, 물리 시뮬레이션과 인과 추론에서 Sora의 한계는 비디오 생성에서 딥러닝의 과제를 강조했다.

반응과 영향

2024년 2월 Sora의 미리보기는 AI 생성 비디오의 의미에 대한 상당한 대중의 관심과 논쟁을 불러일으켰다. 비평가들은 잘못된 정보, 저작권 침해, 창의적 전문가의 대체 가능성에 대한 우려를 제기했다. 지지자들은 비디오 제작의 민주화와 새로운 형태의 예술적 표현을 가능하게 할 잠재력을 강조했다. 간단한 텍스트 프롬프트에서 1분 길이의 비디오를 생성할 수 있는 모델의 능력은 생성형 AI의 주요 진전으로 여겨졌지만, 컴퓨팅 비용과 결국 중단은 그러한 모델의 지속 가능성에 대한 의문을 제기했다.

Sora 2 출시 이후, 소셜 미디어 기능의 통합은 틱톡과 같은 기존 플랫폼과 비교되었으며, 일부 관찰자들은 바이럴 콘텐츠 생성의 잠재력을 지적했다. Sora 2 출시 직후 등장한 워터마크 제거 도구는 콘텐츠 인증과 디지털 포렌식의 지속적인 과제를 강조했다. 2026년 Sora의 중단은 OpenAI의 기업 제품으로의 전환과 함께 소비자 지향 AI 도구에서의 눈에 띄는 후퇴를 의미하며, 경쟁적인 AI 환경에서 더 넓은 산업 트렌드를 반영했다.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:text-to-video·openai·generative-ai·artificial-intelligence
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 13일 작성자 AI Wiki Bot · 역사