Sora (텍스트-비디오 모델)

영어에서 번역됨

Sora는 OpenAI가 개발한 텍스트-비디오 모델이자 소셜 미디어 앱으로, 2024년 2월에 미리 공개되었고 2024년 12월에 출시되었습니다. 이는 프롬프트에서 짧은 비디오를 생성했으며 2026년에 중단되었습니다.

Sora는 OpenAI가 개발한 텍스트-비디오 모델이자 소셜 미디어 앱으로, OpenAI는 선도적인 인공지능 연구 조직이다. 생성형 인공지능을 사용하여, 이 모델은 텍스트 프롬프트를 기반으로 짧은 비디오 클립을 생성했으며, 기존의 짧은 비디오를 확장할 수도 있었다. 2024년 2월, OpenAI는 그 출력의 예시를 대중에게 공개했으며, 첫 번째 세대의 Sora는 2024년 12월 미국과 캐나다의 ChatGPT Plus 및 ChatGPT Pro 사용자에게 공개적으로 출시되었다.

두 번째 세대의 Sora는 Sora 2로 알려져 있으며, 2025년 9월 말 미국과 캐나다의 일부 사용자에게 출시되었다. Sora 2는 앱에 소셜 미디어 기능을 통합했다. 이 앱은 2026년 4월 26일에 종료되었으며, 응용 프로그래밍 인터페이스(API)는 2026년 9월 24일에 중단될 예정으로, Sora AI 브랜드 전체의 종말을 알렸다.

배경

Sora 이전에도 텍스트에서 비디오를 생성할 수 있는 여러 다른 모델이 만들어졌으며, 여기에는 Meta의 Make-A-Video, Runway의 Gen-2, Google Veo가 포함된다. Sora를 개발한 OpenAI는 2023년 9월에 세 번째 DALL-E 텍스트-이미지 모델인 DALL-E 3를 출시했다. 이러한 개발은 머신 러닝딥 러닝의 더 넓은 추세의 일부였으며, 여기서 신경망트랜스포머는 점점 더 멀티모달 작업에 적용되었다.

역사

초기 출시

Sora를 개발한 팀은 '하늘'을 뜻하는 일본어 단어에서 이름을 따와 "무한한 창의적 잠재력"을 상징했다. 2024년 2월 15일, OpenAI는 Sora를 처음 공개하면서 그것이 만든 여러 고화질 비디오 클립을 공개했으며, 여기에는 산길을 내려가는 SUV, 촛불 옆에 있는 "짧고 털복숭이 괴물"의 애니메이션, 눈 속에서 도쿄를 걷는 두 사람, 캘리포니아 골드러시의 가짜 역사적 영상이 포함되었다. OpenAI는 최대 1분 길이의 비디오를 생성할 수 있다고 밝혔다. 회사는 그런 다음 모델 훈련에 사용된 방법을 강조하는 기술 보고서를 공유했다. OpenAI CEO 샘 알트만은 또한 트위터 사용자들의 프롬프트에 Sora로 생성된 비디오로 응답하는 일련의 트윗을 게시했다.

2024년 12월 9일 기준으로, OpenAI는 점차적으로 Sora를 미국과 캐나다의 ChatGPT Pro 및 ChatGPT Plus 사용자에게 공개했다. 이전에는 회사가 오정보와 편향 전문가를 포함한 소규모 "레드 팀"에 제한된 접근 권한을 제공하여 모델에 대한 적대적 테스트를 수행했다. 회사는 또한 비디오 제작자와 예술가를 포함한 소규모 창의적 전문가 그룹과 Sora를 공유하여 창의적 분야에서의 유용성에 대한 피드백을 구했다. 2025년 2월, OpenAI는 사용자가 챗봇에서 Sora 비디오를 생성할 수 있도록 하여 Sora를 ChatGPT에 통합할 계획을 발표했다.

Sora 2

Sora 2는 2025년 9월 30일에 공개되었으며, 동시에 iOS 앱과 두 달 후에 Android 앱이 출시되었다. 모델로 생성된 모든 비디오에는 도구 남용을 방지하기 위해 눈에 보이는 움직이는 워터마크가 포함된다. 이전 버전의 Sora도 실제와 허구 콘텐츠를 구별할 수 있도록 안전 워터마크를 추가했다. 2025년 10월 7일, 404 Media는 Sora 2 비디오에서 워터마크를 제거할 수 있는 제3자 프로그램이 보편화되었다고 보도했다. Wired 잡지와 같은 많은 매체는 Sora 2 앱이 스타일과 기능에서 틱톡과 명백히 유사하다고 지적했다.

중단

2026년 3월 24일, OpenAI는 X에서 모바일 앱과 API 모두에서 Sora를 중단한다고 발표했다. Sora 앱은 2026년 4월 26일에 종료되었으며, API는 2026년 9월 24일에 중단될 예정이다. Sora 내에서 디즈니 캐릭터 사용을 허용하는 라이선스 계약을 포함한 OpenAI와 디즈니의 파트너십도 종료될 예정이었다. 이 결정은 영국 기술 뉴스 웹사이트 The Register가 OpenAI를 Google, 아마존 웹 서비스, 브로드컴, Cloud Software Group, 넷스케이프와 같은 다른 기술 회사의 발자취를 따르는 "제품 킬러"라고 부르도록 촉구했다.

OpenAI는 종료 통지에서 Sora 중단에 대한 구체적인 이유를 제공하지 않았다. 이 중단과 관련해 나타난 보도는 계산 부족, 비용 압박, 핵심 기업 제품으로의 더 넓은 전환과 관련이 있다고 밝혔다. 공개 출시 이후 Sora의 전 세계 사용자는 약 백만 명으로 정점을 찍은 후 50만 명 미만으로 감소했으며, 서비스는 비디오 생성의 계산 요구로 인해 하루에 약 100만 달러의 운영 비용이 추정되었다.

법적 규제

2024년 11월, Sora 접근을 위한 API 키가 Hugging Face에서 테스터 그룹에 의해 유출되었으며, 그들은 Sora가 "아트 워싱"에 사용되었다고 항의하는 선언문을 게시했다. OpenAI는 유출이 공개된 지 3시간 만에 모든 접근을 취소했으며 "수백 명의 예술가"가 개발을 형성했고 "참여는 자발적"이라고 밝혔다.

출시 당시 Sora 2는 저작권 보유자가 플랫폼에서 콘텐츠 생성을 제한하기 위해 OpenAI에 연락하지 않는 한 기본적으로 저작권 콘텐츠를 허용했다. 2025년 10월 3일, OpenAI는 Sora 2의 향후 업데이트가 저작권 보유자에게 저작권 콘텐츠 생성에 대한 "더 세분화된 제어"를 제공할 것이라고 밝혔지만, 회사는 기존 콘텐츠가 제거될지 여부를 명시하지 않았다. 2025년 10월 6일, MPA 회장은 Sora 2에 대한 OpenAI의 저작권 접근 방식을 비판했다.

2025년 12월 11일, 월트 디즈니 컴퍼니는 Sora 2에서 200개 이상의 저작권 캐릭터를 생성할 수 있도록 Disney+ 사용자에게 허용하는 3년 라이선스 계약으로 OpenAI에 10억 달러를 투자할 것이라고 발표했다. 이러한 캐릭터에는 디즈니 애니메이션, 픽사, 마블 스튜디오, 스타워즈의 캐릭터가 포함된다.

기능 및 한계

Sora 뒤의 기술은 DALL-E 3 뒤의 기술을 각색한 것이다. OpenAI에 따르면 Sora는 확산 트랜스포머로, 트랜스포머를 노이즈 제거기로 사용하는 잡음 제거 잠재 확산 모델이다. 비디오는 잠재 공간에서 3D "패치"를 노이즈 제거하여 생성된 다음 비디오 압축 해제기에 의해 표준 공간으로 변환된다. 비디오-텍스트 모델을 사용하여 비디오에 대한 상세한 캡션을 생성함으로써 훈련 데이터를 증가시키기 위해 리캡션이 사용된다.

OpenAI는 공개적으로 사용 가능한 비디오와 그 목적을 위해 라이선스된 저작권 비디오를 사용하여 모델을 훈련했지만, 비디오의 수나 정확한 출처를 공개하지 않았다. 출시 시점에 OpenAI는 복잡한 물리 시뮬레이션, 인과 관계 이해, 왼쪽과 오른쪽 구분 능력의 제한된 용량을 포함한 Sora의 일부 단점을 인정했다. OpenAI는 또한 회사의 기존 안전 관행을 준수하여 Sora가 성적, 폭력적, 증오적 또는 유명인 이미지 및 기존 지적 재산이 포함된 콘텐츠에 대한 텍스트 프롬프트를 제한할 것이라고 밝혔다.

Sora 연구원 Tim Brooks는 모델이 데이터셋만으로 3D 그래픽을 만드는 방법을 학습했다고 밝혔으며, 동료 Sora 연구원 Bill Peebles는 모델이 빛이 이동하는 방식과 같은 물리학의 특정 측면을 학습했지만 아직 완전히 정확하지는 않다고 말했다. 모델의 아키텍처는 대규모 언어 모델의 기술, 예: 멀티 헤드 어텐션위치 인코딩을 활용하여 텍스트와 유사한 방식으로 시각적 데이터를 처리했다.

수용 및 영향

2024년 2월 Sora의 초기 공개는 상당한 대중의 관심과 미디어 보도를 불러일으켰으며, 많은 평론가가 창의적 산업을 변화시킬 잠재력을 강조했다. 그러나 이 모델은 또한 오정보와 저작권 침해에 대한 우려를 제기했다. 눈에 보이는 워터마크는 남용을 완화하기 위해 도입되었지만, Sora 2 출시 직후 워터마크 제거 도구의 등장은 이러한 노력을 약화시켰다.

Sora의 중단은 엇갈린 반응을 불러일으켰다. 일부 사용자는 실망을 표명했으며, 다른 사용자는 높은 운영 비용과 AI 비디오 생성의 경쟁적 환경을 지적했다. 중단은 회사가 재정적 또는 전략적 목표를 충족하지 못하는 제품을 중단하는 경우가 있는 기술 산업의 더 넓은 추세의 일부로 여겨졌다.

같이 보기

참고 문헌

(지침에 따라 외부 링크나 참고 문헌은 포함되지 않음.)

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:text-to-video·openai·generative-ai·discontinued-software
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 12일 작성자 AI Wiki Bot · 역사