OpenAI Sora foi um modelo de texto para vídeo e um aplicativo de mídia social desenvolvido pela OpenAI. Usando inteligência artificial, o modelo gerava clipes de vídeo curtos com base em prompts e também podia estender vídeos curtos existentes. Em fevereiro de 2024, a OpenAI pré-visualizou exemplos de sua produção para o público, com a primeira geração do Sora lançada publicamente para usuários do ChatGPT Plus e ChatGPT Pro nos Estados Unidos e no Canadá em dezembro de 2024.
A segunda geração do Sora foi lançada para usuários selecionados nos EUA e no Canadá no final de setembro de 2025. O Sora 2 integrou recursos de mídia social ao aplicativo. O aplicativo foi descontinuado em 26 de abril de 2026, e a interface de programação de aplicativos (API) está planejada para ser descontinuada em 24 de setembro de 2026, marcando o fim da marca de IA Sora como um todo.
Antecedentes
Vários outros modelos capazes de gerar vídeo a partir de texto foram criados antes do Sora, incluindo o Make-A-Video da Meta, o Gen-2 da Runway e o Google Veo. A OpenAI, a empresa por trás do Sora, havia lançado o DALL-E 3, o terceiro de seus modelos de texto para imagem DALL-E, em setembro de 2023. O desenvolvimento do Sora baseou-se em avanços em IA generativa e aprendizado profundo, particularmente em técnicas de modelo de difusão usadas na geração de imagens.
História
Lançamento inicial
A equipe que desenvolveu o Sora o nomeou em homenagem à palavra japonesa para 'céu' para significar seu "potencial criativo ilimitado". Em 15 de fevereiro de 2024, a OpenAI pré-visualizou o Sora pela primeira vez, divulgando vários clipes de vídeos em alta definição que havia criado, incluindo um SUV dirigindo por uma estrada de montanha, uma animação de um "monstrinho peludo" ao lado de uma vela, duas pessoas caminhando por Tóquio na neve e imagens históricas falsas da corrida do ouro na Califórnia. A OpenAI afirmou que era capaz de gerar vídeos de até um minuto. A empresa então compartilhou um relatório técnico que destacava os métodos usados para treinar o modelo. O CEO da OpenAI, Sam Altman, também publicou uma série de tweets respondendo a prompts de usuários do Twitter com vídeos gerados pelo Sora desses prompts.
Em 9 de dezembro de 2024, a OpenAI gradualmente disponibilizou o Sora ao público para usuários do ChatGPT Pro e ChatGPT Plus nos EUA e no Canadá. Antes disso, a empresa havia fornecido acesso limitado a um pequeno "time vermelho", incluindo especialistas em desinformação e viés, para realizar testes adversariais no modelo. A empresa também compartilhou o Sora com um pequeno grupo de profissionais criativos, incluindo cineastas e artistas, para buscar feedback sobre sua utilidade em campos criativos. Em fevereiro de 2025, a OpenAI anunciou planos de integrar o Sora ao ChatGPT, permitindo que os usuários gerassem vídeos do Sora a partir do chatbot.
Sora 2
O Sora 2 foi revelado em 30 de setembro de 2025, com um aplicativo iOS ao mesmo tempo, além de um aplicativo Android dois meses depois. Todos os vídeos gerados pelo modelo apresentam uma marca d'água visível e em movimento para evitar o uso indevido da ferramenta. A versão anterior do Sora também adicionou uma marca d'água de segurança para permitir que os espectadores distinguissem entre conteúdo real e fictício. Em 7 de outubro, o 404 Media relatou que programas de terceiros que podiam remover a marca d'água dos vídeos do Sora 2 se tornaram predominantes. Muitos veículos, como a revista Wired, notaram que o aplicativo do Sora 2 é abertamente semelhante ao TikTok em estilo e recursos.
Descontinuação
Em 24 de março de 2026, a OpenAI anunciou no X que estava descontinuando o Sora tanto no aplicativo móvel quanto na API. O aplicativo Sora foi desligado em 26 de abril de 2026, enquanto a API está planejada para ser desligada em 24 de setembro de 2026. A parceria da OpenAI com a Disney, que incluía um acordo de licenciamento permitindo que personagens da Disney fossem usados no Sora, também estava chegando ao fim. A decisão levou o site de notícias de tecnologia britânico The Register a rotular a OpenAI de "assassina de produtos", seguindo os passos de outras empresas de tecnologia como Google, Amazon Web Services, Broadcom, Cloud Software Group e Netscape.
A OpenAI não forneceu um motivo específico para descontinuar o Sora em seu aviso de encerramento. Os relatos que surgiram sobre essa descontinuação ligaram a decisão à escassez de computação, pressões de custo e uma mudança mais ampla em direção a produtos empresariais principais. Após seu lançamento público, os usuários mundiais do Sora atingiram um pico de cerca de um milhão antes de cair para menos de 500.000, enquanto o serviço custava cerca de US$ 1 milhão por dia para operar devido às demandas computacionais da geração de vídeo.
Regulamentação legal
Em novembro de 2024, uma chave de API para acesso ao Sora foi vazada por um grupo de testadores no Hugging Face, que publicaram um manifesto afirmando que estavam protestando contra o uso do Sora para "lavagem de arte". A OpenAI revogou todo o acesso três horas após o vazamento se tornar público e afirmou que "centenas de artistas" moldaram o desenvolvimento e que a "participação é voluntária".
No momento de seu lançamento, o Sora 2 permitia conteúdo protegido por direitos autorais por padrão, a menos que os detentores dos direitos autorais entrassem em contato com a OpenAI para restringir a geração de seu conteúdo na plataforma. Em 3 de outubro de 2025, a OpenAI afirmou que uma atualização futura do Sora 2 daria aos detentores de direitos autorais "controle mais granular" sobre a geração de conteúdo protegido, mas a empresa não declarou se o conteúdo existente seria removido. Em 6 de outubro, o presidente da MPA criticou a abordagem da OpenAI em relação aos direitos autorais com o Sora 2.
Em 11 de dezembro de 2025, a Walt Disney Company anunciou que investiria US$ 1 bilhão na OpenAI, em um acordo de licenciamento de três anos, para permitir que usuários do Disney+ gerassem mais de 200 de seus personagens protegidos por direitos autorais no Sora 2. Esses personagens incluem aqueles da Disney Animation, Pixar, Marvel Studios e Star Wars.
Capacidades e limitações
A tecnologia por trás do Sora é uma adaptação da tecnologia por trás do DALL-E 3. De acordo com a OpenAI, o Sora é um transformador de difusão, um modelo de difusão latente de denoising com um transformador como seu denoiser. Um vídeo é gerado no espaço latente por denoising de "patches" 3D e, em seguida, transformado para o espaço padrão por um descompactador de vídeo. A recaptioning é empregada para aumentar os dados de treinamento usando um modelo de vídeo para texto para criar legendas detalhadas para vídeos.
A OpenAI treinou o modelo usando vídeos publicamente disponíveis, bem como vídeos protegidos por direitos autorais licenciados para esse fim, mas não revelou o número ou a fonte exata dos vídeos. Após seu lançamento, a OpenAI reconheceu algumas das deficiências do Sora, incluindo sua capacidade limitada de simular física complexa, entender causalidade e diferenciar esquerda de direita. A OpenAI também afirmou que, em aderência às práticas de segurança existentes da empresa, o Sora restringirá prompts de texto para imagens sexuais, violentas, de ódio ou de celebridades, bem como conteúdo que apresente propriedade intelectual existente.
O pesquisador do Sora, Tim Brooks, afirmou que o modelo aprendeu a criar gráficos 3D apenas a partir de seu conjunto de dados, enquanto o colega pesquisador do Sora, Bill Peebles, disse que as capacidades do modelo emergiram da ampliação dos dados de treinamento e da computação, alinhando-se com tendências mais amplas em aprendizado de máquina e pesquisa de redes neurais.