Sora foi um modelo de texto para vídeo e um aplicativo de mídia social desenvolvido pela OpenAI. Usando inteligência artificial, o modelo gerava clipes de vídeo curtos com base em prompts e também podia estender vídeos curtos existentes. Em fevereiro de 2024, a OpenAI pré-visualizou exemplos de sua produção para o público, com a primeira geração do Sora lançada publicamente para usuários do ChatGPT Plus e ChatGPT Pro nos Estados Unidos e no Canadá em dezembro de 2024.
A segunda geração do Sora foi lançada para usuários selecionados nos EUA e no Canadá no final de setembro de 2025. O Sora 2 integrou recursos de mídia social ao aplicativo. O aplicativo foi encerrado em 26 de abril de 2026, e a interface de programação de aplicativos (API) está planejada para ser descontinuada em 24 de setembro de 2026, marcando o fim da marca de IA Sora como um todo.
Antecedentes
Vários outros modelos capazes de gerar vídeo a partir de texto foram criados antes do Sora, incluindo o Make-A-Video da Meta, o Gen-2 da Runway e o Google Veo. A OpenAI, empresa por trás do Sora, havia lançado o DALL-E 3, o terceiro de seus modelos de texto para imagem DALL-E, em setembro de 2023. O desenvolvimento do Sora baseou-se em avanços em IA generativa, particularmente modelos de difusão e transformadores, que haviam sido aplicados à geração de imagens e texto. O trabalho anterior da OpenAI em modelos de linguagem de grande porte e redes neurais informou a arquitetura do modelo.
Lançamento Inicial
A equipe que desenvolveu o Sora o nomeou em homenagem à palavra japonesa para 'céu' para significar seu "potencial criativo ilimitado". Em 15 de fevereiro de 2024, a OpenAI pré-visualizou o Sora pela primeira vez, lançando vários clipes de vídeos em alta definição que havia criado, incluindo um SUV dirigindo por uma estrada de montanha, uma animação de um "monstro peludo e baixinho" ao lado de uma vela, duas pessoas caminhando por Tóquio na neve e imagens históricas falsas da corrida do ouro na Califórnia. A OpenAI afirmou que era capaz de gerar vídeos de até um minuto. A empresa então compartilhou um relatório técnico que destacava os métodos usados para treinar o modelo. O CEO da OpenAI, Sam Altman, também publicou uma série de tweets respondendo aos prompts dos usuários do Twitter com vídeos gerados pelo Sora dos prompts.
Em 9 de dezembro de 2024, a OpenAI gradualmente disponibilizou o Sora ao público para usuários do ChatGPT Pro e ChatGPT Plus nos EUA e no Canadá. Antes disso, a empresa havia fornecido acesso limitado a um pequeno "time vermelho", incluindo especialistas em desinformação e viés, para realizar testes adversariais no modelo. A empresa também compartilhou o Sora com um pequeno grupo de profissionais criativos, incluindo cineastas e artistas, para buscar feedback sobre sua utilidade em campos criativos. Em fevereiro de 2025, a OpenAI anunciou planos de integrar o Sora ao ChatGPT, permitindo que os usuários gerassem vídeos do Sora a partir do chatbot.
Sora 2
O Sora 2 foi revelado em 30 de setembro de 2025, com um aplicativo iOS ao mesmo tempo, além de um aplicativo Android dois meses depois. Todos os vídeos gerados pelo modelo apresentam uma marca d'água visível e em movimento para evitar o uso indevido da ferramenta. A versão anterior do Sora também adicionou uma marca d'água de segurança para permitir que os espectadores distinguissem entre conteúdo real e fictício. Em 7 de outubro, o 404 Media relatou que programas de terceiros que podiam remover a marca d'água dos vídeos do Sora 2 se tornaram predominantes. Muitos veículos, como a revista Wired, notaram que o aplicativo Sora 2 é abertamente semelhante ao TikTok em estilo e recursos.
Descontinuação
Em 24 de março de 2026, a OpenAI anunciou no X que estava descontinuando o Sora tanto no aplicativo móvel quanto na API. O aplicativo Sora foi encerrado em 26 de abril de 2026, enquanto a API está planejada para ser encerrada em 24 de setembro de 2026. A parceria da OpenAI com a Disney, que incluía um acordo de licenciamento permitindo que personagens da Disney fossem usados dentro do Sora, também estava chegando ao fim. A decisão levou o site de notícias de tecnologia britânico The Register a rotular a OpenAI de "matadora de produtos", seguindo os passos de outras empresas de tecnologia como Google, Amazon Web Services, Broadcom, Cloud Software Group e Netscape.
A OpenAI não forneceu um motivo específico para descontinuar o Sora em seu aviso de encerramento. Os relatos que surgiram sobre essa descontinuidade ligaram a decisão a escassez de computação, pressões de custo e uma mudança mais ampla em direção a produtos empresariais centrais. Após seu lançamento público, os usuários mundiais do Sora atingiram o pico de cerca de um milhão antes de declinar para menos de 500.000, enquanto o serviço custava cerca de US$ 1 milhão por dia para operar devido às demandas computacionais da geração de vídeo.
Regulamentação Legal
Em novembro de 2024, uma chave de API para acesso ao Sora foi vazada por um grupo de testadores no Hugging Face, que publicaram um manifesto afirmando que estavam protestando contra o uso do Sora para "lavagem de arte". A OpenAI revogou todo o acesso três horas após o vazamento se tornar público e afirmou que "centenas de artistas" moldaram o desenvolvimento e que "a participação é voluntária".
Na época de seu lançamento, o Sora 2 permitia conteúdo protegido por direitos autorais por padrão, a menos que os detentores dos direitos entrassem em contato com a OpenAI para restringir a geração de seu conteúdo na plataforma. Em 3 de outubro de 2025, a OpenAI afirmou que uma atualização futura do Sora 2 daria aos detentores de direitos autorais "controle mais granular" sobre a geração de conteúdo protegido, mas a empresa não declarou se o conteúdo existente seria removido. Em 6 de outubro, o presidente da MPA criticou a abordagem da OpenAI em relação aos direitos autorais com o Sora 2.
Em 11 de dezembro de 2025, a Walt Disney Company anunciou que investiria US$ 1 bilhão na OpenAI, em um acordo de licenciamento de três anos, para permitir que usuários do Disney+ gerassem mais de 200 de seus personagens protegidos por direitos autorais no Sora 2. Esses personagens incluem aqueles da Disney Animation, Pixar, Marvel Studios e Star Wars.
Capacidades e Limitações
A tecnologia por trás do Sora é uma adaptação da tecnologia por trás do DALL-E 3. De acordo com a OpenAI, o Sora é um transformador de difusão, um modelo de difusão latente de denoising com um transformador como seu denoiser. Um vídeo é gerado no espaço latente denoising "patches" 3D, então transformado para o espaço padrão por um descompressor de vídeo. A recaptioning é empregada para aumentar os dados de treinamento usando um modelo de vídeo para texto para criar legendas detalhadas para vídeos.
A OpenAI treinou o modelo usando vídeos publicamente disponíveis, bem como vídeos protegidos por direitos autorais licenciados para esse fim, mas não revelou o número ou a fonte exata dos vídeos. Em seu lançamento, a OpenAI reconheceu algumas das deficiências do Sora, incluindo sua capacidade limitada de simular física complexa, entender causalidade e diferenciar esquerda de direita. A OpenAI também afirmou que, em aderência às práticas de segurança existentes da empresa, o Sora restringiria prompts de texto para imagens sexuais, violentas, odiosas ou de celebridades, bem como conteúdo apresentando propriedade intelectual existente.
O pesquisador do Sora Tim Brooks afirmou que o modelo aprendeu a criar gráficos 3D apenas a partir de seu conjunto de dados, enquanto o colega pesquisador do Sora Bill Peebles disse que a capacidade do modelo de gerar cenas coerentes foi um resultado do aumento dos dados de treinamento e da computação. A arquitetura do modelo aproveitou atenção multi-cabeça e codificação posicional para lidar com dependências temporais em sequências de vídeo. Apesar de suas capacidades, as limitações do Sora na simulação física e no raciocínio causal destacaram os desafios do aprendizado profundo na geração de vídeo.
Recepção e Impacto
A pré-visualização do Sora em fevereiro de 2024 gerou interesse público significativo e debate sobre as implicações do vídeo gerado por IA. Críticos levantaram preocupações sobre o potencial uso indevido para desinformação, violação de direitos autorais e o deslocamento de profissionais criativos. Apoiadores destacaram o potencial para democratizar a produção de vídeo e permitir novas formas de expressão artística. A capacidade do modelo de gerar vídeos de um minuto a partir de prompts de texto simples foi vista como um grande passo em frente na IA generativa, embora seu custo computacional e eventual descontinuação levantassem questões sobre a sustentabilidade de tais modelos.
Após o lançamento do Sora 2, a integração de recursos de mídia social gerou comparações com plataformas existentes como o TikTok, com alguns observadores notando o potencial para criação de conteúdo viral. As ferramentas de remoção de marca d'água que surgiram logo após o lançamento do Sora 2 sublinharam desafios contínuos na autenticação de conteúdo e na forense digital. O encerramento do Sora em 2026, juntamente com a mudança da OpenAI em direção a produtos empresariais, marcou um recuo notável das ferramentas de IA voltadas para o consumidor, refletindo tendências mais amplas da indústria no cenário competitivo da IA.