Seedance 2.5는 중국 기술 기업 바이트댄스(ByteDance)가 개발한 인공지능 생성 모델이다. 2025년에 출시된 이 모델은 텍스트 프롬프트에서 비디오 및 이미지 콘텐츠를 생성하며, 생성형 AI 분야의 더 넓은 범주에 위치한다. 2026년 초 기준으로 Wikirating 플랫폼의 1,095개 프롬프트가 Seedance 2.5를 언급하고 있어, 해당 서비스 사용자들 사이에서의 채택을 나타낸다.
이 모델은 Seedance 시리즈의 비디오 생성 모델을 포함하는 바이트댄스의 멀티모달 AI 분야 초기 작업을 기반으로 한다. Seedance 2.5는 자연어 설명에서 시간적으로 일관된 프레임 시퀀스를 생성하는 작업인 텍스트-비디오 합성을 개선한 반복 버전을 대표한다. 이 모델은 이미지 생성도 지원하여 콘텐츠 제작자를 위한 이중 목적 도구로 기능한다.
기능
Seedance 2.5는 텍스트 프롬프트를 입력받아 비디오 클립 또는 정적 이미지를 출력한다. 비디오 생성 기능은 가변 지속 시간을 지원하며, 보고된 출력 길이는 구성에 따라 수 초에서 1분 이상까지 다양하다. 이 모델은 영어와 중국어를 포함한 여러 언어의 프롬프트를 처리하여 바이트댄스의 국제적 사용자 기반을 반영한다.
이미지 생성의 경우 Seedance 2.5는 최대 4K 해상도의 고해상도 정지 이미지를 생성한다. 이 모델은 딥러닝 아키텍처를 사용하며, 트랜스포머 기반 텍스트 인코더와 확산 기반 시각적 디코더를 통합한다 - 이는 현대 생성 모델에서 흔한 설계이다. 이러한 조합을 통해 모델은 객체 배치, 조명, 움직임과 같은 시각적 세부 사항과 텍스트 의미를 정렬할 수 있다.
기술 아키텍처
바이트댄스는 Seedance 2.5에 대한 완전한 기술 논문을 발표하지 않았지만, 이 모델은 텍스트 처리를 위한 멀티 헤드 어텐션 메커니즘과 비디오 프레임 합성을 위한 U-net 스타일 잡음 제거 네트워크를 포함하는 신경망 프레임워크를 사용하는 것으로 이해된다. 이 모델은 크로스 어텐션 레이어를 적용하여 입력 텍스트에 시각적 생성을 조건화하고, 장면 구성에 대한 세밀한 제어를 가능하게 한다.
Seedance 2.5는 또한 다양한 프롬프트에 대한 견고성을 향상시키기 위해 훈련 중 데이터 증강 기법을 통합한다. 훈련 데이터 세트에는 라이선스된 비디오 및 이미지 코퍼스가 포함되지만, 구체적인 출처와 규모는 공개되지 않았다. 이 모델은 추론 중 top-p 샘플링과 온도 스케일링을 사용하여 출력 다양성과 결정성을 제어하며, 사용자가 창의성과 충실도 사이를 조정할 수 있게 한다.
출시 및 가용성
Seedance 2.5는 2024년에 출시된 초기 Seedance 모델에 이어 2025년에 출시되었다. 바이트댄스는 개발자와 기업을 위한 API 액세스를 제공하는 Volcano Engine 클라우드 플랫폼을 통해 이 모델을 제공한다. 이 출시에는 표준 버전과 소비자급 하드웨어에서 더 빠른 추론을 위해 최적화된 경량 변형이 모두 포함된다.
API 가격은 사용량 기반이며, 생성된 비디오 초당 또는 이미지당 비용이 계산된다. 2026년 기준으로 이 모델은 중국, 미국, 유럽 일부 지역을 포함한 특정 지역에서 사용 가능하며, 현지 규제 준수에 따라 달라진다. 바이트댄스는 모델 가중치를 오픈소스로 공개하지 않아 Seedance 2.5는 독점 제공물로 남아 있다.
성능 및 평가
바이트댄스가 발표한 벤치마크에 따르면 Seedance 2.5는 FVD(Fréchet Video Distance) 및 CLIP 점수를 포함한 표준 비디오 생성 지표에서 전작보다 각각 약 15% 및 8% 우수한 성능을 보인다. 제3자 연구 그룹의 독립적 평가는 특히 시간적 일관성과 프롬프트 준수 측면에서 이러한 개선을 뒷받침한다.
모델을 언급하는 1,095개 프롬프트가 있는 Wikirating과 같은 플랫폼의 사용자 피드백은 사실적인 움직임과 복잡한 장면 생성에서의 강점을 강조한다. 일부 사용자는 빠르게 움직이는 시퀀스에서 가끔 발생하는 아티팩트를 보고하며, 이는 현재 비디오 생성 모델의 일반적인 한계이다. 이 모델의 이미지 생성 기능은 사실적인 스타일부터 애니메이션 스타일까지 다양한 스타일을 지원하는 스타일적 다양성으로 칭찬을 받았다.
다른 모델과의 비교
Seedance 2.5는 오픈AI 및 구글 딥마인드의 모델과 같은 다른 텍스트-비디오 모델과 경쟁한다. 비디오에만 전적으로 초점을 맞춘 OpenAI의 Sora와 달리 Seedance 2.5는 이미지 생성을 동일한 프레임워크에 통합하여 통합 인터페이스를 제공한다. Google DeepMind의 Veo 시리즈와 비교하여 Seedance 2.5는 표준 구성에서 더 긴 출력 지속 시간을 지원하지만, Veo는 일부 설정에서 더 높은 최대 해상도를 제공한다.
이 모델은 접근성에서도 차이가 있다. 경쟁사가 종종 대기자 명단 액세스나 기업 계약을 요구하는 반면, Seedance 2.5는 종량제 모델의 공개 API를 통해 제공되어 독립 개발자에게 진입 장벽을 낮춘다. 이러한 접근 방식은 1,095개의 Wikirating 프롬프트에 반영된 채택에 기여했다.
향후 개발
바이트댄스는 오디오 생성과 대화형 편집을 통합할 Seedance 3.0 계획과 함께 Seedance 라인에 대한 지속적인 투자를 시사했다. 회사는 또한 Doubao 챗봇과 같은 대규모 언어 모델 제공과의 통합을 탐색하여 대화형 비디오 생성을 가능하게 하고 있다. 2026년 초 기준으로 이러한 기능에 대한 출시 날짜는 발표되지 않았다.