Robocikowo>ROBOCIKOWO
Seedance

Seedance

Seedance 2.5 · Rodzina: Seedance
Model generowania wideo ByteDance (Seed): text-to-video i image-to-video, wieloujęciowe klipy 1080p z płynnym ruchem; wersja 2.5 (2026) — do 30 s, wiele referencji, edycja lokalna.
✓ Aktywny✓ Publiczny dostępModel generowania wideoModel multimodalny📁 Seedance
Data premiery
1 czerwca 2025
Dostęp:APIHostedWdrożenie:☁ Cloud

Przegląd

Seedance to rodzina modeli generowania wideo opracowana przez zespół Seed w ByteDance. Pierwsza generacja, Seedance 1.0, została udostępniona w czerwcu 2025 r.; kolejne to Seedance 2.0 (luty 2026), Seedance 2.0 mini oraz Seedance 2.5 (lipiec 2026).

Modele generują wideo zarówno z opisu tekstowego (text-to-video), jak i z obrazu wejściowego (image-to-video). Seedance 1.0 tworzy nagrania w rozdzielczości 1080p z płynnym, stabilnym ruchem, bogatymi detalami i kinowym charakterem obrazu, a także natywnie obsługuje wieloujęciowe (multi-shot) opowiadanie historii z zachowaniem tożsamości bohaterów i stylu między kolejnymi ujęciami.

Pod względem technicznym modele łączą uczenie zadań text-to-video oraz image-to-video, opierając się na starannie dobranych danych i szczegółowym opisie wideo (captioning) w fazie pretreningu, a następnie na dostrajaniu nadzorowanym (SFT) i specyficznym dla wideo RLHF z wielowymiarowym mechanizmem nagród. Dzięki wieloetapowej destylacji i optymalizacjom systemowym Seedance 1.0 osiąga ok. 10× przyspieszenie inferencji — 5-sekundowe wideo 1080p powstaje w ok. 41,4 s na karcie NVIDIA L20.

Nowsze generacje rozszerzają możliwości: Seedance 2.5 generuje natywne klipy do 30 sekund z obsługą wielu referencji multimodalnych oraz oferuje lokalną edycję wybranych fragmentów sceny bez ponownego generowania całego ujęcia (tryb beta wydłuża klipy nawet do 3 minut).

Seedance to model własnościowy udostępniany przez API oraz aplikacje ByteDance (Doubao, Jimeng/Dreamina) i platformę Volcano Engine. Jakość modelu była oceniana m.in. na wewnętrznym benchmarku SeedVideoBench-1.0 oraz na platformie Artificial Analysis.

Klasyfikacja
Model generowania wideoModel multimodalny
Rodzina: Seedance
Dostęp i wdrożenie
APIHostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
📥 Wejście: tekst, obraz

Specyfikacja techniczna

Licencja
Proprietary
Wymagania sprzętowe
Model hostowany (chmura). Seedance 1.0: 5-sekundowe wideo 1080p generowane w ok. 41,4 s na karcie NVIDIA L20 (dzięki ~10× przyspieszeniu z destylacji). Dostępny przez API i aplikacje ByteDance oraz Volcano Engine.
Modalności
⬇ Wejście (Input)
textimage
⬆ Wyjście (Output)
video

Możliwości i zastosowania

Natywne możliwości modelu
Generowanie wideo z tekstu
Zdolność modelu do tworzenia klipów wideo bezpośrednio z opisu tekstowego (prompt), z kontrolą nad ruchem, kompozycją kadru, stylem i długością nagrania.
Kategoria: video
Animacja obrazu (image-to-video)
Zdolność modelu do animowania statycznego obrazu wejściowego — przedłużania go w czasie do spójnego klipu wideo zgodnie z opisem ruchu lub akcji.
Kategoria: video
Generowanie wideo
Zdolność modelu do generowania klipów wideo z opisu tekstowego, obrazu lub innego wideo, z kontrolą długości, rozdzielczości i charakterystyk wizualnych.
Kategoria: video
Generowanie wideo wieloujęciowego
Zdolność modelu do generowania spójnych narracyjnie sekwencji złożonych z wielu ujęć, z zachowaniem tożsamości bohaterów, stylu i ciągłości między przejściami kadrów.
Kategoria: video

Architektura techniczna

Rdzeń architektury (Core Architecture)
Techniki trenowania (Training Techniques)