Model generowania wideo ByteDance (Seed): text-to-video i image-to-video, wieloujęciowe klipy 1080p z płynnym ruchem; wersja 2.5 (2026) — do 30 s, wiele referencji, edycja lokalna.
Data premiery
1 czerwca 2025
Dostęp:APIHostedWdrożenie:☁ Cloud
Przegląd
Dostęp i wdrożenie
APIHostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
📥 Wejście: tekst, obraz
Specyfikacja techniczna
Licencja
Proprietary
Wymagania sprzętowe
Model hostowany (chmura). Seedance 1.0: 5-sekundowe wideo 1080p generowane w ok. 41,4 s na karcie NVIDIA L20 (dzięki ~10× przyspieszeniu z destylacji). Dostępny przez API i aplikacje ByteDance oraz Volcano Engine.
Modalności
⬇ Wejście (Input)
textimage
⬆ Wyjście (Output)
video
Możliwości i zastosowania
Natywne możliwości modelu
Generowanie wideo z tekstu
Zdolność modelu do tworzenia klipów wideo bezpośrednio z opisu tekstowego (prompt), z kontrolą nad ruchem, kompozycją kadru, stylem i długością nagrania.
Kategoria: video
Animacja obrazu (image-to-video)
Zdolność modelu do animowania statycznego obrazu wejściowego — przedłużania go w czasie do spójnego klipu wideo zgodnie z opisem ruchu lub akcji.
Kategoria: video
Generowanie wideo
Zdolność modelu do generowania klipów wideo z opisu tekstowego, obrazu lub innego wideo, z kontrolą długości, rozdzielczości i charakterystyk wizualnych.
Kategoria: video
Generowanie wideo wieloujęciowego
Zdolność modelu do generowania spójnych narracyjnie sekwencji złożonych z wielu ujęć, z zachowaniem tożsamości bohaterów, stylu i ciągłości między przejściami kadrów.
Kategoria: video
Dziedziny zastosowań
Architektura techniczna
Rdzeń architektury (Core Architecture)
Techniki trenowania (Training Techniques)
