Gęsty model 5B do generowania wideo od Alibaby (Tongyi Wanxiang), łączący text-to-video i image-to-video w 720p/24 fps na jednej konsumenckiej karcie; licencja Apache 2.0.
Data premiery
28 lipca 2025
Dostęp:DownloadWdrożenie:💻 Lokalnie☁ Cloud
Przegląd
Dostęp i wdrożenie
Pobieranie
LokalnieChmura
Wagi: Open source
Kluczowe parametry
📥 Wejście: tekst, obraz
Specyfikacja techniczna
Modalności
⬇ Wejście (Input)
textimage
⬆ Wyjście (Output)
video
Możliwości i zastosowania
Natywne możliwości modelu
Generowanie wideo
Zdolność modelu do generowania klipów wideo z opisu tekstowego, obrazu lub innego wideo, z kontrolą długości, rozdzielczości i charakterystyk wizualnych.
Kategoria: video
Generowanie wideo z tekstu (text-to-video)
Generowanie sekwencji wideo na podstawie opisu tekstowego (i opcjonalnie obrazu), z zachowaniem spojnej dynamiki sceny.
Kategoria: video
Animacja obrazu (image-to-video)
Zdolność modelu do animowania statycznego obrazu wejściowego — przedłużania go w czasie do spójnego klipu wideo zgodnie z opisem ruchu lub akcji.
Kategoria: video
Rozumienie multimodalne
Zdolność modelu do łączenia i interpretowania informacji z więcej niż jednej modalności, np. tekstu i obrazu.
Kategoria: multimodal
