
Model generowania muzyki od MiniMax. Na podstawie tekstu piosenki i opisu stylu tworzy kompletne utwory do 5 minut z wokalem, w formacie 32 kHz stereo.
✓ Aktywny✓ Publiczny dostęp⚖ Open weightsModel audio
Okno kontekstowe
5K tokenów (prompt)
tokenów
Parametry
8B Global LLM + 0.6B Local LLM (+ 2.4B Flow Matching, 123M Flow-VAE)
parametrów
Data premiery
7 sierpnia 2026
Dostęp:DownloadAPIHostedWdrożenie:💻 Lokalnie☁ Cloud
Przegląd
Klasyfikacja
Model audio
Zastosowania
Dostęp i wdrożenie
PobieranieAPIHostowane
LokalnieChmura
Wagi: Open weights
Kluczowe parametry
📏 Kontekst: 5K tokenów (prompt)
🧩 Parametry: 8B Global LLM + 0.6B Local LLM (+ 2.4B Flow Matching, 123M Flow-VAE)
📥 Wejście: tekst
Specyfikacja techniczna
Okno kontekstowe
5K tokenów (prompt)
tokenów
Parametry
8B Global LLM + 0.6B Local LLM (+ 2.4B Flow Matching, 123M Flow-VAE)
parametrów
Licencja
MiniMax-Music3 Community License
Wymagania sprzętowe
Inferencja wymaga GPU NVIDIA (CUDA). Obsługiwane frameworki: SGLang-Omni/SGLang, diffusers, ComfyUI. Tylko generowanie non-streaming.
Modalności
⬇ Wejście (Input)
text
⬆ Wyjście (Output)
audio
Możliwości i zastosowania
Natywne możliwości modelu
Generowanie audio
Generowanie ścieżki dźwiękowej, w tym dźwięku zsynchronizowanego z obrazem wideo.
Kategoria: audio
Generowanie muzyki
Tworzenie kompletnych utworów muzycznych (z wokalem i aranżacją) na podstawie tekstu piosenki i opisu stylu.
Kategoria: audio
Dziedziny zastosowań
Architektura techniczna
Rdzeń architektury (Core Architecture)