Efektywny kosztowo model głosowy Google — konwersacja i wizualne uziemienie w czasie zbliżonym do rzeczywistego, 97 języków, znakowanie audio SynthID.
Data premiery
15 września 2026
Dostęp:APIHostedWdrożenie:☁ Cloud
Przegląd
Dostęp i wdrożenie
APIHostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
✓ Narzędzia
📥 Wejście: tekst, audio, obraz, wideo
Specyfikacja techniczna
Licencja
Proprietary
Funkcje:✓ Używanie narzędzi
Modalności
⬇ Wejście (Input)
textaudioimagevideo
⬆ Wyjście (Output)
textaudio
Wyniki benchmarków
1 benchmark
Speech Agent Arena
2. miejsce
📅 15 wrz 2026📄 Google DeepMind (blog)
Model reklamowany jako wysoce opłacalny; drugie miejsce w rankingu.
Źródła i powiązane strony
1 źródło
Przeglądaj powiązane tematy
