Robocikowo>ROBOCIKOWO
Gemini 3.8 Live

Gemini 3.8 Live

3.8 Live · Rodzina: Gemini
Efektywny kosztowo model głosowy Google — konwersacja i wizualne uziemienie w czasie zbliżonym do rzeczywistego, 97 języków, znakowanie audio SynthID.
✓ Aktywny✓ Publiczny dostępModel multimodalnyModel audioModel audio📁 Gemini
Data premiery
15 września 2026
Dostęp:APIHostedWdrożenie:☁ Cloud

Przegląd

Gemini 3.8 Live to efektywny kosztowo model głosowy Google DeepMind, łączący inteligencję konwersacyjną, płynny dialog i wizualne uziemienie (visual grounding), zaprojektowany z myślą o skali. Przetwarza wejścia głosowe i wizualne w czasie zbliżonym do rzeczywistego, obsługuje 97 języków z automatycznym wykrywaniem i przełączaniem języka w trakcie rozmowy, potrafi wywoływać narzędzia i API oraz wykonywać zadania w tle bez przerywania dialogu. Całe generowane audio jest znakowane technologią SynthID.

Model został udostępniony 15 września 2026 r. — dla deweloperów przez Gemini API i Google AI Studio, a dla użytkowników m.in. w Search Live. Reklamowany jest jako wysoce opłacalny; w rankingu Speech Agent Arena zajął drugie miejsce. Wśród wariantu wyższej klasy występuje Gemini 3.8 Live Extended Thinking, przeznaczony do zadań o wysokiej złożoności.

Klasyfikacja
Model multimodalnyModel audioModel audio
Rodzina: Gemini
Dostęp i wdrożenie
APIHostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
Narzędzia
📥 Wejście: tekst, audio, obraz, wideo

Specyfikacja techniczna

Licencja
Proprietary
Funkcje:Używanie narzędzi
Modalności
⬇ Wejście (Input)
textaudioimagevideo
⬆ Wyjście (Output)
textaudio

Wyniki benchmarków

1 benchmark
Speech Agent Arena
2. miejsce
📅 15 wrz 2026📄 Google DeepMind (blog)
Model reklamowany jako wysoce opłacalny; drugie miejsce w rankingu.