Robocikowo>ROBOCIKOWO
Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking

3.8 Live Extended Thinking · Rodzina: Gemini
Wariant Gemini 3.8 Live do zadań o wysokiej złożoności: głębsze, wieloetapowe rozumowanie równolegle z mową, nr 1 w Speech-to-Speech Quality Index.
✓ Aktywny✓ Publiczny dostępModel multimodalnyModel audioModel rozumowania📁 Gemini
Data premiery
15 września 2026
Dostęp:APIHostedWdrożenie:☁ Cloud

Przegląd

Gemini 3.8 Live Extended Thinking to wyższej klasy wariant modelu głosowego Gemini 3.8 Live od Google DeepMind, przeznaczony do zadań o wysokiej złożoności. Dodaje głębsze, wieloetapowe rozumowanie, które przebiega równolegle z mówieniem: model potrafi rozumować i jednocześnie mówić, wtrącać naturalne potwierdzenia („Sprawdzę to…") oraz narracyjnie relacjonować postęp zadań wieloetapowych. Zachowuje przy tym cechy wersji Live — przetwarzanie głosu i obrazu w czasie zbliżonym do rzeczywistego, 97 języków, wywoływanie narzędzi i API oraz znakowanie audio SynthID.

Udostępniony 15 września 2026 r. W benchmarkach zajmuje pierwsze miejsce w Speech-to-Speech Quality Index (82,6) według Artificial Analysis, osiąga 68,6% w τ-Voice, 35,1% w Sierra τ-Voice-banking oraz 97,7% w Big Bench Audio. Dostępny m.in. przez Gemini API i Google AI Studio, w Gemini Live i Search Live, a dla subskrybentów Google AI Pro/Ultra w Dokumentach Workspace oraz w Gmailu i Keep; w przygotowaniu wdrożenia enterprise (Gemini Enterprise). Model integrują m.in. Salesforce, ServiceNow, Genspark, Lumeris oraz platformy Agora, LiveKit i LangChain.

Klasyfikacja
Model multimodalnyModel audioModel rozumowania
Rodzina: Gemini
Dostęp i wdrożenie
APIHostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
Narzędzia
📥 Wejście: tekst, audio, obraz, wideo

Specyfikacja techniczna

Licencja
Proprietary
Funkcje:Używanie narzędzi
Modalności
⬇ Wejście (Input)
textaudioimagevideo
⬆ Wyjście (Output)
textaudio

Wyniki benchmarków

4 benchmarki
Speech-to-Speech Quality Index (Artificial Analysis)
quality index · #1 overall
82,6
📅 15 wrz 2026📄 Google DeepMind (blog)
τ-Voice (agentic task completion)
task completion
68,6%%
📅 15 wrz 2026📄 Google DeepMind (blog)
Sierra τ-Voice-banking
35,1%%
📅 15 wrz 2026📄 Google DeepMind (blog)
Big Bench Audio
97,7%%
📅 15 wrz 2026📄 Google DeepMind (blog)