Google udostępniło 13 sierpnia 2026 Gemini 3.7 Flash, według opisu firmy najzdolniejszy model z linii Flash, zbudowany pod złożone kodowanie i pracę z agentami. Nowy model od razu wszedł w status stabilny w dokumentacji Gemini API, a jego cennik jest identyczny jak u poprzednika.
Najważniejsze w skrócie
- Premiera 13 sierpnia 2026, status stabilny (New Stable) w dokumentacji Gemini API
- Pozycjonowany do kodowania, zadań agentowych i wieloetapowego wykonywania poleceń
- Cena wprowadzająca do 31 grudnia 2026: 0,75 USD za mln tokenów wejściowych i 3,75 USD za wyjściowych (ok. 3 zł i 15 zł)
- Od 1 stycznia 2027 stawki rosną dwukrotnie, do 1,50 USD i 7,50 USD za mln tokenów
- Trzy poziomy wysiłku rozumowania: wysoki, średni i niski (usunięto opcję minimal z 3.6 Flash)
Model pod kod i agentów
Google opisuje Gemini 3.7 Flash jako najlepszy i najzdolniejszy model z rodziny Flash, zbudowany pod złożone kodowanie, zadania agentowe?zadania agentowe: Zadania, w których model samodzielnie prowadzi dłuższa sekwencje kroków i wywołań narzędzi, zamiast udzielać jednej odpowiedzi. i niezawodne wieloetapowe wykonywanie poleceń. To czytelny sygnał, w którą stronę idzie linia Flash, ku modelom prowadzącym samodzielnie dłuższe sekwencje działań i wywołań narzędzi.
Model zachowuje trzy poziomy wysiłku rozumowania, wysoki, średni i niski. Względem Gemini 3.6 Flash wypadła opcja minimal, co sugeruje, że Google celuje w zadania wymagające realnego rozumowania, a nie tylko szybkich odpowiedzi. Model pozostaje multimodalny i obsługuje narzędzia po stronie serwera, w tym wykonywanie kodu.
Cena bez zmian względem poprzednika
Wbrew oczekiwaniom obniżki, cennik Gemini 3.7 Flash jest taki sam jak dla Gemini 3.6 Flash. W okresie wprowadzającym, do 31 grudnia 2026, model kosztuje 0,75 USD za milion tokenów?tokeny: Podstawowa jednostka tekstu przetwarzana przez model, fragment słowa lub znaki. Cennik modeli liczy się za miliony tokenów. wejściowych i 3,75 USD za milion wyjściowych (ok. 3 zł i 15 zł). Od 1 stycznia 2027 obie stawki się podwoją, do 1,50 USD i 7,50 USD.
| Okres | Wejście | Wyjście |
|---|---|---|
| Do 31 grudnia 2026 | 0,75 USD | 3,75 USD |
| Od 1 stycznia 2027 | 1,50 USD | 7,50 USD |
To istotny niuans. Google podnosi możliwości modelu Flash, nie zmieniając ceny wejścia, co oznacza lepszy stosunek jakości do kosztu za ten sam budżet na tokeny.
Gdzie działa
Model jest dostępny w Gemini API oraz w Google AI Studio jako wersja stabilna. Wsparcie pojawiło się też szybko poza ekosystemem Google, wtyczka llm-gemini w wersji 0.33 dodała obsługę identyfikatora gemini-3.7-flash.
Dlaczego to ważne?
Utrzymanie ceny przy wzroście możliwości to cichy, ale znaczący ruch. Rywalizacja w segmencie tanich, szybkich modeli nie toczy się już wyłącznie o najniższą stawkę za token, lecz o to, ile realnej pracy agentowej model wykona za ten sam koszt. Kierując linię Flash w stronę kodowania i zadań wieloetapowych, Google mierzy w najszybciej rosnące zastosowanie, autonomicznych agentów prowadzących sekwencje wywołań narzędzi. To przesuwa oś konkurencji z ceny na jakość wykonania.
Co dalej?
- Cena wprowadzająca obowiązuje do 31 grudnia 2026, od 1 stycznia 2027 stawki za tokeny podwoją się do 1,50 USD i 7,50 USD za milion, według cennika Gemini API
- Model jest już stabilny w Gemini API i Google AI Studio, więc kolejnym testem będzie realna adopcja w narzędziach agentowych i porównania z konkurencyjnymi modelami do kodu
Źródła
- Google AI for Developers, Gemini API pricing
- Google AI for Developers, Gemini API models
- Simon Willison's Weblog, llm-gemini 0.33





