Robocikowo>ROBOCIKOWO
Sztuczna Inteligencja

OpenAI tnie ceny GPT-5.6 Luna o 80% — poniżej Gemini Flash-Lite

Pan Robocik1 sierpnia 2026 · 3 min czytania
OpenAI tnie ceny GPT-5.6 Luna o 80% — poniżej Gemini Flash-Lite

OpenAI obniżył 30 lipca 2026 roku ceny modeli z rodziny GPT-5.6 — o 80% dla wariantu Luna i o 20% dla Terra. Po zmianie Luna kosztuje 0,20 USD za milion tokenów wejściowych i 1,20 USD za milion wyjściowych, schodząc poniżej najtańszych ofert Google i Anthropic. Sprawę opisał Simon Willison.

Najważniejsze w skrócie

  • GPT-5.6 Luna: 0,20 USD (ok. 0,80 zł) za mln tokenów wejściowych i 1,20 USD (ok. 4,80 zł) za mln wyjściowych.
  • Obniżka Luny to 80%, wariantu Terra — 20%.
  • Luna schodzi poniżej Gemini 3.1 Flash-Lite (wcześniej 0,25 / 1,50 USD).
  • Za wejście Luna jest pięciokrotnie tańsza niż Claude Haiku 4.5 (1 / 5 USD).
  • Obniżkę umożliwił model GPT-5.6 Sol, który sam optymalizował inferencję.

Co się zmieniło w cenniku

Najmocniejszy ruch dotyczy Luny — najtańszego modelu w rodzinie. Nowa stawka 0,20 USD za milion tokenów wejściowych i 1,20 USD za milion wyjściowych ustawia go poniżej dotychczasowego lidera cenowego w tej klasie. Terra, mocniejszy wariant, potaniał o 20%. To nie jest promocja czasowa, lecz zmiana cennika bazowego API.

−80%obniżka ceny GPT-5.6 Luna — do 0,20 USD za milion tokenów wejściowychOpenAI

Jak wypada na tle konkurencji

Do tej pory najtańszą opcją w segmencie lekkich modeli był Gemini 3.1 Flash-Lite z ceną 0,25 USD za wejście i 1,50 USD za wyjście. Luna schodzi poniżej obu tych wartości. Różnica względem Anthropic jest jeszcze wyraźniejsza: Claude Haiku 4.5 kosztuje 1 USD za wejście i 5 USD za wyjście, więc Luna jest za tokeny wejściowe pięciokrotnie tańsza. Dla zastosowań przetwarzających duże ilości tekstu — agentów, klasyfikacji, wyszukiwania — to różnica, która realnie przesuwa rachunek.

ModelWejścieWyjście
GPT-5.6 Luna0,201,20
Gemini 3.1 Flash-Lite0,251,50
Claude Haiku 4.51,005,00
Ceny w USD za milion tokenów po obniżce (30 lipca 2026).

Skąd wzięła się obniżka

OpenAI podaje, że do obcięcia kosztów użył własnego modelu GPT-5.6 Sol, który autonomicznie przepisywał jądra obliczeniowe w językach Triton i Gluon. Celem było usunięcie zbędnego ruchu danych w pamięci, nadmiarowej synchronizacji i nieefektywnych układów danych, które zostawiają procesory graficzne bezczynne. Efekt to około 20% niższy całkowity koszt obsługi zapytań. Innymi słowy: część oszczędności pochodzi nie z tańszego sprzętu, lecz z AI optymalizującej infrastrukturę AI.

Simon Willison ocenił, że ruch całkowicie zmienia układ sił w segmencie tańszych modeli, i przeniósł swoje demo agenta z Gemini 3.1 Flash-Lite na Lunę.

Dlaczego to ważne?

Cena modeli lekkich decyduje o tym, co w ogóle opłaca się budować. Przy stawce 0,20 USD za milion tokenów wejściowych zastosowania, które przy droższych modelach nie miały sensu ekonomicznego — masowa klasyfikacja, agenci przetwarzający długie konteksty, potoki analizy dokumentów — nagle stają się realne. Fakt, że obniżkę napędza autonomiczna optymalizacja inferencji, ma drugie dno: jeśli model potrafi samodzielnie usprawniać własne serwowanie, granica opłacalności może przesuwać się szybciej, niż wynikałoby z postępu sprzętowego. Dla konkurencji to presja nie tylko cenowa, lecz metodologiczna — Google i Anthropic muszą odpowiedzieć nie kolejną promocją, ale własnym zyskiem na wydajności. Dla użytkowników oznacza to, że wybór taniego modelu przestaje być kompromisem na rzecz budżetu.

Co dalej?

  • Nowe ceny GPT-5.6 Luna i Terra obowiązują w API OpenAI od 30 lipca 2026 roku.
  • Presja cenowa może wymusić odpowiedź Google i Anthropic w segmencie modeli lekkich.

Źródła

Udostępnij ten artykuł