Robocikowo>ROBOCIKOWO
Sztuczna Inteligencja

GPT-6 Sol i Luna: OpenAI tnie ceny API o połowę

Pan Robocik29 września 2026 · 3 min czytania
GPT-6 Sol i Luna: OpenAI tnie ceny API o połowę

OpenAI wypuściło 22 września 2026 roku GPT-6 Sol i GPT-6 Luna — dwa tańsze warianty rodziny GPT-6. Sol kosztuje 2 USD za milion tokenów wejścia i 10 USD wyjścia, Luna odpowiednio 0,10 i 0,50 USD (ok. 0,4 i 2 zł), czyli o połowę mniej niż odpowiedniki z serii 5.6. Flagowa Astra nie tanieje i zostaje na 10/50 USD.

Najważniejsze w skrócie

  • GPT-6 Sol: 2 USD za milion tokenów wejścia i 10 USD wyjścia, o 50% mniej niż GPT-5.6 Sol
  • GPT-6 Luna: 0,10 i 0,50 USD za milion tokenów, przeznaczona do zadań masowych
  • AutomationBench 1.0.6: Sol 33,2% przy 0,27 USD za zadanie, Claude Opus 5 — 26,9% przy koszcie 11 razy wyższym
  • Odczyt tokenów z cache tańszy nawet o 90%, współdzielone prefiksy ważne przez 30 minut
  • GPT-6 Astra bez zmiany ceny i nadal flagowiec rodziny

Trzy poziomy cenowe w jednej rodzinie

ModelWejścieWyjścieRola
GPT-6 Astra10 USD50 USDflagowiec, bez obniżki
GPT-6 Sol2 USD10 USDmodel roboczy
GPT-6 Luna0,10 USD0,50 USDzadania masowe
Cennik za milion tokenów, stan na dzień premiery.

Koszt na zadanie zamiast pozycji w rankingu

Benchmarki OpenAI ułożono tak, by pokazywały nie sam wynik, lecz wynik podzielony przez rachunek. Na AutomationBench 1.0.6, zestawie zadań biznesowych z 47 narzędziami, Sol uzyskał 33,2%. Claude Opus 5 zatrzymał się na 26,9%, kosztując jedenastokrotnie więcej.

0,27 USDkoszt jednego zadania dla GPT-6 Sol na AutomationBench 1.0.6, przy wyższej skuteczności niż Claude Opus 5OpenAI

W inżynierii oprogramowania dystans jest mniejszy. Na DeepSWE 1.1 Sol notuje 68,8% wobec 69,9% dla Claude Fable 5, ale przy koszcie niższym o około 80%. Luna osiąga na tym samym teście 66,6% — o 93% taniej niż Opus 5.

Obniżkę ma sfinansować caching

OpenAI tłumaczy niższe ceny usprawnieniami w cachingu i inferencji. Deweloperzy dostali jawne Breakpoint cache: Ręcznie wskazane miejsce w prompcie, od którego zaczyna się fragment wielokrotnego użytku. Pozwala sterować tym, co trafi do pamięci podręcznej., dashboard z Hit rate: Odsetek zapytań obsłużonych z pamięci podręcznej zamiast liczonych od zera. Im wyższy, tym niższy rachunek. oraz narzędzie diagnostyczne, które w odpowiedzi JSON podaje powód każdego chybienia.

W niecały tydzień nasz hit rate cache na modelach OpenAI wzrósł z około 85% do trwale ponad 90%, co dodatkowo obniżyło koszty inferencji na produkcji.

Bin Fan, Agent Team Lead w Manus.

Stałe ceny, ale baza porównania była promocyjna

Rzecznik OpenAI zapewnił VentureBeat, że stawki Sol i Luna są stałe, a nie wprowadzające. Firma porównuje je jednak do promocyjnego cennika serii 5.6, któremu od listopada 2026 zaplanowano podwyżkę o 25%.

Dlaczego to ważne?

Dwie premiery modeli frontier w jedną dobę i obie sprzedawane ceną — to przesunięcie punktu odniesienia. Laboratoria przestają licytować się surowym wynikiem, bo na szczycie rankingów różnice zeszły do pojedynczych punktów procentowych. Liczy się, ile zadań model domknie w danym budżecie. Dla zespołów budujących agentów wybór modelu staje się decyzją z zakresu inżynierii kosztów, nie prestiżu.

Co dalej?

Źródła

Udostępnij ten artykuł