SpaceXAI udostępniło 21 września 2026 roku Grok 4.7. Model podniósł wynik w indeksie Artificial Analysis z 44 do 46 punktów, ale zużywa na zadanie około 81 tys. tokenów wyjścia wobec 36 tys. u poprzednika. Cena pozostała bez zmian: 2 USD za milion tokenów wejścia i 6 USD wyjścia (ok. 8 i 24 zł).
Najważniejsze w skrócie
- AA Intelligence Index: 46 punktów wobec 44 dla Grok 4.6 — pierwsza czwórka laboratoriów
- Około 81 tys. tokenów wyjścia na zadanie, 2,25 raza więcej niż Grok 4.6
- Cennik bez zmian: 2 USD za milion tokenów wejścia, 6 USD wyjścia
- Terminal-Bench 4.0: 37,6% według SpaceXAI, 26% w standardowym harnessie Artificial Analysis
- Okno kontekstu 500 tys. tokenów — tyle samo co w Grok 4.6 i 4.5
Dwa punkty wyżej, ponad dwa razy więcej tokenów
Grok 4.7 to nowy, większy model bazowy z dłuższym przebiegiem uczenia ze wzmocnieniem, nastawionym na zadania zajmujące wiele godzin. Artificial Analysis potwierdza postęp w kodowaniu: Coding Agent Index rośnie z 47 do 56 punktów, DeepSWE v1.1 z 65% do 73%, a Terminal-Bench 4.0 z 18% do 33%. Rozbieżność z wynikiem oficjalnym bierze się z innego harnessu?Harness: Warstwa pośrednicząca między modelem a zadaniem: pętla wywołań, narzędzia i podpowiedzi systemowe. Ten sam model w innym harnessie osiąga inny wynik. — SpaceXAI mierzy we własnym Grok Build.
Pojawiły się też regresje: AA-LCR spada o 3,7 punktu procentowego, AutomationBench-AA o 1,1.
Znaczenie symboli
- …
- koszt tokenów wyjścia jednego zadania
- …
- cena tokena wyjścia (6 USD za milion)
- …
- liczba tokenów wyjścia (81 tys. dla Grok 4.7, 36 tys. dla Grok 4.6)
Musk obniżał oczekiwania tydzień przed premierą
Poprzeczkę ustawił nisko sam szef firmy, jeszcze zanim model trafił do użytkowników.
Grok 4.7 powinien być mniej więcej na poziomie Opusa 5.0, nie 5.1. W niektórych rzeczach lepszy, w innych gorszy. Musimy naprawić działanie multimodalne.
Elon Musk, założyciel SpaceXAI, wpis z 14 września 2026 roku.
Grok 4.7 should be roughly on par with Opus 5.0, not 5.1. Better in some ways, worse in others. We need to fix multimodal performance. Grok 4.8 will be a noticeable improvement. Grok 4.9 is probably Astra/Fable class. Grok 5 maybe better than anything. We shall see.
Po premierze przyznał, że w kodowaniu agentowym firma jest trzecia — za Anthropic i OpenAI.
Przewaga cenowa trwała jeden dzień
Stawka 2 i 6 USD czyniła model najtańszym w klasie frontier. Nazajutrz Anthropic wypuściło Claude Opus 5.5, a OpenAI modele GPT-6 Sol i Luna, tnąc ceny o połowę — GPT-6 Sol kosztuje dziś na wejściu dokładnie tyle samo. Grok 4.7 zostaje z 46 punktami, na równi z modelem MiMo-V2.6-Pro od Xiaomi.
| Model | Wejście | Wyjście | AA Index |
|---|---|---|---|
| Claude Opus 5.5 | 4 USD | 20 USD | 58 |
| Claude Fable 5.1 | 10 USD | 50 USD | 53 |
| GPT-6 Astra | 10 USD | 50 USD | 53 |
| GPT-6 Sol | 2 USD | 10 USD | 48 |
| Grok 4.7 | 2 USD | 6 USD | 46 |
| GPT-6 Luna | 0,10 USD | 0,50 USD | — |
Parametry API Grok 4.7:
Dlaczego to ważne?
Token jest jednostką rozliczeniową, nie miarą jakości. Model tańszy w przeliczeniu na tysiąc tokenów potrafi wyjść drożej na ukończonym zadaniu, jeśli potrzebuje ich dwa razy więcej — i dokładnie to widać w tym przypadku. Dla zespołów liczących koszt pracy agenta, a nie pozycje cennika, deklarowana obniżka bywa fikcją. Wojna cenowa ma sens dopiero wtedy, gdy porównuje się rachunek za zamknięte zadanie.
Co dalej?
- Musk zapowiedział, że Grok 4.8 przyniesie zauważalną poprawę, a Grok 4.9 będzie modelem klasy Astra/Fable
- Wariant Grok 4.7 Fast pozostaje poza publicznym API — jest dostępny wyłącznie w Cursor oraz Grok Build
- Liczba parametrów i skład danych treningowych nie zostały ujawnione przez producenta
Źródła
- SpaceXAI — Introducing Grok 4.7
- Artificial Analysis — Benchmarking Grok 4.7
- The Decoder — xAI launches Grok 4.7 at bargain prices, but benchmarks reveal a wide gap to Claude and GPT-6
- 机器之心 — 刚刚,SpaceXAI最强Grok 4.7发布!价格杀疯,跑分令人失望






