Robocikowo>ROBOCIKOWO
Grok 4.6

Grok 4.6

4.6 · Rodzina: Grok
Model językowy xAI z rodziny Grok (premiera 12.08.2026), zoptymalizowany pod długotrwałych agentów oraz pracę wizualną i interaktywną; okno kontekstu 500K tokenów.
✓ Aktywny✓ Publiczny dostępLLMModel rozumowaniaModel używający narzędzi📁 Grok
Okno kontekstowe
500K
tokenów
Data premiery
12 sierpnia 2026
Dostęp:APIHostedWdrożenie:☁ Cloud

Przegląd

Grok 4.6 to model językowy z rodziny Grok opracowany przez xAI, udostępniony 12 sierpnia 2026 roku. Względem Grok 4.5 kładzie nacisk na długotrwałych agentów oraz bardziej ambitną pracę wizualną i interaktywną — model lepiej podtrzymuje złożone, wieloetapowe zadania (badania, analiza, nawigacja po kodzie) oraz generuje mocniejsze pierwsze wersje projektów wizualnych i interaktywnych.

Model przeszedł rozszerzone treningi uzupełniające na starannie dobranych danych generowanych przez modele, wysokiej jakości zbiorach inżynierskich i ulepszonych recepturach optymalizatora; zregenerowano trajektorie SFT w obszarach rozumowania, harnessów agentowych oraz STEM i inżynierii oprogramowania. Wyspecjalizowany trening objął optymalizację kerneli, web development i środowiska CAD.

Grok 4.6 oferuje okno kontekstu 500K tokenów, obsługuje użycie narzędzi (tool use) i jest dostępny wyłącznie zamknięcie — przez API (SpaceXAI API), a także w Cursor, Grok Build, OpenRouter, Vercel i Cloudflare. W teście Artificial Analysis Intelligence Index osiąga wynik 61, dorównując GPT-5.6 Sol.

Klasyfikacja
LLMModel rozumowaniaModel używający narzędzi
Rodzina: Grok
Dostęp i wdrożenie
APIHostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
📏 Kontekst: 500K
Narzędzia
📥 Wejście: tekst

Specyfikacja techniczna

Okno kontekstowe
500K
tokenów
Licencja
Proprietary (xAI)
Wymagania sprzętowe
Model zamknięty, dostępny wyłącznie przez chmurę/API xAI; brak wag do wdrożenia lokalnego.
Funkcje:Używanie narzędzi
Modalności
⬇ Wejście (Input)
text
⬆ Wyjście (Output)
textcode

Możliwości i zastosowania

Natywne możliwości modelu
Rozumowanie
Zdolność modelu do logicznego wnioskowania i rozwiązywania złożonych problemów.
Kategoria: reasoning
Rozumowanie wieloetapowe
Prowadzenie wieloetapowego toku rozumowania w długich, złożonych zadaniach.
Kategoria: reasoning
Programowanie
Generowanie, analizowanie i modyfikowanie kodu w wielu językach programowania. Obejmuje pisanie funkcji, debugowanie, refaktoryzację, code review, tworzenie testów. Mierzone benchmarkami takimi jak HumanEval, SWE-bench.
Kategoria: coding
Wielojęzyczność
Kompetencje w wielu językach naturalnych (od kilku do stu+): rozumienie, generowanie, tłumaczenie, code-switching w obrębie jednej rozmowy. Modele frontier obsługują szeroki wachlarz języków ze zbliżoną jakością.
Kategoria: language
Długi kontekst
Obsługa dużych okien kontekstowych — dziesiątek do setek tysięcy (lub milionów) tokenów wejścia. Umożliwia analizę całych baz kodu, długich dokumentów, wielu równolegle rozmów bez utraty wcześniejszych informacji. GPT-5.1 wspiera 400 000 tokenów.
Kategoria: language
Wyjście strukturyzowane
Generowanie danych w ustrukturyzowanych formatach, np. JSON.
Kategoria: structured_generation
Wywoływanie funkcji
Natywne wsparcie dla ustrukturyzowanego wykorzystania narzędzi, umożliwiające przepływy pracy oparte na agentach.
Kategoria: planning
Planowanie
Tworzenie i realizacja planów działania dla złożonych zadań.
Kategoria: planning

Wyniki benchmarków

5 benchmarków
Artificial Analysis Intelligence Index
61
📄 xAI — x.ai/news/grok-4-6
Dorównuje GPT-5.6 Sol.
GDPVal-AA v2
1753
📄 xAI — x.ai/news/grok-4-6
CursorBench v3.2
69.9%
📄 xAI — x.ai/news/grok-4-6
DeepSWE v1.1
65.9%
📄 xAI — x.ai/news/grok-4-6
FrontierCode v1.1
61.3%
📄 xAI — x.ai/news/grok-4-6

Cennik

Architektura techniczna