OpenAI zaprezentowało 13 sierpnia 2026 tryb Ultrafast dla modelu GPT-5.6 Sol, który ma działać 14 razy szybciej niż standardowe przetwarzanie i generować do 750 tokenów wyjściowych na sekundę. Funkcja działa na chipach firmy Cerebras i na razie jest dostępna w wersji preview dla wąskiej grupy klientów.
Najważniejsze w skrócie
- Zapowiedź 13 sierpnia 2026, tryb Ultrafast dla GPT-5.6 Sol
- Deklarowana szybkość: 14x wobec standardowego przetwarzania
- Przepustowość do 750 tokenów wyjściowych na sekundę
- Sprzętowym zapleczem są układy firmy Cerebras
- Dostępność: preview dla wąskiej grupy klientów, z rozszerzaniem w miarę wzrostu mocy
Szybkość zamiast mniejszego modelu
OpenAI pozycjonuje Ultrafast jako sposób na uzyskanie odpowiedzi w czasie zbliżonym do rzeczywistego bez schodzenia na słabszy model. Tryb działa na pełnym GPT-5.6 Sol, a nie na jego okrojonej wersji.
Do tej pory uzyskanie prędkości w czasie rzeczywistym zwykle oznaczało wybór mniejszego lub bardziej wyspecjalizowanego modelu. Ultrafast wskazuje nowy kierunek: więcej użytecznej pracy na sekundę.
Komunikat OpenAI cytowany przez TechCrunch.
Deklarowane 14-krotne przyspieszenie i do 750 tokenów na sekundę to liczby, które mają znaczenie zwłaszcza tam, gdzie liczy się czas reakcji. OpenAI wskazuje reagowanie na incydenty, obsługę klienta, analizę rynków finansowych i handel elektroniczny jako główne zastosowania.
Rola Cerebras i konkurencja
Zapleczem sprzętowym trybu są układy firmy Cerebras, wyspecjalizowane w bardzo szybkim wnioskowaniu?wnioskowanie: Faza, w której gotowy model generuje odpowiedzi na podstawie wejścia, w odróżnieniu od treningu.. To odróżnia Ultrafast od standardowej infrastruktury, na której działa większość modeli OpenAI. Dla wielu zastosowań liczy się nie tyle średni czas odpowiedzi, co płynność strumienia, przy 750 tokenach na sekundę dłuższa odpowiedź pojawia się niemal natychmiast, zamiast budować się na oczach użytkownika. Szybkie tryby nie są przy tym nowością na rynku, Anthropic oferuje szybki tryb dla modeli Claude, choć OpenAI deklaruje wyższą prędkość.
Dlaczego to ważne?
Prędkość generowania staje się osobną osią rywalizacji w AI, obok jakości i ceny. Dla zastosowań takich jak obsługa klienta czy reakcja na incydenty opóźnienie bywa ważniejsze niż ostatnie punkty w benchmarku, użytkownik czeka na odpowiedź w czasie rzeczywistym. Oparcie trybu na wyspecjalizowanym sprzęcie Cerebras pokazuje, że dalsze skoki wydajności coraz częściej pochodzą nie z samego modelu, lecz z warstwy sprzętowej pod nim. Jeśli OpenAI utrzyma pełną jakość modelu przy takiej prędkości, przesunie próg tego, co uchodzi za pracę w czasie rzeczywistym.
Co dalej?
- Dostęp ma być rozszerzany w miarę wzrostu dostępnej mocy obliczeniowej, według OpenAI, obecnie tryb jest w preview dla wąskiej grupy klientów
- Brak podanej ceny trybu Ultrafast, warunki cenowe będą kluczowe dla adopcji w zastosowaniach o dużej skali





