Flagowy, zunifikowany model OpenAI (premiera 07.08.2025) z routerem przełączającym między szybką odpowiedzią a głębokim rozumowaniem (GPT-5 Thinking).
✓ Aktywny✓ Publiczny dostęp★ WyróżnionyLLMModel multimodalnyModel rozumowaniaModel używający narzędzi📁 GPT
Okno kontekstowe
400K tokenów (272K wejścia + 128K wyjścia)
tokenów
Parametry
Nieujawnione publicznie
parametrów
Max output
128 000
tokenów
Data premiery
7 sierpnia 2025
Dostęp:APIHostedWdrożenie:☁ Cloud
Przegląd
Dostęp i wdrożenie
APIHostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
📏 Kontekst: 400K tokenów (272K wejścia + 128K wyjścia)
🧩 Parametry: Nieujawnione publicznie
✓ Narzędzia
📥 Wejście: tekst, obraz, dokumenty
Specyfikacja techniczna
Okno kontekstowe
400K tokenów (272K wejścia + 128K wyjścia)
tokenów
Parametry
Nieujawnione publicznie
parametrów
Max output tokens
128 000
tokenów na odpowiedź
Knowledge cutoff
30 wrz 2024
Data graniczna wiedzy
Licencja
Proprietary (OpenAI Terms of Use; ChatGPT / API commercial terms)
Wymagania sprzętowe
Nie dotyczy — model hostowany wyłącznie w OpenAI API i produktach ChatGPT. Brak wersji on-device ani lokalnej.
Funkcje:✓ Używanie narzędzi
Modalności
⬇ Wejście (Input)
textimagedocuments
⬆ Wyjście (Output)
textcodestructured_data
Możliwości i zastosowania
Natywne możliwości modelu
Rozumowanie
Zdolność modelu do logicznego wnioskowania i rozwiązywania złożonych problemów.
Kategoria: reasoning
Zaawansowane rozumowanie
Zdolność do wieloetapowego, ustrukturyzowanego rozumowania: analiza problemów, planowanie kroków, wnioskowanie na podstawie hipotez. Modele reasoning-first (np. GPT-5.1 Thinking) dedykują część inferencji na łańcuchy myślowe zanim udzielą odpowiedzi.
Kategoria: reasoning
Programowanie
Generowanie, analizowanie i modyfikowanie kodu w wielu językach programowania. Obejmuje pisanie funkcji, debugowanie, refaktoryzację, code review, tworzenie testów. Mierzone benchmarkami takimi jak HumanEval, SWE-bench.
Kategoria: coding
Kodowanie agentowe
Wielogodzinne, wieloetapowe zadania programistyczne wykonywane samodzielnie przez model: klonowanie repozytorium, uruchamianie testów, iteracja poprawek, integracja z narzędziami CLI. Charakterystyczne dla wariantów Codex (GPT-5.1-Codex-Mini, Codex-Max).
Kategoria: coding
Zdolności agentowe
Zdolność modelu do autonomicznego planowania i wykonywania wieloetapowych zadań poprzez sekwencyjne użycie narzędzi, utrzymywanie kontekstu i adaptację do wyników pośrednich.
Kategoria: planning
Długi kontekst
Obsługa dużych okien kontekstowych — dziesiątek do setek tysięcy (lub milionów) tokenów wejścia. Umożliwia analizę całych baz kodu, długich dokumentów, wielu równolegle rozmów bez utraty wcześniejszych informacji. GPT-5.1 wspiera 400 000 tokenów.
Kategoria: language
Rozumienie multimodalne
Zdolność modelu do łączenia i interpretowania informacji z więcej niż jednej modalności, np. tekstu i obrazu.
Kategoria: multimodal
Rozumienie obrazu
Analiza i interpretacja treści obrazów.
Kategoria: vision
Użycie narzędzi
Zdolność modelu do wywoływania zewnętrznych funkcji, API i narzędzi w trakcie rozmowy: kalkulator, wyszukiwarka, edytor kodu, baza danych. Model decyduje kiedy i jak użyć narzędzia oraz interpretuje jego wynik.
Kategoria: planning
Wywoływanie funkcji
Natywne wsparcie dla ustrukturyzowanego wykorzystania narzędzi, umożliwiające przepływy pracy oparte na agentach.
Kategoria: planning
Przestrzeganie instrukcji
Precyzyjne wypełnianie wskazówek zawartych w prompcie: format odpowiedzi, długość, styl, ograniczenia (np. 'odpowiedz w sześciu słowach'). GPT-5.1 znacząco poprawił tę zdolność względem GPT-5.
Kategoria: language
Rozumowanie matematyczne
Zdolność modelu do rozwiązywania zadań matematycznych wymagających wieloetapowego rozumowania — równania, dowody, kombinatoryka, geometria, rachunek różniczkowy, zadania konkursowe.
Kategoria: reasoning
Wyjście strukturyzowane
Generowanie danych w ustrukturyzowanych formatach, np. JSON.
Kategoria: structured_generation
Przeglądanie internetu
Zdolność modelu do samodzielnego wyszukiwania i przeglądania stron internetowych w celu pozyskania aktualnych informacji.
Kategoria: other
Adaptacyjny wysiłek rozumowania
Model sam decyduje ile 'myślenia' poświęcić na konkretne zapytanie: proste pytania odpowiadane szybko, złożone problemy dostają więcej cykli inferencji. Cecha GPT-5.1 (Instant i Thinking) skracająca czas dla łatwych zadań, wydłużająca dla trudnych.
Kategoria: reasoning
Wyniki benchmarków
5 benchmarków
SWE-bench
accuracy · agentic coding, with tools
74.9%
📄 OpenAI GPT-5 announcement (2025-08-07)
AIME 2025
accuracy · without tools
94.6%
📄 OpenAI GPT-5 announcement (2025-08-07)
GPQA
accuracy · without tools
85.7%
📄 OpenAI GPT-5 announcement (2025-08-07)
MMMU
accuracy · multimodal reasoning
84.2%
📄 OpenAI GPT-5 announcement (2025-08-07)
Aider Polyglot
accuracy · code editing
88%
📄 OpenAI GPT-5 announcement (2025-08-07)
Cennik
Architektura techniczna
Rdzeń architektury (Core Architecture)
Forma modelu (Model Form)
Techniki trenowania (Training Techniques)
Wdrożenie i bezpieczeństwo
🔒 Security / Enterprise
✓ Zweryfikowane informacje enterprise
GPT-5 dostępny w ChatGPT Enterprise/Team oraz API z kontrolami enterprise: brak treningu na danych klientów API/enterprise domyślnie, SOC 2, szyfrowanie w tranzycie i spoczynku, kontrola dostępu.
OpenAI deklaruje zgodność SOC 2 Type 2, szyfrowanie AES-256 (rest) i TLS 1.2+ (transit) oraz brak wykorzystywania danych biznesowych do treningu bez zgody.
Aktualizacja: 7 sie 2025↗ Dokumentacja security
