Robocikowo>ROBOCIKOWO
GPT-6.1 Sol

GPT-6.1 Sol

6.1 Sol (gpt-6.1-sol) · Rodzina: GPT
Model AI OpenAI z rodziny GPT (linia Sol); wydajność zbliżona do GPT-6 Astra przy niższym koszcie, nastawiony na złożone programowanie, obsługę komputera i pracę zawodową.
✓ Aktywny✓ Publiczny dostępLLMModel multimodalnyModel rozumowaniaModel używający narzędzi📁 GPT
Okno kontekstowe
1.05M
tokenów
Max output
128 000
tokenów
Dostęp:APIWdrożenie:☁ Cloud

Przegląd

GPT-6.1 Sol to model AI firmy OpenAI należący do rodziny GPT i linii „Sol”. OpenAI pozycjonuje go jako wariant oferujący wydajność zbliżoną do flagowego GPT-6 Astra przy niższym koszcie, ukierunkowany na złożone programowanie, obsługę komputera (computer use) i pracę zawodową. Jest to rewizja (6.1) modelu GPT-6 Sol, którego linia zadebiutowała 22 września 2026 roku.

Specyfikacja

Model obsługuje okno kontekstowe o wielkości 1 050 000 tokenów (do 922 000 tokenów wejściowych i do 128 000 tokenów wyjściowych). Data graniczna wiedzy to 30 kwietnia 2026 roku. Przyjmuje dane tekstowe i obrazowe, a generuje tekst. Udostępnia regulowany poziom „wysiłku rozumowania” (reasoning effort): low, medium (domyślny), high, xhigh oraz max.

Dostępność i funkcje

GPT-6.1 Sol jest dostępny przez API OpenAI (Chat Completions oraz Responses API, w tym tryb wsadowy/Batch). Obsługuje m.in. streaming, strukturyzowane wyjścia, wywoływanie funkcji, wyszukiwanie w plikach, wejście obrazowe, wyszukiwanie w sieci i buforowanie promptów (prompt caching), a także narzędzia takie jak web search, file search, generowanie obrazów, interpreter kodu, hosted shell i computer use. Nie jest dostępny przez endpointy Live, Realtime ani Assistants.

Cennik

Publiczny cennik API wynosi 2 USD za 1 mln tokenów wejściowych, 0,10 USD za 1 mln tokenów z pamięci podręcznej (cached input), 2,50 USD za zapis do cache oraz 10 USD za 1 mln tokenów wyjściowych. Dla żądań przekraczających 272 000 tokenów stawki wejściowe i cache rosną dwukrotnie, a wyjściowe o 50%.

Klasyfikacja
LLMModel multimodalnyModel rozumowaniaModel używający narzędzi
Rodzina: GPT
Dostęp i wdrożenie
API
Chmura
Wagi: Zamknięte
Kluczowe parametry
📏 Kontekst: 1.05M
✓ Narzędzia
📥 Wejście: tekst, obraz

Specyfikacja techniczna

Okno kontekstowe
1.05M
tokenów
Max output tokens
128 000
tokenów na odpowiedź
Knowledge cutoff
30 kwi 2026
Data graniczna wiedzy
Licencja
Proprietary (OpenAI)
Funkcje:✓ Używanie narzędzi
Modalności
⬇ Wejście (Input)
textimage
⬆ Wyjście (Output)
text

Możliwości i zastosowania

Natywne możliwości modelu
Rozumowanie
Zdolność modelu do logicznego wnioskowania i rozwiązywania złożonych problemów.
Kategoria: reasoning
Zaawansowane rozumowanie
Zdolność do wieloetapowego, ustrukturyzowanego rozumowania: analiza problemów, planowanie kroków, wnioskowanie na podstawie hipotez. Modele reasoning-first (np. GPT-5.1 Thinking) dedykują część inferencji na łańcuchy myślowe zanim udzielą odpowiedzi.
Kategoria: reasoning
Rozumowanie wieloetapowe
Prowadzenie wieloetapowego toku rozumowania w długich, złożonych zadaniach.
Kategoria: reasoning
Programowanie
Generowanie, analizowanie i modyfikowanie kodu w wielu językach programowania. Obejmuje pisanie funkcji, debugowanie, refaktoryzację, code review, tworzenie testów. Mierzone benchmarkami takimi jak HumanEval, SWE-bench.
Kategoria: coding
Kodowanie agentowe
Wielogodzinne, wieloetapowe zadania programistyczne wykonywane samodzielnie przez model: klonowanie repozytorium, uruchamianie testów, iteracja poprawek, integracja z narzędziami CLI. Charakterystyczne dla wariantów Codex (GPT-5.1-Codex-Mini, Codex-Max).
Kategoria: coding
Zdolności agentowe
Zdolność modelu do autonomicznego planowania i wykonywania wieloetapowych zadań poprzez sekwencyjne użycie narzędzi, utrzymywanie kontekstu i adaptację do wyników pośrednich.
Kategoria: planning
Obsługa komputera
Zdolność modelu do obsługi interfejsu komputera poprzez interpretację zrzutów ekranu oraz generowanie akcji takich jak kliknięcia, wpisywanie tekstu i nawigacja po aplikacjach.
Kategoria: planning
Przeglądanie internetu
Zdolność modelu do samodzielnego wyszukiwania i przeglądania stron internetowych w celu pozyskania aktualnych informacji.
Kategoria: other
Rozumienie obrazu
Analiza i interpretacja treści obrazów.
Kategoria: vision
Użycie narzędzi
Zdolność modelu do wywoływania zewnętrznych funkcji, API i narzędzi w trakcie rozmowy: kalkulator, wyszukiwarka, edytor kodu, baza danych. Model decyduje kiedy i jak użyć narzędzia oraz interpretuje jego wynik.
Kategoria: planning
Planowanie
Tworzenie i realizacja planów działania dla złożonych zadań.
Kategoria: planning

Cennik

Architektura techniczna

Rdzeń architektury (Core Architecture)
Techniki trenowania (Training Techniques)