Robocikowo>ROBOCIKOWO
Claude 3.5 Sonnet

Claude 3.5 Sonnet

Claude 3.5 Sonnet (claude-3-5-sonnet-20241022) · Rodzina: Claude
Model Anthropic (2024) z rodziny Claude: multimodalny, okno 200K, ~2× szybszy i tańszy od Claude 3 Opus. Aktualizacja z X 2024 dodała „obsługę komputera”.
⚠ Deprecated⏳ Ograniczony dostępLLMModel multimodalnyModel używający narzędzi📁 Claude
Okno kontekstowe
200K
tokenów
Data premiery
20 czerwca 2024
Dostęp:APIHostedWdrożenie:☁ Cloud

Przegląd

Claude 3.5 Sonnet to duży model językowy firmy Anthropic z rodziny Claude, zaprezentowany 20 czerwca 2024 r. W chwili premiery przewyższał wcześniejszy, najmocniejszy model Claude 3 Opus na szerokim zestawie testów, działając przy tym około dwukrotnie szybciej i w niższej cenie.

Model jest multimodalny — przyjmuje tekst oraz obrazy (zdjęcia, wykresy, dokumenty) i generuje odpowiedzi tekstowe. Obsługuje okno kontekstowe 200 000 tokenów i był określany jako najmocniejszy model wizyjny Anthropic w chwili premiery. Wraz z nim wprowadzono funkcję Artifacts w claude.ai (interaktywne okno z wygenerowaną treścią).

22 października 2024 r. Anthropic udostępniło ulepszoną wersję Claude 3.5 Sonnet (claude-3-5-sonnet-20241022) z wyraźnie lepszymi wynikami w programowaniu (SWE-bench Verified 49,0%) oraz nową, eksperymentalną zdolnością „obsługi komputera” (computer use) w publicznej wersji beta — model potrafi sterować interfejsem komputera (patrzeć na ekran, poruszać kursorem, klikać, pisać).

Cennik API wynosił 3 USD za 1 mln tokenów wejściowych i 15 USD za 1 mln tokenów wyjściowych. Model był dostępny przez Claude API, claude.ai (i aplikację iOS), Amazon Bedrock oraz Google Vertex AI. Obecnie Claude 3.5 Sonnet to model starszej generacji, zastąpiony przez nowsze modele Claude.

Klasyfikacja
LLMModel multimodalnyModel używający narzędzi
Rodzina: Claude
Dostęp i wdrożenie
APIHostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
📏 Kontekst: 200K
Narzędzia
📥 Wejście: tekst, obraz, dokumenty

Specyfikacja techniczna

Okno kontekstowe
200K
tokenów
Licencja
Proprietary
Funkcje:Używanie narzędzi
Modalności
⬇ Wejście (Input)
textimagedocuments
⬆ Wyjście (Output)
textcodestructured_data

Możliwości i zastosowania

Natywne możliwości modelu
Rozumowanie
Zdolność modelu do logicznego wnioskowania i rozwiązywania złożonych problemów.
Kategoria: reasoning
Rozumowanie wieloetapowe
Prowadzenie wieloetapowego toku rozumowania w długich, złożonych zadaniach.
Kategoria: reasoning
Długi kontekst
Obsługa dużych okien kontekstowych — dziesiątek do setek tysięcy (lub milionów) tokenów wejścia. Umożliwia analizę całych baz kodu, długich dokumentów, wielu równolegle rozmów bez utraty wcześniejszych informacji. GPT-5.1 wspiera 400 000 tokenów.
Kategoria: language
Programowanie
Generowanie, analizowanie i modyfikowanie kodu w wielu językach programowania. Obejmuje pisanie funkcji, debugowanie, refaktoryzację, code review, tworzenie testów. Mierzone benchmarkami takimi jak HumanEval, SWE-bench.
Kategoria: coding
Użycie narzędzi
Zdolność modelu do wywoływania zewnętrznych funkcji, API i narzędzi w trakcie rozmowy: kalkulator, wyszukiwarka, edytor kodu, baza danych. Model decyduje kiedy i jak użyć narzędzia oraz interpretuje jego wynik.
Kategoria: planning
Wyjście strukturyzowane
Generowanie danych w ustrukturyzowanych formatach, np. JSON.
Kategoria: structured_generation
Rozumienie obrazu
Analiza i interpretacja treści obrazów.
Kategoria: vision
Rozumienie wykresów
Odczyt i interpretacja wykresów, tabel i diagramów.
Kategoria: vision
OCR
Rozpoznawanie tekstu na obrazach i w dokumentach.
Kategoria: vision
Wielojęzyczność
Kompetencje w wielu językach naturalnych (od kilku do stu+): rozumienie, generowanie, tłumaczenie, code-switching w obrębie jednej rozmowy. Modele frontier obsługują szeroki wachlarz języków ze zbliżoną jakością.
Kategoria: language
Planowanie
Tworzenie i realizacja planów działania dla złożonych zadań.
Kategoria: planning
Obsługa komputera
Zdolność modelu do obsługi interfejsu komputera poprzez interpretację zrzutów ekranu oraz generowanie akcji takich jak kliknięcia, wpisywanie tekstu i nawigacja po aplikacjach.
Kategoria: planning

Wyniki benchmarków

2 benchmarki
SWE-bench
accuracy · SWE-bench Verified (20241022 release)
49.0%
📄 Anthropic (aktualizacja Claude 3.5 Sonnet, X 2024)
TAU-bench
accuracy · retail domain
69.2%
📄 Anthropic (aktualizacja Claude 3.5 Sonnet, X 2024)

Cennik

Architektura techniczna

Rdzeń architektury (Core Architecture)
Forma modelu (Model Form)
Techniki trenowania (Training Techniques)

Wdrożenie i bezpieczeństwo

🔒 Security / Enterprise
✓ Zweryfikowane informacje enterprise

Dostępny przez Claude API oraz platformy chmurowe (Bedrock, Vertex AI). Anthropic nie wykorzystuje domyślnie danych z API do trenowania modeli i stosuje kontrole klasy enterprise.

Aktualizacja: 24 lip 2026↗ Dokumentacja security