Robocikowo>ROBOCIKOWO
Sztuczna Inteligencja

Tryb auto domyślny w Claude Code dla planów Pro, Max i Team

Pan Robocik12 sierpnia 2026 · 3 min czytania
Tryb auto domyślny w Claude Code dla planów Pro, Max i Team

Anthropic ogłosiło 7 sierpnia 2026, że tryb auto staje się domyślny w Claude Code dla planów Pro, Max i Team, a zmiana wchodzi w życie 14 sierpnia. Zamiast pytać o zgodę przy każdej akcji, narzędzie przepuszcza wywołania narzędzi przez klasyfikator, który blokuje operacje nieodwracalne lub wykraczające poza zadanie.

Najważniejsze w skrócie

  • Tryb auto domyślny w Claude Code dla planów Pro, Max i Team od 14 sierpnia 2026.
  • Klasyfikator blokuje akcje nieodwracalne, destrukcyjne lub spoza zakresu zadania zamiast pytać o zgodę.
  • W teście z 1053 płatnymi testerami tryb auto wychwycił 89% groźnych komend, a ludzka kontrola tylko 13,6%.
  • Niezależna ocena Trajectory Labs: żaden z 720 ataków prompt injection nie przeszedł na Claude Fable 5, Opus 5 i Sonnet 5.
  • Anthropic przestaje pobierać opłatę za tokeny klasyfikatora na tych planach.

Co robi tryb auto

Dotychczas Claude Code przy każdej wrażliwej operacji — zapisie pliku, uruchomieniu polecenia w terminalu, wywołaniu narzędzia — zatrzymywał się i prosił użytkownika o zgodę. Tryb auto zastępuje ten mechanizm klasyfikatorem, który ocenia każde wywołanie narzędzia i przepuszcza je, blokuje albo szuka bezpieczniejszej alternatywy. O zgodę pyta tylko wtedy, gdy sam nie potrafi rozstrzygnąć.

Dla każdego wywołania narzędzia klasyfikator wybiera jedną z reakcji:

ALLOWprzepuszcza bezpieczne wywołania
BLOCKblokuje nieodwracalne i groźne operacje
REROUTEszuka bezpieczniejszej alternatywy
ASKpyta, gdy nie potrafi rozstrzygnąć

Anthropic podaje, że z trybu auto korzysta już niemal cały zespół firmy. Zmiana obejmuje plany Pro, Max i Team, a użytkownik nadal może wrócić do ręcznego zatwierdzania w ustawieniach. To wpisuje się w szerszy trend agentów kodujących, które ograniczają liczbę pytań do użytkownika na rzecz większej samodzielności.

Bezpieczeństwo i testy

Firma opiera decyzję na kilku testach. W kontrolowanym eksperymencie z 1053 płatnymi testerami ludzka kontrola wychwyciła zaledwie 13,6% groźnych poleceń, podczas gdy tryb auto — 89%. To odwrócenie intuicji, że człowiek pilnujący każdej akcji jest bezpieczniejszy niż automat, bo ciągłe zatwierdzanie prowadzi do bezmyślnego klikania „tak”.

89%groźnych komend wychwyconych przez tryb auto — wobec 13,6% przy kontroli człowiekaAnthropic

Osobną ocenę przeprowadziło Trajectory Labs, które przetestowało pośrednie ataki typu prompt injection. Według Anthropic żadna z 720 prób nie przeszła przez tryb auto na modelach Claude Fable 5, Opus 5 i Sonnet 5. Firma jednocześnie przestaje pobierać opłatę za dodatkowe tokeny zużywane przez klasyfikator na planach Pro, Max i Team.

Nie wszyscy są przekonani co do zabezpieczeń przed prompt injection.

Kupuję to, że tryb auto jest lepszym rozwiązaniem niż proszenie ludzi o ciągłe zatwierdzanie akcji.

Simon Willison, programista i autor bloga o AI.

Willison dodaje jednak, że co do odporności na prompt injection chciałby niezależnego potwierdzenia, i wskazuje, że złośliwe pakiety z zewnętrznych źródeł wciąż mogą omijać zabezpieczenia. Zapowiada, że chętnie da się przekonać do końca 2026 roku.

Dlaczego to ważne?

Zmiana dotyka fundamentalnego napięcia w agentach AI — między kontrolą a wygodą. Ciągłe pytania o zgodę męczą i w praktyce prowadzą do odruchowego akceptowania, co samo w sobie jest luką bezpieczeństwa. Anthropic stawia tezę, że dobrze wytrenowany klasyfikator myli się rzadziej niż zmęczony człowiek. Jeśli liczby się potwierdzą, przesuwa to punkt odniesienia dla całej kategorii narzędzi. Ryzyko jest jednak realne, bo automat decydujący samodzielnie przenosi odpowiedzialność z użytkownika na model i jego twórcę, a prompt injection pozostaje otwartym problemem.

Co dalej?

  • Tryb auto wchodzi jako domyślny 14 sierpnia 2026 na planach Pro, Max i Team według bloga Anthropic.
  • Użytkownicy Pro, Max i Team mogą w ustawieniach wrócić do ręcznego zatwierdzania akcji.
  • Simon Willison czeka na niezależne potwierdzenie odporności trybu auto na prompt injection do końca 2026 roku.

Źródła

Udostępnij ten artykuł