Od 14 sierpnia Claude Code będzie domyślnie działać w trybie automatycznym, wykrywając 89% zagrożeń wobec 13,6% skuteczności ludzi.

Źródło zdjęcia: The Decoder
Anthropic wprowadza znaczące zmiany w swoim narzędziu kodowania Claude Code, które od 14 sierpnia będzie domyślnie działać w trybie automatycznym dla wszystkich planów płatnych z wyjątkiem Enterprise. Decyzja ta ma na celu zwiększenie bezpieczeństwa i efektywności pracy programistów, jak informuje firma w oficjalnym komunikacie.
Tryb automatyczny pozwala narzędziu AI na samodzielną pracę bez czekania na ręczne zatwierdzenie każdego kroku. Specjalny klasyfikator sprawdza, czy dana akcja jest niebezpieczna lub nieodwracalna i tylko w takich przypadkach prosi o potwierdzenie.
Anthropic przeprowadziło obszerne testy kontrolowane z udziałem 1053 płatnych testerów oraz wewnętrznych zespołów red-team. Wyniki pokazują zdecydowaną przewagę trybu automatycznego nad ludzkimi recenzentami w wykrywaniu zagrożeń. Podczas gdy ludzie wykryli zaledwie 13,6% niebezpiecznych komend, system automatyczny zidentyfikował aż 89% z nich.
Niezależny audyt przeprowadzony przez Trajectory Labs testował 72 scenariusze ataków, każdy po dziesięć razy. Żaden z 720 prób nie zdołał przełamać zabezpieczeń aktualnych modeli Claude (Fable 5, Opus 5, Sonnet 5) w trybie automatycznym. Dla porównania, system GPT-5.6 Sol od OpenAI w trybie Codex Auto-Review przepuścił 5,83% ataków.
Wewnętrznie w Anthropic tryb automatyczny już udowodnił swoją wartość. System uchronił Claude przed przesłaniem poufnych danych na publiczną stronę. Podczas jednej z długich sesji zabił około 2000 procesów, które mogłyby zakłócić trwające zadania trenowania GPU.
Anthropic nie pobiera opłat za tokeny zużywane przez sam klasyfikator. Mimo to uczynienie trybu automatycznego domyślnym prawdopodobnie pozostaje korzystne finansowo dla firmy. Gdy Claude pracuje dłużej i wykonuje więcej zadań, całkowite zużycie tokenów wzrasta, co przekłada się na wyższe przychody.
Claude Code jest obecnie najszerzej używanym narzędziem do kodowania AI, a uczynienie trybu automatycznego domyślnym przesuwa rolę programistów dalej od aktywnego kodowania w stronę przeglądania rezultatów generowanych przez sztuczną inteligencję. Sama Anthropic zaleca jednak ostrożność.
Klasyfikator redukuje ryzyko, ale go nie eliminuje. „W przypadku krytycznych zmian w infrastrukturze produkcyjnej nadal zalecamy samodzielne sprawdzenie działań Claude'a”, pisze firma. Ta rada tworzy paradoks — im rzadziej programiści interweniują, tym bardziej liczy się ich nadzór, ale jednocześnie trudniej jest zbudować głębokie zrozumienie projektów, które w dużej mierze powstały w trybie automatycznym bez znaczącego udziału człowieka.

Jane Doe 4 dołącza do pozwu przeciw xAI, twierdząc, że Grok posłużył do stworzenia 7 tys. obrazów CSAM z jej zdjęcia z dzieciństwa.

Wired ujawnia kod OS Investigate – narzędzia AI Flock Safety, które identyfikuje i profiluje kierowców bez zarzutów, wbrew publicznym zapewnieniom firmy.

Twitch pozwala streamerom zablokować trening AI Amazona, ale ponad 16 tys. twórców kwestionuje, jak długo ich treści już były wykorzystywane.