Od 14 sierpnia Claude Code będzie domyślnie działać w trybie automatycznym, wykrywając 89% zagrożeń wobec 13,6% skuteczności ludzi.

Źródło zdjęcia: The Decoder
Anthropic wprowadza znaczące zmiany w swoim narzędziu kodowania Claude Code, które od 14 sierpnia będzie domyślnie działać w trybie automatycznym dla wszystkich planów płatnych z wyjątkiem Enterprise. Decyzja ta ma na celu zwiększenie bezpieczeństwa i efektywności pracy programistów, jak informuje firma w oficjalnym komunikacie.
Tryb automatyczny pozwala narzędziu AI na samodzielną pracę bez czekania na ręczne zatwierdzenie każdego kroku. Specjalny klasyfikator sprawdza, czy dana akcja jest niebezpieczna lub nieodwracalna i tylko w takich przypadkach prosi o potwierdzenie.
Anthropic przeprowadziło obszerne testy kontrolowane z udziałem 1053 płatnych testerów oraz wewnętrznych zespołów red-team. Wyniki pokazują zdecydowaną przewagę trybu automatycznego nad ludzkimi recenzentami w wykrywaniu zagrożeń. Podczas gdy ludzie wykryli zaledwie 13,6% niebezpiecznych komend, system automatyczny zidentyfikował aż 89% z nich.
Niezależny audyt przeprowadzony przez Trajectory Labs testował 72 scenariusze ataków, każdy po dziesięć razy. Żaden z 720 prób nie zdołał przełamać zabezpieczeń aktualnych modeli Claude (Fable 5, Opus 5, Sonnet 5) w trybie automatycznym. Dla porównania, system GPT-5.6 Sol od OpenAI w trybie Codex Auto-Review przepuścił 5,83% ataków.
Wewnętrznie w Anthropic tryb automatyczny już udowodnił swoją wartość. System uchronił Claude przed przesłaniem poufnych danych na publiczną stronę. Podczas jednej z długich sesji zabił około 2000 procesów, które mogłyby zakłócić trwające zadania trenowania GPU.
Anthropic nie pobiera opłat za tokeny zużywane przez sam klasyfikator. Mimo to uczynienie trybu automatycznego domyślnym prawdopodobnie pozostaje korzystne finansowo dla firmy. Gdy Claude pracuje dłużej i wykonuje więcej zadań, całkowite zużycie tokenów wzrasta, co przekłada się na wyższe przychody.
Claude Code jest obecnie najszerzej używanym narzędziem do kodowania AI, a uczynienie trybu automatycznego domyślnym przesuwa rolę programistów dalej od aktywnego kodowania w stronę przeglądania rezultatów generowanych przez sztuczną inteligencję. Sama Anthropic zaleca jednak ostrożność.
Klasyfikator redukuje ryzyko, ale go nie eliminuje. „W przypadku krytycznych zmian w infrastrukturze produkcyjnej nadal zalecamy samodzielne sprawdzenie działań Claude'a”, pisze firma. Ta rada tworzy paradoks — im rzadziej programiści interweniują, tym bardziej liczy się ich nadzór, ale jednocześnie trudniej jest zbudować głębokie zrozumienie projektów, które w dużej mierze powstały w trybie automatycznym bez znaczącego udziału człowieka.

Mimo obietnic Muska i Nvidii naukowcy jak LeCun ostrzegają, że roboty humanoidalne AI nie są jeszcze wystarczająco inteligentne, by zmienić nasze życie.

Meta wprowadza nowe narzędzia AI wykrywające reklamy i konta kierujące do materiałów przedstawiających wykorzystywanie seksualne dzieci na Facebooku i Instagramie.

Framework REACT redukuje błąd rekonstrukcji pH oceanu o 14,7% i błąd chemiczny o 24% dzięki modelowaniu zgodnemu z cyklem węgla.