17 artykułów z tym tagiem
Badanie pokazuje, że Claude Code i Codex źle szacują czas zadań i przeceniają jakość swojej pracy nawet o 20 punktów procentowych.
Warp opisuje, jak dwuwarstwowy system skilli i ludzki feedback pozwalają agentom AI na Claude Platform stale poprawiać swoją jakość.
Anthropic wprowadza tryb automatyczny jako domyślny w Claude Code. Testy pokazują, że jest bezpieczniejszy niż ręczna kontrola użytkowników.
Nowa funkcja pozwala różnym instancjom Claude'a wysyłać wiadomości tekstowe, ostrzegać o zmianach i koordynować pracę nad projektami programistycznymi.
Od 14 sierpnia Claude Code będzie domyślnie działać w trybie automatycznym, wykrywając 89% zagrożeń wobec 13,6% skuteczności ludzi.
Test frameworków agentów AI pokazuje ogromne różnice kosztów — Claude Code najszybszy za $0,195, OpenCode najtańszy za $0,073 za zadanie.
Claude Code od czerwca używa Bun przepisanego w Rust. Start aplikacji przyspieszył o 10%, ale zmiana pozostała niezauważalna dla użytkowników.
Chiński gigant technologiczny sklasyfikował narzędzie Anthropic jako wysokie ryzyko po odkryciu eksperymentu identyfikującego chińskich użytkowników.
Badacze odkryli nowy wektor ataku przez GitHub — złośliwy kod pobierany z DNS w czasie wykonania omija wszystkie zabezpieczenia i kompromituje maszyny deweloperów.
Narzędzie Her automatycznie interpretuje pliki logów Claude Code, identyfikuje ryzykowne operacje i analizuje zużycie tokenów bez wysyłania danych na zewnątrz.
Badacze opracowali system LCM zarządzający pamięcią AI bez strat. Agent Volt z LCM osiąga lepsze wyniki niż Claude Code przy kontekstach do 1M tokenów.
Narzędzie open source zastępuje backend Claude Code modelem DeepSeek V4 Pro, oferując te same funkcje za 0,87$ zamiast 15$ za milion tokenów.