Claude Mythos 5 wykrył 10 tys. luk w systemach i samodzielnie zaktualizował 50 mln linii kodu. Anthropic ostrzega przed drastycznym ryzykiem nowej AI.

Źródło zdjęcia: Spider's Web
Anthropic, firma założona przez byłych twórców ChatGPT, zaprezentowała nową klasę modeli AI o nazwie Mythos, która może oznaczać przełom w rozwoju sztucznej inteligencji. Jak informuje SpiderWeb, na rynek trafiają dwie wersje: Claude Mythos 5 oraz jego publiczny odpowiednik Claude Fable 5, które według reakcji internetu to obecnie najmocniejszy, ale i potencjalnie najniebezpieczniejszy model AI na świecie.
Ze względu na ogromne ryzyko, pełna wersja Mythos 5 była początkowo dostępna tylko dla największych gigantów technologicznych w ramach tajnego Projektu Glasswing. Jack Clark, współzałożyciel Anthropic, przyznał w wywiadzie dla BBC, że możliwości AI rosną dziś tak szybko, iż branża pilnie potrzebuje hamulca.
Nowe modele wykraczają daleko poza generowanie tekstu, stając się w pełni autonomicznymi agentami zdolnymi do planowania i realizacji wieloetapowych zadań bez ingerencji człowieka.
W programowaniu Fable 5 wykazuje zdolności, które „przerażają inżynierów”. Model potrafi pracować bez nadzoru przez długi czas, ucząc się na błędach. Firma Stripe poinformowała, że AI całkowicie samodzielnie zaktualizował ich bazę kodu w języku Ruby. Model pokonał też konkurencję w profesjonalnych testach programistycznych FrontierCode, z jego potencjału skorzystała już aplikacja Notion.
Przełomem jest także rozwiązanie problemów z logiką, które dotąd trapiły modele AI. Fable 5 bez zająknięcia odpowiada na podchwytliwe pytania — bezbłędnie liczy litery „R” w słowie strawberry czy ocenia, że ułamek 5/11 nie jest większy niż 5/1. Grając w cyfrową grę karcianą Slay the Spire, model tworzył własne notatki z rozgrywki, wyciągał wnioski i często docierał do finału.
Wersja Mythos 5 staje się w rękach naukowców superkomputerem badawczym. W jednym z eksperymentów model spędził ponad tydzień na autonomicznej pracy, przetwarzając dane o komórkach 138 gatunków zwierząt. Następnie samodzielnie zaprojektował i wytrenował własny model AI, który przewyższył rozwiązania z prestiżowego magazinu Science. Według firmy projektuje leki dziesięciokrotnie szybciej niż ludzie i regularnie generuje nowatorskie hipotezy naukowe — jedna z nich dotycząca bakterii E. coli została już potwierdzona w niezależnych badaniach laboratoryjnych.
Anthropic zdecydowało się na radykalny podział ze względu na „drastyczne ryzyko”. Claude Mythos 5 pozostaje ściśle reglamentowany i trafia tylko do rządów, wielkich banków i placówek badawczych. Claude Fable 5 to wersja dla szerokiej publiczności, ale z agresywnym systemem obronnym. Jeśli wykryje zadania dotyczące hakowania, inżynierii wirusów lub próby kradzieży wiedzy, zapytanie zostanie zablokowane i przekierowane do starszego, słabszego modelu Opus 4.8.
Nowe modele Anthropic wyznaczają nowy standard w rozwoju sztucznej inteligencji, łącząc przełomowe możliwości z bezprecedensowymi środkami bezpieczeństwa, co może zdefiniować przyszłość branży AI.

Cloudflare oferuje użytkownikom większą kontrolę nad botami AI dzięki nowej taksonomii opartej na trzech kategoriach: Search, Agent i Training.

Nowy model AI Gemini Spark trafia do pierwszych użytkowników, ale europejscy klienci nie mają do niego dostępu. Google wprowadza kolejne ograniczenia geograficzne.

Anthropic dodał do Claude Cowork funkcję nagrywania umiejętności przez screen recording z narracją. Zapisane zadania można potem automatycznie powtarzać.