Nowy model Opus 5 od Anthropic przewyższa większy Fable 5 w testach, oferując mniej ograniczeń i lepszą dostępność dla użytkowników.

Źródło zdjęcia: TechCrunch
Anthropic wprowadził w piątek model Opus 5, najnowszą wersję swojego flagowego modelu AI. Choć jest mniejszy od modelu Fable 5, Opus 5 będzie zarówno tańszy, jak i mniej restrykcyjny, co prawdopodobnie uczyni go preferowanym wyborem w większości przypadków użycia. Szczegóły dotyczące nowego modelu zostały opublikowane w oficjalnym ogłoszeniu na TechCrunch.
Opus 5 wyróżnia się szczególnie w zakresie weryfikacji własnej pracy i starannego iterowania do momentu osiągnięcia sukcesu. Anthropic podkreśla, że podczas testów porównawczych model był w stanie napisać własny pipeline wizji komputerowej w odpowiedzi na niekompletny prompt, co świadczy o jego zaawansowanych możliwościach samonaprawy i rozwiązywania problemów.
Model pojawił się w szybkim tempie rozwoju serii 5 — Mythos 5, Fable 5 i Sonnet 5 zostały wszystkie wprowadzone w czerwcu, pozostawiając jedynie lekki model Haiku jako ostatni oczekujący na aktualizację do serii 5.
Opus 5 jest wolny od polityki 30-dniowego przechowywania danych, która obowiązuje modele Fable i Mythos i wzbudzała obawy wśród użytkowników dbających o prywatność. Jednak nadal obowiązują znaczące zabezpieczenia, szczególnie w zakresie zadań cyberbezpieczeństwa, takich jak generowanie exploitów i testy penetracyjne.
Na przykład, zabezpieczenia Opus 5 uniemożliwiają jego wykorzystanie do skanowania w poszukiwaniu podatności w binarnych plikach oprogramowania, choć pozwalają na wyszukiwanie luk w kodzie źródłowym, ponieważ to drugie zadanie jest częściej wykorzystywane do celów obronnych.
Anthropic wprowadził również narzędzie Automatic Fallbacks w wersji beta, które ma uczynić zabezpieczenia mniej uciążliwymi. Gdy prompt uruchomi klasyfikator bezpieczeństwa, system automatycznie przekieruje żądanie do mniej zaawansowanego modelu, dzięki czemu użytkownicy API otrzymają funkcjonalną odpowiedź zamiast komunikatu o błędzie.
Opus 5 reprezentuje kolejny krok w strategii Anthropic polegającej na oferowaniu modeli o różnym stopniu zaawansowania i ograniczeń, dopasowanych do różnych potrzeb użytkowników.

Gubernator Teksasu Greg Abbott zamroził wydatki na kamery Flock po śledztwie ujawniającym wydanie ponad 30 mln dolarów na system AI.

Model Qwen2.5–14B (9 GB) odpowiedział na 67% pytań z 41 lat Jeopardy!, przewyższając ograniczenia legendarnego superkomputera Watson z 2011 roku.

Caterpillar wykorzystuje wiedzę z automatyzacji kopalni do wdrażania AI na placach budowy i inwestuje 100 mln dolarów w szkolenia pracowników.