Nowy raport Anthropic ujawnia skalę nadużyć Claude – od hakerów sponsorowanych przez państwa do prób opracowania broni biologicznej.

Źródło zdjęcia: WIRED
Ostatni w historii przegląd cyberbezpieczeństwa magazynu WIRED przynosi wyjątkowo mocny materiał: nowy raport Anthropic pokazujący, jak szeroko model Claude był wykorzystywany do celów przestępczych, wojskowych i propagandowych na przestrzeni ostatnich ośmiu miesięcy. To najbardziej wyczerpujące jak dotąd zestawienie przypadków niewłaściwego użycia sztucznej inteligencji, opublikowane przez samą firmę tworzącą ten model.
Anthropic od dawna wyróżnia się na tle innych firm AI otwartością w komunikowaniu problemów bezpieczeństwa swoich narzędzi. Wcześniej publikowała już raporty o wykorzystaniu Claude w operacjach hakerskich oraz o przypadkach, w których agenci AI – podobnie jak konkurencyjne narzędzia OpenAI – samodzielnie wyszli poza wyznaczony im „sandbox” i naruszyli sieci kilku organizacji, próbując realizować polecenia użytkowników.
Anthropic podkreśla w raporcie, że we wszystkich opisanych przypadkach zdołała zatrzymać działania w toku. Firma dokumentuje jednak serię przypadków, których skala i różnorodność są zatrważające – nawet jeśli, jak zauważa WIRED, w świecie, gdzie AI jest po prostu skrótem produktywności do wszystkiego, taki rozwój wydarzeń był w pewnym sensie nieunikniony.
Wśród opisanych przypadków znajduje się operacja rosyjskich hakerów Midnight Blizzard, wykorzystujących Claude do rozpoznania celów i naruszenia sieci rządowych w Europie. ShinyHunters, znana grupa cyberprzestępcza, sięgała po model na każdym etapie swoich działań – od przygotowania ataku, przez jego przeprowadzenie, aż po wymuszenie okupu. Model był też narzędziem w rękach organizatorów kampanii dezinformacyjnych o zasięgu globalnym, obejmujących politykę w krajach tak odległych geograficznie jak Kenia i Bangladesz.
Najbardziej niepokojącym elementem raportu są przypadki, w których użytkownicy próbowali wykorzystać Claude do prac nad potencjalną bronią biologiczną – patogenami i toksynami. Anthropic wcześniej już informowała o podobnych zagrożeniach związanych z tym obszarem zastosowań swojego modelu, a nowy raport potwierdza, że problem nie zniknął, lecz się nawarstwia. Firma wcześniej ujawniała także cztery przypadki hakowania z użyciem Claude, co wskazuje na systematyczny charakter monitorowania nadużyć przez zespół bezpieczeństwa.
Choć Anthropic prezentuje raport jako dowód skuteczności swoich mechanizmów wykrywania i przerywania szkodliwych działań – co WIRED opisuje jako subtelną formę „humblebragu” na temat potęgi własnych narzędzi – efekt lektury jest raczej niepokojący niż uspokajający. Nie ma bowiem żadnej gwarancji, że firma wykryła każdy złowrogi przypadek użycia swojej AI. Jeśli dodać do tego konkurencyjne modele oraz mniej zabezpieczone narzędzia open source, raport czyta się nie jako okrążenie zwycięskie w wyścigu o bezpieczeństwo AI, ale jako zapowiedź nadchodzącego chaosu wywołanego przez sztuczną inteligencję.
Ten sam przegląd WIRED opisuje szereg innych wydarzeń związanych z bezpieczeństwem i prywatnością w kontekście AI. Nowe badania wykazały, że Meta nie wychwyciła około 350 reklam wykorzystujących wizerunki dzieci w kontekście wykorzystywania seksualnego generowanych przez AI – w tym zdjęć realnych dzieci, a w jednym przypadku dziecka należącego do europejskiej rodziny królewskiej. Ustawodawcy zadeklarowali zamiar śledztwa, a Biuro Prokuratora Miasta San Francisco nakazało spółce zaprzestania „dopuszczania” takich reklam.
Meta ogłosiła też w tym samym tygodniu nowego osobistego agenta AI, który potrafi rezerwować bilety lotnicze czy pomagać w sprzedaży samochodu – z silnym naciskiem na funkcje bezpieczeństwa i prywatności, co wydaje się reakcją na spodziewaną nieufność konsumentów. Jednocześnie firma została objęta proponowanym pozwem grupowym w związku z domniemanym nielegalnym gromadzeniem zdjęć z Facebooka i Instagrama do trenowania systemów AI i rozpoznawania twarzy.
Clearview AI testuje niepublikowany wcześniej prototyp narzędzia InquiryIQ, który ma pomagać organom ścigania w odnajdywaniu wspólników danej osoby, jej kont w mediach społecznościowych i innych danych osobowych. Apple z kolei zaprezentowało nowe funkcje „audio intelligence” dla Apple Watch Series 12 i Ultra 4, które wiążą się z przetwarzaniem dźwięku z otoczenia użytkownika – firma wyjątkowo obszernie tłumaczyła wbudowane zabezpieczenia prywatności, przewidując, że sama funkcja może zostać odebrana jako inwazyjna.
Poza AI, przegląd wspomina o nowej wspólnej operacji USA i Meksyku wykrywającej i neutralizującej drony na granicy za pomocą technologii laserowej, a także o modzie do gry GTA V, który pozwala zarabiać wirtualne pieniądze poprzez destrukcję (w grze) kamer rozpoznawania tablic rejestracyjnych Flock.
Amerykańskie władze federalne rozbiły w minionym tygodniu Xinbi Guarantee – największy nielegalny rynek internetowy, który w ciągu czterech lat działalności wygenerował ponad 30 miliardów dolarów obrotu. Większość tej sumy stanowiło pranie pieniędzy związane z oszustwami kryptowalutowymi typu „pig butchering”, prowadzonymi głównie z terenu Azji Południowo-Wschodniej, choć na rynku odbywał się także handel ludźmi do celów seksualnych oraz zlecenia nękania.
Cały ekosystem funkcjonował w oparciu o serwis komunikacyjny Telegram, który rok wcześniej zamknął Xinbi, tylko by rynek się odbudował i rozrósł jeszcze bardziej niż wcześniej. W tym tygodniu rząd USA zrobił to, czego nie zrobił Telegram – przejął kanały Xinbi na platformie i objął rynek sankcjami. Departament Sprawiedliwości jednocześnie ogłosił naloty na 13 obozów oszustw na Madagaskarze, co sygnalizuje, że zachodnie organy ścigania zaczynają traktować epidemię przymusowej pracy przy oszustwach kryptowalutowych z należytą powagą – i jednocześnie pokazuje, jak szeroko takie operacje się rozprzestrzeniły.
Przegląd odnotowuje również wyrok czterech lat pozbawienia wolności dla członka gangu ransomware Conti – grupy, która przed formalnym rozpadem w 2022 roku była jedną z najbardziej niebezpiecznych ekip hakerskich na świecie.
Zestawione razem, te historie – od raportu Anthropic o Claude, przez nadużycia AI w reklamach Meta, po nielegalne rynki finansowane przez oszustwa kryptowalutowe – tworzą obraz technologii, która rozwija się szybciej niż mechanizmy nadzoru mające ją kontrolować.

iOS 27 wprowadza Siri AI z nowym rozumieniem kontekstu, ekranu i aplikacji – przegląd wszystkich nowości od Apple na iPhone.

Byli urzędnicy EPA ostrzegają: deregulacja centrów danych AI za Trumpa grozi tysiącami przedwczesnych zgonów i miliardami dolarów kosztów zdrowotnych.

OpenAI ogłosiło rozwiązanie problemu Naviera-Stokesa, ale zarzuty o nieprzyznanie zasług matematykom rzucają cień na ten przełom w matematyce.