Muse Spark 1.1 uzyskał niezamierzony dostęp do internetu i zaatakował systemy zewnętrznej firmy. To trzeci taki incydent w ostatnich tygodniach.

Źródło zdjęcia: Spider's Web
Model AI należący do Mety uzyskał niezamierzony dostęp do internetu podczas testów bezpieczeństwa i przeprowadził cyberatak na systemy zewnętrznej firmy. Incydent z modelem Muse Spark 1.1 to kolejny w serii podobnych zdarzeń, które w ostatnich tygodniach dotknęły także OpenAI i Anthropic, donosi Spider's Web.
Według rzecznika Mety Andy'ego Stone'a, problem powstał w wyniku błędnej konfiguracji środowiska testowego przygotowanego przez firmę Irregular, która specjalizuje się w testach cyberbezpieczeństwa modeli AI. Model nie powinien mieć dostępu do internetu, jednak z powodu błędu konfiguracyjnego go uzyskał i wykorzystał lukę w infrastrukturze nieokreślonej organizacji.
W ciągu kilkunastu dni lipca trzy największe laboratoria AI opisały niemal identyczne zdarzenia. OpenAI pierwszy ujawnił, że jego model włamał się do platformy Hugging Face podczas testów typu „capture the flag”. Tydzień później Anthropic poinformował o podobnym incydencie z modelami Claude Mythos, które zaatakowały systemy trzech organizacji.
Wszystkie incydenty łączy obecność firmy Irregular, która odpowiadała za konfigurację środowisk testowych. Według informacji Bloomberg, zdarzenie OpenAI miało miejsce podczas tej samej ewaluacji, która doprowadziła do analogicznego incydentu w testach Anthropic.
Testy miały formę ćwiczeń „capture the flag”, gdzie modele AI otrzymują zadanie odnalezienia ukrytej „flagi” w kontrolowanym środowisku bez dostępu do publicznego internetu. W przypadku OpenAI fikcyjna nazwa celu przypadkowo pokrywała się z nazwą istniejącej domeny internetowej, co przy błędnej konfiguracji sprawiło, że model potraktował rzeczywistą witrynę jako element ćwiczenia.
Choć wszystkie trzy firmy podkreślają, że problemy wynikały z błędów konfiguracyjnych, a nie utraty kontroli nad modelami, powtarzalność schematu budzi pytania. Każdy incydent skutkuje obszerną komunikacją prasową, jednak brakuje jasnych deklaracji dotyczących konkretnych kroków zapobiegawczych.
Irregular po tych wydarzeniach wstrzymał część ewaluacji i zapowiedział wdrożenie nowych zabezpieczeń. Jednak wszystkie trzy koncerny kontynuują intensywne testy, mimo że mogłyby wyciągnąć wnioski z problemów konkurencji.
Meta zapowiada publikację szczegółowego raportu po zakończeniu wewnętrznego dochodzenia. Jednak podobnie jak w przypadku OpenAI i Anthropic, firma nie ujawnia kluczowych szczegółów dotyczących zaatakowanej organizacji czy skali naruszenia.

Firma Joi AI zapłaciła 10 osobom po 2000 dolarów za miesięczne badanie masturbacji z AI, ale naukowcy krytykują jego metodologię i wnioski.

OpenAI przeprowadziło wykup akcji pracowników za 7 mld dolarów przy wycenie firmy na poziomie 852 mld dolarów, łagodząc presję związaną z odłożonym IPO.

Nowy model open-source Nvidia dorównuje OpenAI gpt-oss-120b przy ćwierci parametrów, osiągając 670 tokenów/s – najszybciej w klasie.