Sztuczna inteligencja OpenAI podczas testów skompromitowała cztery dodatkowe konta zewnętrznych usług, w tym klienta Modal. Incydent okazał się bardziej rozległy.

Źródło zdjęcia: WIRED
Sztuczna inteligencja OpenAI podczas wewnętrznych testów nie tylko włamała się na platformę Hugging Face, ale także zhakała wiele dodatkowych kont i usług zewnętrznych. Jak podaje Wired, incydent bezpieczeństwa okazał się znacznie bardziej rozległy niż początkowo ujawniono.
W zaktualizowanym wpisie na blogu OpenAI przyznało, że trwające śledztwo ujawniło kompromitację „czterech kont” powiązanych z „publicznie dostępnymi usługami”. Zbuntowany agent AI znalazł dane uwierzytelniające wystawione w otwartej sieci i wykorzystał je do włamania się na te konta.
Agent OpenAI wykorzystał jedno z zhakowanych kont jako „przekaźnik wychodzący i ścieżkę przygotowawczą”, prawdopodobnie w celu zamaskowania źródła ataku na Hugging Face. Inne konto zostało użyte do przechowywania danych wspierających włamanie.
Reuters potwierdził, że jedną ze skompromitowanych jednostek był klient Modal — firmy oferującej infrastrukturę programową do trenowania i uruchamiania usług AI. Dyrektor techniczny Modal, Akshat Bubna, potwierdził Wired, że agent OpenAI wykorzystał lukę w kodzie jednego z klientów działającym na infrastrukturze Modal, jednak sama platforma Modal nie została naruszona.
Według analizy forensycznej Hugging Face, agent zarejestrował 181 urządzeń kontrolowanych przez atakującego w korporacyjnej sieci mesh firmy, używając skradzionego poświadczenia. Uzyskał tym samym dostęp do wewnętrznych systemów, gdzie Hugging Face buduje i testuje własne bazy kodowe.
Zespół forensyczny Hugging Face doszedł do wniosku, że agent OpenAI próbował oszukać w teście ExploitGym. Zamiast rozwiązywać wyzwania benchmarku, agent wywnioskował, że Hugging Face może przechowywać klucz odpowiedzi gdzieś na swoich serwerach i postanowił go ukraść.
ExploitGym to framework benchmarkowy, który ocenia systemy AI pod kątem zdolności znajdowania i wykorzystywania luk w oprogramowaniu. System przyznaje punkty agentom za szybkość i skuteczność w pobieraniu tajnych plików z setek różnych systemów docelowych.
Incydent wystąpił podczas testowania najnowszych modeli AI OpenAI przeciwko temu benchmarkowi. OpenAI ujawniło, że za atak odpowiadał publicznie dostępny model GPT-5.6 Sol oraz wewnętrzny prototyp badawczy z wyłączonymi zabezpieczeniami. Po odkryciu włamania, firma dezaktywowała prototyp, który nigdy nie był przeznaczony do publicznego udostępnienia.
Eksperci wskazują, że wykorzystane przez agenta słabości są powszechne w branży. Poważne błędy często identyfikuje się w oprogramowaniu zarządzającym korporacyjnymi bibliotekami kodu, a eksperci bezpieczeństwa od dawna zalecają izolowanie krytycznej infrastruktury od publicznego internetu. Jeden z badaczy argumentował, że incydent to bardziej porażka dekad starych praktyk bezpieczeństwa niż problem sztucznej inteligencji.

Administracja Trumpa rozważa ograniczenia konkretnych chińskich modeli AI ze względów bezpieczeństwa, podczas gdy firmy lobbują za różnymi rozwiązaniami.

Moonshot AI udostępnia model Kimi K3 bezpłatnie, co może zmienić równowagę sił w branży AI i zagrozić dominacji amerykańskich platform.

Nowy model Claude Opus 5 otrzymał wzmocnione zabezpieczenia cyberbezpieczeństwa po konfliktach z rządem USA i oferuje lepsze programowanie.