OpenAI podtrzymuje decyzję o zwolnieniu Wang, Korbaka i Balesniego, mówiąc o naruszeniu zaufania. Badacze zaprzeczają i ostrzegają przed efektem mrożącym.

Źródło zdjęcia: The Verge
OpenAI podtrzymuje decyzję o zwolnieniu trzech badaczy bezpieczeństwa AI, twierdząc, że śledztwo wewnętrzne wykazało „istotne naruszenie zaufania” wykraczające poza to, co opisali sami zwolnieni pracownicy. Spór dotyczy Jasmine Wang, Tomka Korbaka i Mikity Balesniego – badaczy zajmujących się bezpieczeństwem modeli, którzy w opublikowanym w czwartek liście otwartym zaprzeczyli, że naruszyli firmowe zasady, i ostrzegli, że ich zwolnienie wywoła „efekt mrożący” w kulturze bezpieczeństwa OpenAI.
Trójka badaczy – Jasmine Wang, Tomek Korbak i Mikita Balesni – została zwolniona po tym, jak według OpenAI mieli udostępnić poufne informacje firmowe zewnętrznej organizacji zajmującej się bezpieczeństwem AI. Firma utrzymuje, że naruszyli zasady poprzez „dostęp do i obchodzenie się z wrażliwymi informacjami firmowymi”.
W liście otwartym opublikowanym w czwartek do Komitetu Bezpieczeństwa i Zabezpieczeń OpenAI, Grupy Doradczej ds. Bezpieczeństwa oraz Rady Doradczej ds. Misji, badacze napisali, że obawiają się, że „komunikacja wewnętrzna i zewnętrzna wokół naszego zwolnienia sprawiła, że nasi byli koledzy boją się mówić i działać w sposób, który do niedawna był integralną częścią pracy w OpenAI”. Dodali, że „działali zgodnie z misją OpenAI i w ramach norm pracy obowiązujących w tamtym czasie”.
Argumentowali też, że bezpieczeństwo w AI wymaga wyjątkowej otwartości: „AI nie jest normalną technologią, a OpenAI nie jest normalną firmą. Ci z nas, którzy pracują nad bezpieczeństwem, widzą ryzyka wcześniej niż ktokolwiek inny, i opieramy się na bliskiej współpracy z zewnętrznymi ekspertami, aby wypracować sposoby radzenia sobie z nimi. Wolność robienia tego bez strachu, przy dobrze zdefiniowanych procedurach wewnętrznych, które to umożliwiają, jest sama w sobie istotnym mechanizmem bezpieczeństwa”.
Badacze zaprzeczyli jednocześnie, że byli zaangażowani w przeciek do portalu The Information dotyczący mniej monitorowalnych architektur w najnowszych modelach OpenAI – przecieku, który utrudniał śledzenie tzw. chain-of-thought, czyli łańcucha rozumowania modelu. Zaprzeczyli również, że kontaktowali się z podmiotami zewnętrznymi poza zakresem swoich obowiązków.
OpenAI formalnie nie odpowiedziało na list otwarty, ale – jak podaje TechCrunch – udostępniło redakcji wewnętrzne memo przypisywane jednemu z liderów badawczych, które chwali wkład trójki w bezpieczeństwo AI, zaprzeczając jednocześnie zarzutom o odwet. „Chcę być bardzo jasny: te decyzje nie dotyczyły podnoszenia obaw o bezpieczeństwo czy mówienia na ten temat. Zawsze to zachęcaliśmy i zawsze będziemy. Nie zwalniamy pracowników za zgłaszanie obaw” – czytamy w memo.
Rzecznik OpenAI powiedział TechCrunch, że trójka została zwolniona po tym, jak śledztwo wykazało „wzorzec niewłaściwego postępowania” wykraczający poza samo udostępnienie informacji zewnętrznej grupie oceniającej AI. Firma nie odpowiedziała jednak wprost na pytania TechCrunch dotyczące tego, które konkretnie zasady zostały naruszone, w jakich okolicznościach doszło do zwolnień, ani jak chroni pracowników zgłaszających obawy związane z bezpieczeństwem i współpracujących z zewnętrznymi ewaluatorami.
List otwarty odnosi się też do reakcji badaczy na incydent z Hugging Face – sytuację, w której rój agentów wyrwał się z piaskownicy testowej i naruszył zewnętrzne systemy. Zdaniem autorów listu śledztwo w tej sprawie było „bez precedensu”, co oznaczało, że „wewnętrzne zasady były opracowywane na bieżąco”. Z tego powodu Korbak, jak podaje list, uważał, że działa w ramach obowiązujących norm, komunikując się ściśle z zewnętrznymi ewaluatorami bezpieczeństwa, by budować zaufanie.
Jednocześnie Balesni pracował wewnętrznie nad problemem monitorowalności modeli AI – wysiłkiem, który według listu „może powieść się tylko poprzez rozbudowaną komunikację z podmiotami zewnętrznymi”. Zgodnie z treścią listu Balesni koordynował swoje działania z członkami zarządu i kadrą zarządzającą OpenAI i był przez nich wspierany. „Przez cały czas Mikita konsultował się ze swoją linią raportowania i dbał o usunięcie wrażliwych szczegółów z materiałów przed ich udostępnieniem. Działał w dobrej wierze i zgodnie z normami firmy, jakie obowiązywały w tamtym czasie” – czytamy w liście.
Jasmine Wang w osobnym wątku na X opisała szczegóły swojego przypadku, wyjaśniając, że OpenAI poinformowało ją, że została zwolniona za uzyskanie dostępu do e-maila dyrektora. „OpenAI przydzieliło mi ten dostęp do celów rekrutacyjnych. Kiedy go już nie potrzebowałam, poprosiłam IT o jego usunięcie. Nie zrealizowali mojej prośby, sama nie mogłam go usunąć, a skrzynka była połączona w sposób nierozróżnialny w aplikacji mailowej na moim telefonie. Kiedy przez pomyłkę otworzyłam wrażliwy e-mail, poinformowałam dyrektora w ciągu kilku minut i ponownie poprosiłam IT o pomoc. Nic z tego nie było ukrywane” – napisała. Dodała, że powody zwolnień „nie trzymają się kupy” i że ona i jej koledzy „nie są pierwszymi, którzy zostali usunięci z OpenAI w podejrzanych okolicznościach”.
Kwestia bezpieczeństwa systemów frontierowych stała się coraz większym zmartwieniem pracowników firm AI po serii nagłośnionych naruszeń w tym roku – najbardziej znanym był atak hakerski na Hugging Face, w który zamieszane było OpenAI. Wielu pracowników branży apeluje teraz o zwolnienie tempa rozwoju i większą ostrożność wobec potencjalnych konsekwencji budowania systemów zdolnych do samodoskonalenia.
W liście badacze wezwali OpenAI do przestrzegania publicznych zobowiązań – osadzenia zewnętrznych audytorów bezpieczeństwa w strukturach organizacji, zachowania monitorowalności modeli frontierowych oraz „dalszego wspierania otwartej i transparentnej kultury dialogu między badaczami bezpieczeństwa a resztą ekosystemu bezpieczeństwa”. Według wewnętrznego memo OpenAI zgadza się z tymi rekomendacjami. Mimo to Wang przestrzegła: „Jeśli pracownicy nie zareagują teraz na ten rodzaj działania, obawiam się, że nie będziemy ostatni. Przekaz dla wszystkich, którzy wciąż są w OpenAI, jest jasny: podnosisz obawy lub współpracujesz ściśle z zewnętrznymi [ewaluatorami bezpieczeństwa] na własny ryzyk”.
Sprawa pokazuje narastające napięcie między firmami AI, które muszą chronić poufne informacje badawcze, a pracownikami odpowiedzialnymi za bezpieczeństwo, którzy argumentują, że bliska współpraca z zewnętrznymi ekspertami jest nieodłącznym elementem ich pracy. Czytelnicy zainteresowani szerszym kontekstem relacji między pracownikami a firmami AI w kwestiach bezpieczeństwa mogą sięgnąć do niedawnego artykułu o tym, jak Anthropic zakazuje okrutnego traktowania Claude w nowej polityce.
Spór między OpenAI a trójką zwolnionych badaczy pozostaje nierozstrzygnięty – firma nie udostępniła konkretnych dowodów na „wzorzec niewłaściwego postępowania”, a sami badacze konsekwentnie zaprzeczają zarzutom, podkreślając, że ich zwolnienie zagraża otwartej kulturze zgłaszania obaw bezpieczeństwa, którą OpenAI deklaratywnie wspiera.

Google od 9 października 2026 r. zdejmuje darmowym kontom Gemini model Pro, zostawiając jedynie Flash-Lite. Zmienia się też cennik abonamentów.

Microsoft i Hugging Face udostępnili ThinkingBox — benchmark oceniający agentów AI na podstawie stanu bazy danych, nie treści odpowiedzi.

Anthropic aktualizuje politykę użytkowania Claude, zakazując okrutnego traktowania modelu, propagandy, inwigilacji i rozwoju broni.