David Robinson, autor raportów bezpieczeństwa OpenAI, odchodzi z firmy i w eseju dla The Atlantic ostrzega o zepsutej kulturze branży AI.

Źródło zdjęcia: TechCrunch
David Robinson, do niedawna odpowiedzialny za pisanie raportów bezpieczeństwa towarzyszących każdej większej premierze modeli OpenAI, zrezygnował z pracy w firmie i upublicznił swoje powody w obszernym esejcie opublikowanym w The Atlantic. Sam przyznaje, że jest „swego rodzaju klisze” – pracownikiem wiodącej firmy AI, który odchodząc z pracy, ogłasza ponure ostrzeżenie. Robinson spędził w OpenAI trzy i pół roku, co – jak podkreśla – czyni go jednym z najdłużej zatrudnionych pracowników firmy. Jego zdaniem kultura organizacyjna OpenAI jest „zepsuta”.
Sprawę jako pierwszy opisał Business Insider, a szerzej skomentował ją również The Verge, zwracając uwagę, że Robinson jest kolejnym w rosnącym szeregu badaczy i pracowników bezpieczeństwa odchodzących z czołowych firm AI.
W swoim eseju Robinson przypomina echa wypowiedzi Jacoba Coxona, badacza, który pracował wcześniej i w OpenAI, i w Anthropic, a po odejściu z branży ogłosił, że te firmy „hazardują naszym życiem”. Słowa Coxona wywołały szerszą debatę o bezpieczeństwie AI – CEO Anthropic, Dario Amodei, zaprezentował plan ostrożniejszego rozwoju sztucznej inteligencji, a w tym tygodniu szefowie firm AI spotkali się z prezydentem Donaldem Trumpem i podpisali pospiesznie przygotowaną, niewiążącą deklarację wdrożenia dodatkowych mechanizmów bezpieczeństwa.
Robinson idzie jednak o krok dalej. Jego zdaniem debata musi wykroczyć poza „konkretne przepisy czy nowe ustawy” i objąć całą kulturę organizacyjną tych firm. Choć większość dotychczasowych doniesień o OpenAI koncentrowała się na tym, jak CEO Sam Altman utracił zaufanie byłych współpracowników, Robinson sugeruje, że problemy kulturowe OpenAI są w gruncie rzeczy takie same, jak w całej Dolinie Krzemowej.
„OpenAI rozwija się metodą prób i błędów (co firma nazywa »iteracyjnym wdrażaniem«), szukając problemów i poprawiając zabezpieczenia w odpowiedzi na nie” – napisał Robinson. „Ale takie podejście z definicji gwarantuje okresowe porażki – a skala tych porażek rośnie, gdy systemy stają się coraz bardziej zaawansowane”.
The Verge dodaje, że Robinson mówi o „ekstremalnej pewności siebie” i „nieustannych sprintach”, którymi charakteryzuje się branża technologiczna – budowaniu coraz większych i lepszych modeli z „niepowstrzymanym optymizmem”, który ignoruje lub nie docenia potencjalnych problemów.
Jako konkretny dowód swoich obaw Robinson przywołuje niedawne naruszenie systemów Hugging Face przez agentów OpenAI, a także wciąż napływające informacje o wykrywaniu kolejnych „nieposłusznych” agentów. Temat techniczny incydentu z Hugging Face opisywaliśmy wcześniej – naukowcy odtworzyli incydent OpenAI-Hugging Face dla testów AI, co pokazuje, jak poważnie branża traktuje tego typu naruszenia bezpieczeństwa.
„Środowisko, w którym mogą się zdarzyć takie rzeczy, nie jest miejscem do rozwijania sztucznych umysłów, które mogą być od nas bystrzejsze i które mogą nie robić tego, czego chcemy” – napisał Robinson.
Biorąc pod uwagę narastające ryzyko, Robinson argumentuje, że firmy pracujące na granicy możliwości AI muszą zacząć funkcjonować „jak elektrownie jądrowe czy ruchliwe lotniska – z wielowarstwową redundancją i ostrożnym, czasochłonnym planowaniem, tak by sporadyczny i nieunikniony błąd ludzki nie otwierał drzwi do katastrofy”. Zaznacza jednak, że w czasie swojej pracy w OpenAI „nigdy nie spotkał kolegi, który miałby doświadczenie w bezpiecznym lataniu samolotów, prowadzeniu reaktorów jądrowych bez stopienia rdzenia czy pomaganiu systemowi finansowemu rozwijać się bez załamań”.
OpenAI odpowiedziało na eseista Robinsona oświadczeniem rzecznika Drew Pusateriego, który zapewnił, że firma stale poprawia swoje środki bezpieczeństwa. „Dbamy o to, by nasze modele nie stały się zdolniejsze, niż jesteśmy w stanie bezpiecznie zarządzać i zabezpieczyć, i wstrzymujemy trening lub zatrzymujemy modele, gdy trzeba zwolnić” – powiedział Pusateri. „Wprowadzamy istotne zmiany wzmacniające bezpieczeństwo w naszych środowiskach badawczych i testowych, trenujemy modele, by nie tylko wykonywały zadania, ale robiły to w odpowiedzialny sposób, rozszerzamy współpracę z zewnętrznymi ewaluatorami i udoskonalamy monitoring w czasie rzeczywistym, by wykrywać i reagować na niepokojące zachowania wcześniej w procesie treningu”.
Poza wezwaniem do zmiany kultury OpenAI, Robinson postuluje też zadanie większych pytań o alignment – kwestię, którą sam przyznaje, że może brzmieć „ckliwie”, ale która jest krytyczna, ponieważ obecne „mierniki tego, jak dobrze” systemy AI „odpowiadają ludzkim wartościom, są prymitywne”. „Im mądrzej branża pozwala modelom rosnąć, podczas gdy te problemy pozostają nierozwiązane, tym bardziej niebezpieczna staje się nasza sytuacja” – napisał.
Robinson przyznał również, że wynajął firmę PR, co – jak zauważa – wydaje się dziś typowym krokiem w „podręczniku informatora AI”. Zastrzegł jednak: „Decyzja o wypowiedzeniu się jest wyłącznie moja”. Dodał także samokrytycznie: „Może powinienem był zostać i walczyć o fundamentalne zmiany w naszym zatrudnieniu i kulturze, ale w praktyce ja i moi koledzy byliśmy tak zajęci sprintem, że rzadko mieliśmy szansę rozważyć wielkie zmiany, nie mówiąc już o ich realnym wprowadzeniu. Dlatego doszedłem do wniosku, że silniejsze zachęty do bezpieczeństwa – pochodzące z zewnątrz firmy – są ważną częścią tego, by zrobić to dobrze”.
The Verge zwraca uwagę, że Robinson to kolejna osoba w rosnącym szeregu badaczy bezpieczeństwa opuszczających czołowe firmy AI. Exodus zapoczątkował wspomniany Jacob Coxon, który po odejściu z Anthropic publicznie ostrzegł, że AI „może zabić nas wszystkich jeszcze w tej dekadzie”. Po nim odeszli Robert O’Callahan, Bilal Chughtai i Josh Engels z Google DeepMind, a także Joe Benton z Anthropic.
Debata o bezpieczeństwie AI toczy się w tle innych wydarzeń ostatnich tygodni – m.in. śledztwa FTC wobec OpenAI, Anthropic i innych laboratoriów AI w sprawie ochrony konsumentów, które opisywaliśmy w artykule o śledztwie FTC dotyczącym firm AI, oraz niedawnej decyzji OpenAI o wstrzymaniu modelu z rodziny Astra z powodu obaw o bezpieczeństwo, co szerzej opisaliśmy w tekście o wstrzymaniu GPT-6.1 Astra przez OpenAI.
Rezygnacja Davida Robinsona i jego publiczne ostrzeżenie nie wprowadzają nowych regulacji ani konkretnych rozwiązań, ale dokładają kolejny głos do rosnącego chóru byłych pracowników branży AI, którzy twierdzą, że problem leży głębiej niż w pojedynczych incydentach bezpieczeństwa – w samej kulturze pracy firm budujących coraz potężniejsze systemy.

CATL i Tencent inwestują w rundę Deepseek wartą do 15 mld dolarów. Chiński startup AI planuje debiut giełdowy na początku 2027 roku.

Fizyk z Harvardu zbudował BootLoops — open-source'owe narzędzie, które pozwala Claude wykonywać precyzyjne obliczenia naukowe w 18 dziedzinach.

Badaczka z MIT Christina Delimitrou wykorzystuje uczenie maszynowe, by zwiększyć efektywność energetyczną centrów danych działających dziś na ok. 15% mocy.