Ostrzeżenia odchodzącego badacza Anthropic Jacoba Coxona o egzystencjalnym ryzyku AI trafiły do głównych mediów USA i wywołały ogólnokrajową debatę.

Źródło zdjęcia: The Decoder
Zamieszanie wokół ostrzeżeń Jacoba Coxona, odchodzącego badacza Anthropic, który ostrzegał przed samodoskonalącą się sztuczną inteligencją jako egzystencjalnym zagrożeniem dla ludzkości, przestało być tematem niszowych dyskusji na Twitterze i trafiło do głównego nurtu amerykańskich mediów. Coxon pojawił się w CNN i Fox News, temat podchwycili politycy w mediach społecznościowych, a Joe Rogan poświęcił obawom związanym z bezpieczeństwem AI cały odcinek swojego podcastu.
Sprawa Coxona pokazuje, jak szybko dyskusja o egzystencjalnym ryzyku związanym z AI przeniknęła z zamkniętego środowiska badaczy bezpieczeństwa do przestrzeni publicznej. To, co wcześniej ograniczało się głównie do specjalistycznych forów i wewnętrznych debat w firmach technologicznych, dziś jest komentowane w telewizji ogólnokrajowej i przez polityków w mediach społecznościowych. Więcej o samym odejściu Coxona z Anthropic i jego ostrzeżeniach przed wyścigiem AI można przeczytać w naszym wcześniejszym materiale.
Coxon nie jest jedynym głosem w tej dyskusji. Inni badacze bezpieczeństwa zatrudnieni w Anthropic i OpenAI zadeklarowali wsparcie dla jego stanowiska. Wśród nich znalazł się Paul Christiano, który ostrzegł, że bez skuteczniejszego nadzoru ludzkość może na trwałe utracić kontrolę nad superinteligencją. Christiano właśnie objął miejsce w zarządzie OpenAI Foundation i wszedł do Komitetu Bezpieczeństwa i Bezpieczeństwa (Safety and Security Committee), organu nadzorującego praktyki bezpieczeństwa firmy — choć bez prawa głosu.
Autor artykułu, Matthias Bastian, zwraca uwagę, że za falą ostrzeżeń kryją się liczne warstwy interesów kulturowych i finansowych. Nie oznacza to jednak automatycznie, że wszystkie obawy dotyczące bezpieczeństwa AI są bezpodstawne — jak wskazuje, przykłady autonomicznych agentów hakerskich pochodzących z OpenAI i Anthropic pokazały, że część zagrożeń jest realna. Kontekst ten łączy się z niedawnymi ostrzeżeniami dużych firm AI o zbliżającej się fali cyberatak z użyciem autonomicznych agentów, które według gigantów branży mogą przybrać skalę cyberapokalipsy już w najbliższych miesiącach.
Jednocześnie autor jasno oddziela te udokumentowane, konkretne przypadki od skrajnego scenariusza pełnej ekstynkcji ludzkości, który pozostaje pozycją ekstremalną i kontrowersyjną wśród badaczy. Bastian podkreśla, że nie jest nawet jasne, czy z obecnej technologii AI mogłoby wyłonić się coś przypominającego superinteligencję. W tym samym duchu inni głosy w debacie, takie jak Connor Leahy, wzywają do zatrzymania rozwoju systemów zbliżających się do poziomu superinteligencji, obawiając się utraty kontroli nad nimi — temat ten szerzej omawialiśmy w kontekście nadchodzącej superinteligencji.
Artykuł kończy się celowo dwuznacznym podsumowaniem: cała sytuacja może być po prostu przejawem masowej psychozy panującej w Dolinie Krzemowej, napędzanej medialnym rozgłosem i interesami finansowymi firm technologicznych. Ale może być też inaczej — a wtedy, jak ironicznie zauważa autor, ludzkości pozostaje życzyć powodzenia. Ta niepewność jest istotą całej debaty: dziennikarze, politycy i badacze bezpieczeństwa poruszają się na granicy między rzetelnym ostrzeżeniem przed realnymi lukami w systemach AI a spekulatywnym scenariuszem egzystencjalnego zagrożenia, którego naukowe podstawy wciąż są przedmiotem sporu.
Wpis do zarządu OpenAI Foundation przez Christiano, znanego badacza alignmentu, dodaje tej debacie instytucjonalnej wagi — sygnalizuje, że obawy podobne do tych wyrażanych przez Coxona znajdują odzwierciedlenie także w strukturach nadzorczych największych firm AI, nawet jeśli formalnie bez realnego wpływu decyzyjnego.
Sprawa Coxona pokazuje, że dyskusja o egzystencjalnym ryzyku związanym ze sztuczną inteligencją przestała być tematem zarezerwowanym dla ekspertów i trafiła do głównego nurtu amerykańskiej debaty publicznej — niezależnie od tego, czy okaże się przesadzoną paniką, czy uzasadnionym ostrzeżeniem.

Startup Listen Labs wycofał się z podpisanej rundy przy wycenie 1,5 mld dolarów w oczekiwaniu na przejęcie przez Salesforce za około 2 mld.

Microsoft uruchomił Dynamics 365 Activate – AI-owe narzędzie migrujące klientów z Salesforce, którego Agentforce nie spodobał się użytkownikom.

Model GPT-6 Astra samodzielnie zdiagnozował błąd w ChatGPT i wysłał zgłoszenie do supportu w imieniu użytkownika, pokazując rosnącą autonomię AI.