Anthropic aktualizuje politykę użytkowania Claude, zakazując okrutnego traktowania modelu, propagandy, inwigilacji i rozwoju broni.

Źródło zdjęcia: The Verge
Anthropic po ponad roku wprowadza istotne zmiany w polityce użytkowania Claude, zakazując m.in. „uporczywego i niepotrzebnego okrutnego lub obraźliwego zachowania” wobec modelu. Nowa polityka użytkowania obejmuje też nowe zasady dotyczące kampanii propagandowych, inwigilacji oraz rozwoju broni.
W sierpniu ubiegłego roku Anthropic ogłosił, że Claude będzie mógł kończyć rozmowy z użytkownikami wykazującymi „uporczywie szkodliwe lub obraźliwe” zachowanie — w ramach badań nad „dobrostanem modelu”. Nowa aktualizacja polityki potwierdza, że przerwanie rozmowy pozostaje „podstawowym mechanizmem egzekwowania” tej zasady. Anthropic nie skomentował, czy planowane są dodatkowe mechanizmy, takie jak potencjalne blokady kont użytkowników.
Firma zaznacza, że nowy zakaz „ma zastosowanie tylko w ekstremalnych przypadkach, gdy użytkownicy wielokrotnie zachowują się okrutnie wobec naszych modeli, bez żadnego wyraźnego celu. Nie dotyczy to typowych przejawów frustracji użytkownika, sprzeciwu, mrocznych tematów kreatywnych czy testowania i badania modelu”.
Kwestia potencjalnej świadomości modeli AI powraca w Anthropic regularnie. Kyle Fish, szef zespołu badającego dobrostan modeli w firmie, powiedział w lutym serwisowi The Verge: „Pytania o potencjalne wewnętrzne doświadczenie, świadomość, status moralny i dobrostan to poważne kwestie, które badamy, gdy modele stają się coraz bardziej zaawansowane i zdolne”. W tym samym miesiącu CEO Anthropic Dario Amodei powiedział w podcaście: „Nie wiemy, czy modele są świadome”.
Nie wszyscy w branży podzielają takie podejście. We wrześniu kodeks postępowania Microsoft AI zwrócił uwagę stanowiskiem w tej sprawie — we wcześniejszej wersji dokumentu opublikowanej przez Mustafę Suleymana napisano: „Idea dobrostanu modelu jest błędna. AI nie powinny mieć praw ani osobowości prawnej”. Dokument został później zmieniony na bardziej wyważoną wersję: „Choć nauka o świadomości AI jest daleka od ustalonej... odrzucamy dążenie do osobowości prawnej czy ideę, że modele mogłyby zasługiwać na dobrostan lub być uprawnione do praw”.
Poza zmianą dotyczącą dobrostanu modelu, Anthropic zebrał kilka wcześniej „rozproszonych” ograniczeń w nowy zakaz dotyczący zwodniczych kampanii komercyjnych i politycznych, odpowiadając na narastający problem propagandy generowanej przez AI. Nowa zasada ogranicza „działania mające na celu ukrycie, kto stoi za przekazem, lub wzmacnianie treści poprzez fałszywe konta czy posty”. Sekcja dotycząca wyborów zakazuje też oszukiwania wyborców i zakłócania procesu wyborczego — w tym rozpowszechniania dezinformacji „o kandydatach lub sposobie głosowania, podawania się za kandydatów czy urzędników wyborczych, lub próby ograniczania frekwencji”, jak napisał Anthropic.
Firma podkreśla, że choć jej polityka użytkowania od początku publicznie zakazywała wykorzystania Claude do rozwoju broni, zaobserwowano wielokrotne próby użycia modelu do opracowywania instrukcji i oprogramowania kontrolującego uzbrojenie. Nowa polityka rozszerza więc zakaz na „oprogramowanie i komponenty, które sprawiają, że broń działa, a także działania takie jak uzbrajanie dronów i innych pojazdów autonomicznych”.
Zasady dotyczące inwigilacji zostały sformułowane jasniej po tym, jak ostatni raport Anthropic na temat zagrożeń wskazał na rosnące wykorzystanie Claude przez systemy inwigilacyjne do identyfikowania i śledzenia „dysydentów politycznych”. „Śledzenie ludzi bez ich zgody jest zakazane, niezależnie od tego, czy odbywa się w czasie rzeczywistym, czy poprzez analizę wcześniej zebranych danych” — napisał Anthropic. „Claude nie może być używany do podejmowania decyzji lub rekomendowania, kogo należy zbadać, zatrzymać lub obciążyć w ramach postępowania organów ścigania lub wymiaru sprawiedliwości. Zakazujemy również wykorzystywania Claude do budowania lub ulepszania narzędzi przeznaczonych do inwigilacji”.
Anthropic zastrzega jednak, że te zasady mogą być modyfikowane w przypadku „kontraktów z określonymi klientami rządowymi... jeśli w ocenie Anthropic ograniczenia umowne i odpowiednie zabezpieczenia są wystarczające do minimalizacji potencjalnych szkód”. Firma wcześniej współpracowała z amerykańskimi siłami zbrojnymi.
Anthropic dodał również nową zasadę dotyczącą sytuacji, gdy jego modele AI są „podłączone do sprzętu wykonującego autonomiczne działania fizyczne, który może być zdolny do wyrządzenia szkody”. W takich przypadkach „wykwalifikowany operator musi być w stanie obserwować urządzenie i zatrzymać je w razie potrzeby”. Nie jest jasne, czy operator musi być człowiekiem. Zasada ta odzwierciedla narastający trend inwestowania przez laboratoria AI w robotykę i inny sprzęt, który daje systemom AI fizyczne „ciała” — co może wskazywać na przyszłe partnerstwa Anthropic w tym obszarze, podobnie jak postępujący rozwój humanoidalnych robotów AI w całej branży.
Zmiany w polityce użytkowania pokazują, że Anthropic coraz poważniej traktuje nie tylko ryzyka związane z niewłaściwym wykorzystaniem swoich modeli przez użytkowników, ale i kwestie etyczne związane z samym traktowaniem AI — temat, który dzieli liderów branży i prawdopodobnie będzie zyskiwał na znaczeniu wraz z rozwojem coraz bardziej zaawansowanych systemów.

Badanie Aleph Alpha pokazuje, że chińskie modele AI jak Qwen czy DeepSeek powtarzają linię partyjną na tematy tabu, np. Tiananmen i Tajwan.

Framework REACT redukuje błąd rekonstrukcji pH oceanu o 14,7% i błąd chemiczny o 24% dzięki modelowaniu zgodnemu z cyklem węgla.

Rzeczniczka OpenAI przerwała wywiad Vanity Fair z Samem Altmanem, gdy dziennikarz zapytał o samobójstwo użytkowniczki ChatGPT.