Odtajnione dokumenty sądowe NYT ujawniają, że OpenAI i Microsoft znały ryzyko 'doom loopa' i mimo to skrobały treści wydawców.

Źródło zdjęcia: The Verge
Odtajnione dokumenty procesowe w sprawie New York Times przeciwko OpenAI i Microsoftowi ujawniają, że obie firmy doskonale wiedziały, jaki los czeka wydawców internetowych – i mimo to kontynuowały swoją strategię. Wewnętrzna dokumentacja Microsoftu ostrzegała, że firma uruchamia „doom loop”, który zniszczy sieć, a skrobanie danych do treningu modeli opisywano jako „największą kradzież pracy w historii ludzkości”, która robi „kompletne pośmiewisko z idei uczciwego użytku” (fair use).
Wstęp do dokumentu cytuje Hechta i szefa produktu ChatGPT w OpenAI w sposób, który – jak sugeruje pozew – ukazuje, że firmy zdawały sobie sprawę, że stanowią „egzystencjalną groźbę” dla wydawców, takich jak New York Times. Wewnętrzny dokument Microsoftu formułuje to jeszcze mocniej: „Nasza strategia treściowa dla AI uruchomiła 'doom loop', który zaszkodzi jednocześnie wydajności naszych modeli i całej sieci: to niezwykle nietypowe, gdy produkt końcowy zagraża ekonomicznym fundamentom swoich niezbędnych dostawców, ale to właśnie sytuacja, którą stworzyliśmy dla naszego biznesu LLM w odniesieniu do 'łańcucha dostaw treści'”.
Satya Nadella przyznał w swoim zeznaniu, że chatboty w praktyce zastąpiły wyszukiwanie i usunęły potrzebę docierania bezpośrednio do źródła informacji. To potwierdza wcześniejsze doniesienia o skrobaniu treści przez Microsoft, które opisywano jako największą kradzież pracy w historii.
Rzecznik Microsoftu Haurek bronił jednak zeznań szefa firmy, argumentując, że „świadectwo Satyi i stanowisko Microsoftu w tej sprawie są całkowicie spójne. Mówił o szerokich zasadach i zmianach zachodzących w sposobie, w jaki ludzie znajdują i konsumują informacje. Te obserwacje nie powinny być mylone z wnioskami dotyczącymi kwestii praw autorskich przed sądem, którymi Microsoft zajmuje się w swoich pismach procesowych”.
Dokumenty pokazują też sprzeczności między publicznymi deklaracjami a praktyką firm. Nadella twierdził, że „wszystko, co jest za paywallem, powinno być licencjonowane” – jednak przedstawiciel OpenAI przyznał, że nie ma świadomości jakichkolwiek działań mających na celu wykrywanie lub usuwanie treści zza paywalla ze zbiorów treningowych.
Współzałożyciel OpenAI Greg Brockman z kolei wykazał się większym zainteresowaniem „gazylionami” dolarów, które firma mogłaby zarobić na komercyjnej AI, niż altruistycznymi motywacjami, na które firmy publicznie się powołują.
Wewnętrzna dokumentacja OpenAI potwierdza również, że firma dobrze wiedziała o tendencji ChatGPT do dosłownego reprodukowania materiałów objętych prawami autorskimi. Choć pracownicy uznawali „zapobieganie memoryzacji” za istotne dla „minimalizowania naruszeń praw autorskich”, jednocześnie przyznawali, że GPT-4 „zapamiętał ogromną ilość danych i dlatego będzie niesamowicie dobry w regurgitacji”. Pozew przywołuje konkretne przykłady sytuacji, w których ChatGPT generował długie fragmenty tekstu wprost z artykułów New York Times, Mercury News, The Denver Post, LifeHacker i Eurogamer w odpowiedzi na zapytania użytkowników.
Microsoft z kolei zdawał sobie sprawę, jak jego masowe skrobanie internetu zostanie odebrane, przyznając wewnętrznie, że „prawie nikt nie zamierzał, aby treści, które stworzył, były wykorzystywane w ten sposób, i nikt nie jest za to wynagradzany”.
Dyrektor polityki OpenAI Jack Clark miał wyraźnie widzieć nadchodzące konsekwencje, mówiąc, że firma „tworzy systemy zastępujące pracę ludzi, którzy definiują 'kulturę' społeczeństwa”. Wewnętrzne dokumenty opisywały ChatGPT jako „nowoczesny kiosk z prasą”. Nick Turley, szef ChatGPT w OpenAI, miał z kolei powiedzieć, że gdy użytkownik dostanie odpowiedź od chatbota, nie ma już „dobrego powodu, by klikać” w link do źródła.
Microsoft przyznał wprost, że „LLM-y są produktem, który niszczy swój własny łańcuch dostaw”, ponieważ w wielu przypadkach zastępują dane, na których same zostały wytrenowane. Eksperci medialni i ekonomiczni z OpenAI mieli powiązać spadek ruchu z odnośników do stron takich jak New York Times bezpośrednio z podsumowaniami generowanymi przez AI, takimi jak Google AI Overviews, szacując, że ruch z wyszukiwania może spadać nawet o 60 procent.
Z odtajnionego dokumentu wynika jasno, że obie firmy zdawały sobie sprawę, że nieodwracalnie zaszkodzą branży wydawniczej, zatrudniającej „miliony ludzi”, a przez to również własnemu produktowi – ale kontynuowały działania w pogoni za „gazylionami” dolarów, niezależnie od przewidywanego „doom loopa”.

Suno uruchomiło funkcję Speech w becie – pierwszy model audio generujący głos i muzykę AI jako jeden spójny utwór.
Konferencja EmTech Future 2026 MIT Technology Review pokazała, jak AI zaczyna przenikać kwanty, energię, biologię i robotykę.
Android Authority odnalazło w kodzie APK dowody na rozszerzenie funkcji Call for Me w Gemini na rozmowy z rodziną i znajomymi.