OpenAI wdraża textGrain – niewidzialny znak wodny w tekstach ChatGPT i Codexa dla użytkowników UE, zgodnie z wymogami AI Act.

Źródło zdjęcia: Spider's Web
OpenAI uruchamia nowy mechanizm, który ma pomóc odróżniać tekst napisany przez człowieka od tekstu wygenerowanego przez model językowy. Jak informuje Spider's Web, firma zaczęła znakować odpowiedzi ChatGPT i Codexa niewidzialnym, statystycznym sygnałem – ale na razie tylko dla użytkowników z Unii Europejskiej. To efekt wejścia w życie unijnych przepisów o przejrzystości systemów AI wynikających z AI Act.
Przez lata jednym z największych problemów generatywnej sztucznej inteligencji było to, że po wygenerowaniu tekstu praktycznie nie dało się jednoznacznie stwierdzić, czy napisał go człowiek, czy model. Powstawały różne narzędzia do wykrywania treści AI, ale ich skuteczność była – i wciąż jest – co najmniej dyskusyjna. Nowy system OpenAI, nazwany textGrain, ma to zmienić, choć sama firma nie kryje, że to rozwiązanie dalekie od idealnego.
Nowa technologia OpenAI nie ma nic wspólnego z klasyczną cyfrową steganografią znaną z plików graficznych czy audio. Firma opisuje ją jako system dodający do generowanego tekstu niewidoczny statystyczny sygnał ukryty w sposobie doboru słów przez model. Nie ma tu ukrytych znaków, dodatkowych spacji czy egzotycznych symboli – model w subtelny sposób preferuje określone warianty słów lub konstrukcji językowych, pozostawiając charakterystyczny wzorzec, który może wykryć odpowiednie narzędzie.
Z perspektywy osoby korzystającej z ChatGPT tekst ma wyglądać dokładnie tak samo jak dotychczas. Zmiana zachodzi wyłącznie na poziomie statystycznym i jest praktycznie nieodczuwalna dla człowieka. Jak podaje OpenAI, skuteczność wykrywania rośnie wraz z długością tekstu, ale jest ogólnie znacznie niższa w przypadku treści o ograniczonej swobodzie doboru słów – jako przykład firma podaje teksty matematyczne, w przeciwieństwie do bardziej swobodnych odpowiedzi z dziedziny psychologii.
Przepisy unijne, które skłoniły OpenAI do wdrożenia tego rozwiązania, nie wymagają umieszczania na wygenerowanym tekście wielkiego napisu „Wygenerowano przez AI”. Chodzi raczej o identyfikację techniczną, odczytywalną przez narzędzia i systemy informatyczne, a celem regulacji jest walka z dezinformacją, manipulacją, podszywaniem się pod inne osoby i zalewaniem internetu syntetycznymi treściami.
Firma bardzo ostrożnie opisuje możliwości nowego systemu i otwarcie przyznaje, że tekstowe znaki wodne są wciąż wczesną technologią z poważnymi ograniczeniami. Dobre wyniki w warunkach laboratoryjnych nie przekładają się automatycznie na równie wysoką skuteczność w codziennym użytkowaniu. OpenAI podkreśla, że wykrywanie może generować zarówno fałszywe alarmy, jak i przeoczenia, a samo wykrycie znaku wodnego nie mówi praktycznie nic o autorstwie tekstu, odpowiedzialności za jego treść czy prawdziwości zawartych w nim informacji.
Szczególnie istotne jest to, że edycja może znacząco osłabić siłę znaku wodnego. Firma pokazała, jak zastąpienie 10 proc. lub 25 proc. słów w tekście wpływa na skuteczność jego wykrywania – a wystarczy kilka ręcznych poprawek, parafraza albo przepisanie fragmentów własnymi słowami, by skuteczność detekcji zaczęła gwałtownie spadać.
To ważne zastrzeżenie w kontekście debaty publicznej, w której regularnie pojawiają się pomysły wykorzystania „wykrywaczy AI” w szkołach, na uczelniach czy w procesach rekrutacyjnych jako niepodważalnego dowodu korzystania z modeli językowych. OpenAI przypomina, że technologia po prostu do tego się nie nadaje. Wykrycie znaku wodnego oznacza jedynie, że w tekście znaleziono sygnały charakterystyczne dla systemu OpenAI – nie oznacza, że tekst został napisany wyłącznie przez AI, ani że człowiek nie dokonał później rozległych zmian. W praktyce jest to raczej wskazówka niż wyrok.
Przez najbliższe tygodnie niewidzialne oznaczenia mają pojawiać się wyłącznie w kwalifikujących się odpowiedziach ChatGPT i Codexa generowanych dla użytkowników z Unii Europejskiej. Klienci korzystający z API OpenAI na całym świecie będą mogli samodzielnie zdecydować, czy chcą aktywować znakowanie treści – funkcja pozostanie domyślnie wyłączona. To wymowna decyzja, która pokazuje, że poza UE OpenAI nie zamierza na razie wprowadzać znakowania jako standardu.
Sam znak wodny jest tylko częścią znacznie większej układanki, którą branża określa mianem „provenance”, czyli śledzenia pochodzenia treści. OpenAI od dłuższego czasu rozwija technologie pozwalające identyfikować obrazy, dźwięki i inne materiały generowane przez AI, wykorzystując między innymi standard C2PA, który pozwala zapisywać metadane opisujące pochodzenie plików.
W perspektywie kilku lat mechanizmy te mogą okazać się jednym z najważniejszych technologicznych frontów walki z dezinformacją. Internet coraz bardziej przypomina środowisko, w którym praktycznie każdy obraz, nagranie audio, film czy tekst może być wygenerowany przez maszynę, a samo rozpoznawanie treści „na oko” przestaje mieć sens. Problem polega jednak na tym, że nie istnieje rozwiązanie idealne – metadane można usuwać, znaki wodne próbować obchodzić, a teksty przepisywać i parafrazować.
Jako kraj Unii Europejskiej Polska podlega tym samym przepisom AI Act, które wymusiły na OpenAI wdrożenie znakowania treści. Polscy użytkownicy ChatGPT i Codexa powinni więc otrzymywać odpowiedzi z niewidzialnym znakiem wodnym textGrain na takich samych zasadach jak pozostali obywatele UE. W praktyce oznacza to, że polskie instytucje edukacyjne, redakcje czy firmy, które chciałyby wykorzystywać wykrywanie treści AI jako dowód w sporach – na przykład przy podejrzeniu plagiatu czy pracy napisanej przez model – powinny pamiętać o ograniczeniach tej technologii, wyraźnie podkreślanych przez samą OpenAI. Znak wodny to wskazówka, nie dowód ostateczny, a jego skuteczność drastycznie spada po edycji tekstu.
System textGrain to dopiero pierwszy krok w walce o przejrzystość treści generowanych przez AI – i, jak sama OpenAI przyznaje, krok wciąż niedoskonały. Skuteczność wykrywania zależy od długości tekstu, jego charakteru oraz tego, czy ktoś poddał go edycji, a znaki wodne nie zastąpią rzetelnej weryfikacji źródła informacji.

Framework ADSD łączy diagnozę błędów z reużywalnymi umiejętnościami solvera, redukując błąd o niemal 71 razy w testach przepływu mocy.

Badanie Highwire: 78% menedżerów używa AI do ocen pracowników, ale tylko 16% podwładnych wie o tym wpływie.

OpenAI umieściło na GitHubie 372 wyniki matematyczne stworzone przez AI, dzieląc świat matematyki wobec tempa i formy ich publikacji.