ChatGPT zostawi niewidzialny ślad. OpenAI ma sposób na wykrywanie tekstów AI
ChatGPT zostawi niewidzialny ślad. OpenAI ma sposób na wykrywanie tekstów AI
OpenAI chce sprawić, by tekst wygenerowany przez ChatGPT można było rozpoznać nawet wtedy, gdy nie widać żadnych oznaczeń. Firma opracowała niewidzialny znak wodny, który ukrywa się w sposobie dobierania słów.
OpenAI opracowało technologię, która ma pozwolić rozpoznać tekst wygenerowany przez sztuczną inteligencję. Rozwiązanie nazwane textGrain działa podobnie do niewidzialnego znaku wodnego – tyle że zamiast obrazu czy dźwięku oznacza tekst.
Firma poinformowała, że w najbliższych tygodniach zacznie stosować tę technologię w wybranych odpowiedziach ChatGPT i Codex w Unii Europejskiej. Jednocześnie klienci korzystający z API OpenAI na całym świecie będą mogli dobrowolnie włączyć znakowanie tekstu.
WIDEO
Byłem w chińskim Apple Storze. Porównałem ceny iPhone'ów z polskimi
Dlaczego akurat Unia Europejska?
Powód jest prosty: unijne przepisy dotyczące sztucznej inteligencji. OpenAI rozwija textGrain m.in. w odpowiedzi na wymagania wynikające z AI Act. Przepisy nakładają na dostawców generatywnej AI obowiązek umożliwienia identyfikacji treści wygenerowanych przez ich systemy w sposób możliwy do odczytania przez maszyny. Wcześniej podobne rozwiązanie wprowadził Claude.
Dlatego właśnie to użytkownicy ChatGPT i Codex w Unii Europejskiej będą jednymi z pierwszych, którzy otrzymają teksty z niewidocznym znakiem wodnym. OpenAI zaznacza jednocześnie, że na początku nie zamierza wprowadzać takiego rozwiązania jako globalnego standardu. Firma chce najpierw zebrać doświadczenia z rzeczywistego wykorzystania technologii i sprawdzić jej ograniczenia.
Ukryty sygnał w doborze słów
textGrain nie dodaje do tekstu widocznego komunikatu ani specjalnego symbolu. Technologia wykorzystuje statystyczny sygnał ukryty w sposobie wybierania słów przez model. Człowiek czytający tekst nie powinien zauważyć żadnej różnicy. Specjalny detektor może natomiast sprawdzić, czy analizowany fragment zawiera charakterystyczny sygnał pozostawiony przez model OpenAI.
Według firmy w przeprowadzonych testach textGrain osiągał wyniki porównywalne lub lepsze od innych sprawdzanych przez nią metod, w tym SynthID dla tekstu. OpenAI podkreśla jednak, że nie oznacza to niezawodnego wykrywania każdego tekstu wygenerowanego przez AI.
Wystarczy zmienić kilka słów?
Tu pojawia się istotny problem. Znak wodny można osłabić, modyfikując tekst. W testach OpenAI detektor poprawnie rozpoznawał około 92 proc. niezmodyfikowanych, 400-tokenowych fragmentów. Po zastąpieniu zaledwie 10 proc. słów synonimami skuteczność spadała do około 66 proc. Przy zmianie 25 proc. słów było to już tylko 17 proc.
Znaczenie ma również długość tekstu. Przy założonym poziomie fałszywych alarmów na poziomie 1 proc. system wykrywał znak w około 80 proc. fragmentów liczących 200 tokenów i około 95 proc. fragmentów 400-tokenowych w przypadku treści dotyczących psychologii. Znacznie gorzej radził sobie z matematyką, gdzie model ma mniejszą swobodę wyboru słów.
To oznacza, że krótki wpis, mocno przeredagowany tekst czy odpowiedź dotycząca dziedziny o bardzo ograniczonym słownictwie mogą być znacznie trudniejsze do zweryfikowania.
OpenAI podkreśla też ważne ograniczenie. Wykrycie znaku nie oznacza, że wiadomo, kto korzystał z ChatGPT ani w jakim stopniu AI pomogła w stworzeniu tekstu. Znak wodny nie pozwala ustalić autora, użytkownika, konta, promptu ani rozmowy, z której pochodzi treść. Nie odpowie też na pytanie, czy tekst jest prawdziwy, czy został wykorzystany zgodnie z prawem.
Co więcej, brak wykrytego znaku nie będzie dowodem na to, że tekst napisał człowiek. Sygnał może zostać osłabiony przez edycję, tłumaczenie albo zbyt krótki tekst. Może też chodzić o starszy lub nieobsługiwany model albo narzędzie innej firmy.
OpenAI na razie nie udostępni detektora wszystkim
Samo znakowanie tekstu ma być szerzej dostępne, ale z detektorem sytuacja wygląda inaczej. OpenAI otworzyło możliwość składania wniosków o dostęp, jednak początkowo narzędzie otrzymają wybrani badacze i organizacje eksperckie.
Firma tłumaczy to ryzykiem fałszywych wyników. Detektor może bowiem wskazać oznaczenie tam, gdzie go nie ma, albo nie zauważyć sygnału, który rzeczywiście został umieszczony w tekście.
OpenAI zapowiada jednocześnie, że w przyszłości chce udostępnić technologię textGrain jako open source.
To początek walki o pochodzenie treści
OpenAI przedstawia textGrain jako część większego systemu ustalania pochodzenia treści generowanych przez AI. Firma stosuje już podobne rozwiązania w przypadku obrazów i dźwięku, m.in. Content Credentials oraz niewidoczne znaki wodne.
W przypadku tekstu zadanie jest jednak trudniejsze. Tekst można bardzo łatwo przepisać, przeredagować, przetłumaczyć lub połączyć z treścią stworzoną przez człowieka. Dlatego OpenAI nie traktuje textGrain jako ostatecznego sposobu na rozstrzygnięcie, czy tekst napisało AI.
Na razie firma stawia więc na rozwiązanie etapowe. W Unii Europejskiej oznaczenie ma trafić do wybranych tekstów generowanych przez ChatGPT i Codex w najbliższych tygodniach. OpenAI będzie obserwować, jak technologia sprawdza się w praktyce, i na tej podstawie rozwijać zarówno samo znakowanie, jak i sposób wykrywania AI.
Paweł MaziarzRedaktor prowadzący serwis benchmark.pl
Redaktor prowadzący serwis Benchmark.pl, dziennikarz technologiczny z ponad 15-letnim doświadczeniem. Specjalizuje się w tematach związanych ze sprzętem komputerowym, rozwojem technologii AI oraz trendami w branży IT. W swojej pracy stawia na rzetelność, praktyczne podejście i pasję do nowinek technologicznych, koncentrując się na ocenie produktów pod kątem ich wartości i opłacalności dla użytkowników. W wolnym czasie angażuje się w wolontariat, aktywnie spędza czas oraz rozwija swoje zainteresowania i pasje.