OpenAI wprowadza niewidzialny znak wodny w ChatGPT i Codex na terenie UE
OpenAI planuje w najbliższych tygodniach oznaczać teksty generowane przez ChatGPT i Codex niewidocznym znakiem wodnym, obejmując tym rozwiązaniem użytkowników z Unii Europejskiej. Mechanizm ma pozwalać wykrywać treści stworzone przez AI, choć na razie jego skuteczność jest ograniczona.
Firma OpenAI przygotowuje modyfikację, która dla przeciętnego użytkownika będzie praktycznie niezauważalna, choć jej konsekwencje mogą być istotne. Zgodnie z zapowiedzią, już wkrótce treści tworzone przez ChatGPT oraz Codex na obszarze Unii Europejskiej zostaną opatrzone niewidzialnym znakiem wodnym. Żaden symbol, gwiazdka czy dopisek nie zdradzą, że dany fragment powstał z pomocą maszyny - nic takiego nie da się zobaczyć ani podczas odczytu, ani przy kopiowaniu tekstu. Mimo to będzie istniała możliwość ustalenia, że dana treść została wygenerowana przez sztuczną inteligencję.
ChatGPT ze znakiem wodnym. Wcześniej zapowiadał to Claude
Rozwiązanie opracowane przez OpenAI funkcjonuje pod nazwą textGrain. Mechanizm subtelnie wpływa na to, jakie słowa wybiera model podczas generowania odpowiedzi, dzięki czemu w tekście tworzy się rozpoznawalny wzorzec statystyczny. Dla człowieka jest on całkowicie niewidoczny, natomiast dedykowany algorytm jest w stanie go zidentyfikować, ponieważ posiada odpowiedni klucz. Warto zaznaczyć, że OpenAI nie jest pionierem w tej dziedzinie - Anthropic, firma stojąca za Claude'em, testuje analogiczne technologie już od pewnego czasu. OpenAI podąża więc za rozwiązaniem, które wcześniej zaczął rozwijać konkurent.
Nie ma mowy o tym, żeby każdy mógł teraz samodzielnie wkleić fragment tekstu do jakiegoś narzędzia i uzyskać stuprocentową pewność, czy powstał on za pomocą AI. Obecnie dostęp do takiej funkcji otrzymają jedynie wybrani naukowcy oraz instytucje specjalizujące się w tej tematyce. W praktyce oznacza to, że nauczyciel nie będzie w stanie w ten sposób zweryfikować, czy uczeń skorzystał ze wsparcia sztucznej inteligencji podczas pisania wypracowania.
To raczej dobra wiadomość, bo skuteczność całego rozwiązania wciąż budzi wątpliwości. Przeprowadzone testy na próbkach tekstu o długości 400 tokenów wykazały, że zamiana jedynie 10 procent słów na synonimy potrafi zmniejszyć wykrywalność z poziomu około 92 procent do 66 procent. Gdy odsetek podmienionych wyrazów wzrósł do 25 procent, skuteczność detekcji spadła już do 17 procent. Oznacza to, że odpowiednie przeredagowanie tekstu w zasadzie usuwa znak wodny. W przypadku dziedzin takich jak matematyka, gdzie model ma znacznie mniejszą swobodę w konstruowaniu wypowiedzi, rozpoznawalność wypada jeszcze słabiej.
OpenAI podkreśla przy tym, że nieznalezienie znaku wodnego w tekście nie jest dowodem na to, że autorem był człowiek - zasada ta działa też w odwrotnym kierunku. System nie udostępnia również żadnych informacji dotyczących tego, kto wygenerował treść, z jakiego konta korzystał, jaki prompt zastosował ani jak duży był faktyczny wkład pracy ze strony użytkownika.
Źródło: AntyWeb


