OpenAI dodaje niewidoczny znak wodny ChatGPT do tekstów czatbota oraz wyników kodowania Codex w całej Unii Europejskiej. Jednak własne testy firmy pokazują, że zamiana jednej czwartej słów na synonimy obniża wykrywalność do zaledwie 17%.
To posunięcie odpowiada unijnemu Aktowi o AI, czyli zbiorowi przepisów, który wymaga maszynowo odczytywalnych etykiet na generowanych przez AI tekstach. Jednak OpenAI przyznaje, że technologia jest niedojrzała, dlatego detektor pozostaje na razie niedostępny publicznie.
Jak silny jest znak wodny ChatGPT po edycji tekstu?
Zgodnie z ogłoszeniem, system o nazwie textGrain wpływa na wybór słów przez model, zostawiając ukryty wzorzec statystyczny. Oddzielny detektor skanuje fragmenty tekstu w poszukiwaniu tego wzorca.
Znak wodny znajduje się w samym doborze słów — tłumaczy OpenAI w swoim FAQ. Nie dodaje żadnych ukrytych znaków, niewidzialnych spacji czy nietypowej interpunkcji. Dlatego popularny trik z usuwaniem ukrytych znaków nic nie daje.
Długość ma duże znaczenie. OpenAI mierzy tekst w tokenach, czyli fragmentach słów, które przetwarzają modele AI. Jeden token to około trzy czwarte angielskiego słowa.
W testach OpenAI detektor wykrył około 66% nieedytowanych odpowiedzi liczących około 150 słów. Przy około 300 słowach wskaźnik wzrósł do około 92%.
Lekka edycja osłabia znak wodny ChatGPT. W tekstach o długości 300 słów zamiana jednego słowa na dziesięć na synonim obniżyła wykrywalność z 92% do 66%. Wymiana jednego słowa na cztery obniżyła ją do zaledwie 17%.
Znak wodny niemal nie wpłynął na wyniki testów porównawczych GPT-6 Astra OpenAI, najnowszego modelu firmy.
Dlaczego OpenAI nie udostępnia detektora publicznie?
Zamiast publicznego narzędzia OpenAI przyjmuje zgłoszenia od zatwierdzonych naukowców i wyspecjalizowanych instytucji. Firma podkreśla, że pozytywny wynik nie ujawnia użytkownika, promptu ani rozmowy.
Negatywny wynik również niewiele mówi. Krótkie, edytowane lub przetłumaczone teksty łatwo omijają detektor. To samo dotyczy wyników konkurencyjnych narzędzi AI.
Brak wykrytego znaku wodnego nie udowadnia, że autorem był człowiek.
Obrazy i dźwięk działają inaczej. Każdy może załadować takie pliki do publicznego narzędzia OpenAI verify i sprawdzić znak wodny SynthID.
Poza Europą znak wodny ChatGPT jest domyślnie wyłączony. Klienci API na całym świecie mogą jednak teraz włączyć go dla wybranych modeli w ustawieniach projektu lub organizacji.
Wdrożenie nastąpiło po sierpniowym rozpoczęciu egzekwowania przepisów o przejrzystości Aktu AI UE. Dla branży krypto stawka jest konkretna, bo wykorzystanie AI przez przestępców wzrosło o 40% rok do roku według TRM Labs.
Luka między żądaniami regulatorów a możliwościami detektorów zapewne zdecyduje, jak każde duże laboratorium AI podejdzie do zgodności z przepisami.









