2026-10-05 · ← Aktualności
OpenAI zacznie znakować tekst w UE, lecz nie udostępni publicznego detektora
OpenAI w najbliższych tygodniach doda niewidoczny watermark do kwalifikujących się tekstów z ChatGPT i Codex w UE, a klienci API na całym świecie mogą włączyć go dobrowolnie. Ze względu na podatność na edycję i ryzyko błędnych wyników detektor trafi początkowo tylko do zatwierdzonych badaczy i organizacji eksperckich.
Nie udało się wczytać obrazu.
OpenAI odpowiada na obowiązki przejrzystości wynikające z artykułu 50 unijnego AI Act. W najbliższych tygodniach firma doda niewidoczny watermark do kwalifikujących się tekstów z ChatGPT i Codex we wszystkich planach w UE. Nie będzie to globalne ustawienie domyślne. Klienci API na całym świecie mogą włączyć znakowanie dla wybranych modeli, ale w API pozostaje ono domyślnie wyłączone.
textGrain zmienia dobór słów, a nie wygląd dokumentu
Technologia textGrain umieszcza sygnał statystyczny w wyborze słów podczas generowania. Detektor korzystający z tego samego tajnego klucza sprawdza następnie, czy tekst zawiera taki wzorzec. Czytelnik nie widzi oznaczenia. Nie są to też ukryte znaki ani metadata, które znikają po skopiowaniu tekstu.
OpenAI otworzyło również nabór wniosków o dostęp do detektora. Początkowo otrzymają go wyłącznie zatwierdzeni badacze i organizacje eksperckie, oceniane indywidualnie. Narzędzie ma wskazywać obecność watermarku OpenAI, a nie tożsamość użytkownika, jego prompty czy treść rozmów. Firma planuje także udostępnić technologię jako open source.
Europejski przepis tworzy znak bez publicznego czytnika
Dla użytkownika w UE zmienia się sposób generowania tekstu, lecz nie pojawia się publiczne narzędzie do weryfikacji. Programiści korzystający z API mają odwrotny układ: mogą aktywować funkcję globalnie, ale domyślnie pozostaje ona wyłączona. To istotna różnica między obowiązkiem spełnianym w produktach OpenAI a opcją, którą klient API musi poprawnie skonfigurować.
Watermark może wskazać jedynie, że system OpenAI wygenerował lub przetworzył część tekstu. Nie określa autora, udziału pracy człowieka, własności ani prawdziwości treści. Brak wykrycia również nie dowodzi, że tekst napisał człowiek.
Edycja niszczy sygnał szybciej niż znaczenie tekstu
W testach opublikowanych przez OpenAI, przy docelowym poziomie false positive równym 1%, wykrywalność wyniosła około 80% dla tekstów liczących 200 tokenów i 95% dla 400 tokenów w jednym zestawie odpowiedzi z psychologii. W teście edycji tekstu o długości 400 tokenów wynik spadł z około 92% do 66% po zastąpieniu synonimami 10% słów oraz do 17% po zmianie 25%.
To poważne ograniczenie dla szkół, redakcji i systemów moderacji. Tłumaczenie, parafraza lub zwykła redakcja mogą osłabić sygnał, a false positive może zaszkodzić osobie, która rzeczywiście napisała tekst. OpenAI właśnie ryzykiem niewykrytych znaków i błędnych wskazań tłumaczy brak publicznego detektora na starcie.
Niezależne testy pokażą, czy watermark wytrzyma spór
Warto obserwować trzy rzeczy: odporność textGrain na tłumaczenie i zwykłą edycję, listę organizacji otrzymujących dostęp do detektora oraz możliwość niezależnego powtórzenia wyników po publikacji open source. Wykryty znak może wspierać ustalanie provenance, ale nie powinien być jedynym dowodem w sprawie studenta, pracownika lub autora.
Regulacja zmusiła dostawców do umieszczenia maszynowo czytelnego śladu w generowanym tekście. Praktyka musi teraz pokazać, czy da się go odczytywać na tyle wiarygodnie i uczciwie, by nie został tylko zaznaczoną rubryką w compliance.
Werdykt Lilith
OpenAI zapisze europejskie teksty niewidzialnym atramentem, a lupę pożyczy tylko wybranym laboratoriom. Znak bez powszechnie dostępnego i wiarygodnego czytnika lepiej chroni compliance niż człowieka oskarżonego o oszustwo.
Link zewnętrzny zostawiam na koniec. Najpierw krótkie wyjaśnienie tutaj, bez polowania po cudzej stronie.
Oryginalne źródło ↗ ↗