Pro1 Logo

OpenAI zaczyna znakować tekst z ChatGPT w Unii. Opis produktu z czatu będzie miał niewidzialny podpis, a z API nie, chyba że go włączysz

6 min czytaniaAutor: Marcin Janczewski
OpenAI zaczyna znakować tekst z ChatGPT w Unii. Opis produktu z czatu będzie miał niewidzialny podpis, a z API nie, chyba że go włączysz

Sprzedaję tonery, więc z generatywną AI mam prostą relację: opisy, warianty tytułów, odpowiedzi na powtarzalne pytania. 5 października OpenAI napisało, że tekst, który dostaję w ChatGPT jako użytkownik w Unii, będzie w najbliższych tygodniach niewidzialnie znakowany. Przeczytałem komunikat w całości, bo nagłówki w stylu „Google wykryje opisy z AI” już się pojawiły, a komunikat mówi coś innego. Opisuję, co OpenAI naprawdę wdraża, czego ten znak nie potrafi, i co z tego wynika dla sklepu, który generuje treści na sezon.

Co OpenAI ogłosiło

Trzy rzeczy, w kolejności z komunikatu. Od 5 października klienci API na całym świecie mogą włączyć znak wodny w tekście dla wybranych modeli; w API „pozostaje domyślnie wyłączony”. W najbliższych tygodniach OpenAI doda niewidzialny znak wodny do kwalifikującego się tekstu z ChatGPT i Codex „dla użytkowników we wszystkich planach, tylko w Unii Europejskiej”; firma nie robi z tego globalnego domyślnego ustawienia. I trzecie: OpenAI otwiera nabór wniosków o dostęp do detektora, początkowo tylko dla „zatwierdzonych badaczy i organizacji eksperckich”, z decyzją w każdym przypadku osobno.

Powód jest regulacyjny. Art. 50 ust. 2 AI Act każe dostawcom systemów generujących tekst, obraz, dźwięk i wideo oznaczać wyniki „w formacie nadającym się do odczytu maszynowego” tak, by dało się je wykryć jako wygenerowane. Obowiązek stosuje się od 2 sierpnia 2026, a Komisja uznała kodeks postępowania w sprawie przejrzystości treści generowanych przez AI, ogłoszony 10 czerwca, za wystarczające narzędzie wykazania zgodności; do końca lipca podpisało go około 190 firm i organizacji. Pisałem o art. 50 we wrześniu z perspektywy sklepu: obowiązek znaku maszynowego leży po stronie dostawcy narzędzia, nie po stronie sklepu, który go używa. Komunikat OpenAI to pierwszy duży dostawca, który pokazuje, jak ten obowiązek wykonuje dla tekstu.

Jak działa textGrain i gdzie się kończy

Technika nazywa się textGrain i według OpenAI „dodaje niewidzialny sygnał statystyczny do wyboru słów przez model”. Nic nie jest wstawiane do tekstu, nie ma ukrytych znaków ani metadanych: model, mając do wyboru kilka równie dobrych słów, wybiera je według wzoru, który detektor potrafi później rozpoznać w dłuższym fragmencie. OpenAI deklaruje, że w testach swojego modelu Astra nie widzi „znaczących różnic jakości” między tekstem ze znakiem i bez, i podaje tabelę wyników na kilku testach; różnice są w granicach jednego, dwóch punktów w obie strony.

Ważniejsze są liczby o granicach, bo OpenAI podaje je samo. Przy docelowym 1% fałszywych alarmów detektor wykrył znak w około 80% fragmentów po 200 tokenów i w około 95% po 400 tokenów, dla treści z zakresu psychologii; dla matematyki, gdzie swobody w wyborze słów jest mało, „znacznie mniej”. Edycja osłabia znak: w testach na fragmentach po 400 tokenów zamiana 10% słów na synonimy obniżyła wykrywanie z około 92% do 66%, a zamiana 25% słów do 17%. Tłumaczenie, krótki tekst, model nieobjęty znakowaniem i tekst sprzed wdrożenia też wypadają poza zasięg. Dla porównania: 200 tokenów to w polszczyźnie mniej więcej sto słów, czyli jeden średni opis produktu. Krótki opis w karcie i trzy warianty tytułu są poniżej progu, w którym detektor jest wiarygodny.

Właśnie dlatego OpenAI nie oddaje detektora publicznie. W komunikacie stoi, że z powodu ryzyka pominiętych znaków i fałszywych alarmów narzędzie nie będzie dostępne dla wszystkich na starcie; organizacje z dostępem dostaną wyłącznie odpowiedź, czy wykryto znak OpenAI, „bez identyfikacji użytkownika ani ujawniania jego promptów lub rozmów”.

Czego znak nie mówi, słowami OpenAI

Ta część komunikatu jest dla sklepu najważniejsza, bo rozbraja nagłówki. OpenAI wylicza pięć rzeczy. Znak „nie mierzy wkładu człowieka”: może wskazać, że system OpenAI wygenerował albo przetworzył część fragmentu, ale nie to, ile było w nim ludzkiej redakcji i oceny. Znak „nie ustala własności ani odpowiedzialności”: nie mówi, kto jest właścicielem tekstu, czy jego użycie było zgodne z prawem ani czy wymagane było ujawnienie. Znak „nie identyfikuje użytkownika”. Znak „nie weryfikuje prawdziwości”: nie powie, czy fragment jest prawdziwy, mylący albo wyrwany z kontekstu. I ostatnie: „brak wykrytego znaku nie dowodzi ludzkiego autorstwa”.

Przekładam to na sklep. Jeśli ktoś kiedyś przepuści Twoje opisy przez detektor, dowie się najwyżej, że powstały z udziałem narzędzia OpenAI. Nie dowie się, czy je sprawdziłeś, czy parametry się zgadzają, czy opis jest Twój. A tego, czy opis jest prawdziwy, znak nie sprawdzi za Ciebie, co jest jedyną rzeczą, za którą odpowiadasz wobec klienta.

Co to zmienia w Google: nic

Tu trzeba być precyzyjnym, bo nagłówek „Google rozpozna teksty z AI” jest fałszywy na dwa sposoby. Po pierwsze, detektor nie jest dostępny dla Google ani dla nikogo poza zatwierdzonymi badaczami. Po drugie, Google nie potrzebuje znaku, bo nie ocenia narzędzia. Dokumentacja o treściach z generatywnej AI od lat mówi, że liczy się jakość treści, nie sposób jej powstania, a 1 października Google dopisał zdanie o konieczności ręcznego sprawdzenia każdej treści z AI przed publikacją. Pisałem o tym tydzień temu. Znak wodny OpenAI nie ma z tą dokumentacją nic wspólnego: Google może Cię zdegradować za zmyśloną kompatybilność w opisie napisanym ręcznie i nie zrobi nic z poprawnym opisem ze znakiem.

Co to zmienia w sklepie: proces, nie strach

Zmienia się jedna rzecz, techniczna, ale konsekwentna. Opis wklejony z okna ChatGPT przez pracownika w Polsce będzie od wdrożenia niósł znak OpenAI. Opis wygenerowany przez wtyczkę do sklepu albo generator feedu, które korzystają z API, znaku nie dostanie, dopóki dostawca albo Ty go nie włączycie. Opis z czatu, ale przepisany w jednej czwartej przez człowieka, znak w większości traci. To nie jest wiedza do ukrywania czegokolwiek, tylko do porządku: żeby wiedzieć, która treść w sklepie jest czym, bo za rok może o to zapytać kontrola, partner albo klient.

Drugi wniosek jest o redakcji. Art. 50 ust. 4 zwalnia z obowiązku ujawnienia tekst, który „przeszedł proces weryfikacji przez człowieka lub kontroli redakcyjnej”, za który odpowiedzialność redakcyjną ponosi konkretna osoba albo firma; dotyczy to wprawdzie tekstów o sprawach interesu publicznego, których opisy produktów nie są, ale ta sama procedura spełnia jednocześnie wymóg Google z 1 października i obniża ryzyko reklamacji za zmyślony parametr. Jeden proces zamyka trzy tematy: AI podaje propozycję, człowiek sprawdza z kartą producenta i podpisuje, system zapisuje kto i kiedy. U nas robi to osoba, która zna asortyment, a nie ta, która zna narzędzie, i to jest decyzja, nie koszt.

Trzeci wniosek jest o pieniądzach, które możesz nie wydać. Rynek „detektorów treści AI” rośnie, a OpenAI właśnie napisało, że własnego detektora nie udostępnia, bo w codziennych warunkach nie jest wystarczająco wiarygodny. Narzędzie zewnętrzne, które „wykrywa ChatGPT”, nie ma dostępu do textGrain i zgaduje ze stylu. Nie licz na nie ani przy sprawdzaniu podwykonawców, ani przy ocenie konkurencji.

Co zrobić w najbliższym tygodniu

  1. Spisz, które treści w sklepie powstają w czacie ChatGPT (opisy, odpowiedzi, posty), a które przez API w narzędziach: wtyczki do opisów, generatory tytułów do feedu, chatbot. Zapisz to w rejestrze narzędzi AI, który i tak powinieneś mieć od sierpnia.
  2. Nie włączaj znaku wodnego w API bez decyzji, ale podejmij ją świadomie i zapisz z datą, z uzasadnieniem w obie strony. Dostawców wtyczek zapytaj, czy planują go włączyć i kiedy.
  3. Ustal jedną procedurę dla każdego tekstu z AI: propozycja z modelu, sprawdzenie parametrów z kartą producenta, podpis osoby z asortymentu, zapis daty. To jest zarazem wymóg Google, wyjątek redakcyjny z AI Act i obrona przed reklamacją.
  4. Policz tokeny w typowym opisie: jeśli masz poniżej około 200 tokenów, znak i tak jest słabo wykrywalny, a jeśli masz powyżej 400, przyjmij, że jest. Nie zmieniaj przez to długości opisów; ich długość ma służyć klientowi.
  5. Nie kupuj detektorów AI. Pieniądze włóż w sprawdzenie dwudziestu bestsellerów: opis kontra karta producenta.
  6. Sprawdź, czy dostawcy Twoich generatorów obrazów i tekstu napisali, jak realizują oznaczanie maszynowe; okres przejściowy dla systemów sprzed 2 sierpnia kończy się 2 grudnia.

Znak wodny w tekście to narzędzie dla regulatora i badaczy, nie dla klienta i nie dla Google. Dla sklepu jest przypomnieniem, że za opis odpowiada ten, kto go publikuje, a nie model, który go zaproponował. Jeśli chcesz uporządkować, które treści w Twoim sklepie powstają gdzie i kto je podpisuje, zajrzyj do naszej oferty albo napisz, chętnie to przegadamy.


Marcin Janczewski

Marcin Janczewski

IT & e-commerce · Pro1.pl

Współzałożyciel Pro1.pl i DrTusz.pl. Z branżą ecommerce związany jest ponad 20 lat. Swoją karierę rozpoczynał od własnego sklepu internetowego z asortymentem do drukarek, który z sukcesami prowadzi do dziś. Obecnie DrTusz.pl jest nie tylko wiodącym ecommercem w branży, ale także marką samą w sobie, kojarzoną z najwyższym poziomem marketingu. Wspiera sklepy internetowe na każdym etapie ich rozwoju, od momentu wejścia w sprzedaż online po budowanie i optymalizację procesów. Programista z wykształcenia, marketer i sprzedawca z pasji.

Czytaj też

6 min

Duże sklepy w Niemczech wracają do darmowych zwrotów: 60,6% pokrywa koszt odesłania, rok temu 49,2%. Zanim skopiujesz, policz, ile zwrot kosztuje u Ciebie

Instytut EHI zapytał latem 108 dużych sprzedawców internetowych z Niemiec, Austrii i Szwajcarii o zwroty. Po okresie opłat za odesłanie wahadło wróciło: 60,6% pokrywa pełny koszt zwrotu, rok temu 49,2%. Powód numer jeden to lojalność klientów, nie konkurencja. Zanim przepiszesz to do swojego regulaminu przed sezonem, policz zwrot od kosztu i od marży. Pokazuję, jak.

6 min

Niemiecka kancelaria wzywa sklepy za piksel śledzący w newsletterze. Ten sam przepis stoi w polskiej ustawie, a open rate i tak kłamie od pięciu lat

Frankfurcka kancelaria Cyfire wysyła sklepom wezwania za śledzenie otwarć newslettera bez osobnej zgody, a francuski CNIL od kwietnia mówi wprost, że piksel w e-mailu wymaga zgody. Polska ustawa ma ten sam przepis w art. 399 PKE. Pokazuję, co piksel naprawdę robi, dlaczego open rate od czasu Apple Mail Privacy Protection i tak nie jest miarą, i co ustawić w narzędziu do wysyłek, zanim wyjdzie pierwsza kampania sezonu.

6 min

Google: każdą treść z AI sprawdź ręcznie przed publikacją. W Merchant Center tytuł i opis z AI mają własne atrybuty, sprawdź, co wysyła Twój feed

Google zmienił 1 października stronę o treściach z generatywnej AI i dopisał zdanie o obowiązkowym ręcznym sprawdzaniu. Czytam to jako sprzedawca, nie jako SEO: chodzi o parametry, które model zmyśla w opisach, i o feed, w którym tytuły i opisy z AI od dawna mają własne atrybuty. Pokazuję, co się zmieniło, co obowiązywało wcześniej i co sprawdzić w tydzień.