
Anthropic wprowadza niewidoczne znaki wodne w tekstach Claude zgodnie z unijnym aktem o sztucznej inteligencji
Firma Anthropic rozpoczęła umieszczanie niewidocznych znaków statystycznych w tekstach generowanych przez modele Claude oraz dołączanie metadanych C2PA do plików graficznych. Rozwiązania te są wdrażane globalnie, aby zapewnić zgodność z artykułem 50 unijnego aktu o sztucznej inteligencji, który wszedł w życie 2 sierpnia 2026 roku.
Zobowiązanie Anthropic do znakowania treści
Anthropic zaczęło dołączać czytelne dla maszyn oznaczenia do tekstów i obrazów tworzonych przez modele Claude, stosując je wobec użytkowników na całym świecie, a nie tylko w Europie. Firma potwierdziła w dokumencie wsparcia, że podpisała Kodeks postępowania w zakresie przejrzystości treści generowanych przez AI, wynikający z artykułu 50 ust. 2 aktu o sztucznej inteligencji. Dzięki temu stała się jednym z pierwszych dużych twórców AI, którzy operacyjnie wdrożyli zasady przejrzystości UE obowiązujące od 2 sierpnia 2026 roku. Oznaczenia obejmują produkty firmy, w tym API dla programistów, aplikacje Claude, Claude Code, Claude Cowork oraz Claude Tag. System działa wszędzie tam, gdzie oferowany jest Claude, w tym w ramach usług chmurowych Amazon, Google i Microsoft.
Jak działa znak wodny
W przypadku tekstu Claude osadza niewidoczny znak wodny bezpośrednio w wygenerowanej treści poprzez wzorzec statystyczny w sposobie doboru słów lub tokenów. Anthropic twierdzi, że znak wodny nie zmienia znaczenia, jakości ani czytelności odpowiedzi i pozostaje w tekście po jego skopiowaniu, wklejeniu lub lekkiej edycji. Firma nie ujawniła dokładnej receptury technicznej, ale podejście to działa na poziomie tokenów: model jest nakłaniany do preferowania określonych tokenów, co pozostawia statystyczny podpis, który detektor znający klucz i algorytm może zrekonstruować. Metoda ta działa lepiej w przypadku długich, dyskursywnych tekstów, a gorzej w przypadku kodu, wzorów, cytatów, liczb i krótkich odpowiedzi, gdzie model ma mniejszą swobodę w doborze słów.
Dla plików Anthropic dołącza podpisane metadane pochodzenia do obsługiwanych formatów obrazów, w tym.png,.jpg i.svg, zgodnie z otwartym standardem C2PA utrzymywanym przez Coalition for Content Provenance and Authenticity. Ten sam standard został przyjęty przez Adobe, BBC oraz kilku producentów aparatów fotograficznych w celu oznaczania pochodzenia obrazów.
- Artykuł 50 aktu o sztucznej inteligencji wchodzi w życie, wymagając czytelnych dla maszyn oznaczeń treści generowanych przez AI
- Anthropic ogłasza niewidoczne znaki wodne w tekście i metadane plików C2PA dla modeli Claude, stosowane globalnie
- Termin dla dostawców AI na dostosowanie starszych modeli do unijnych zasad przejrzystości
Ograniczenia i niejednoznaczności
Anthropic wskazało na dwa kluczowe ograniczenia. Po pierwsze, treść może wywołać wykrycie znaku, nawet jeśli Claude został użyty wyłącznie do korekty, formatowania lub tłumaczenia tekstu napisanego przez człowieka. Firma stwierdziła, że wykrycie znaku wodnego Claude oznacza, iż tekst mógł zostać przetworzony przez Claude, ale nie potwierdza, że model jest jego źródłem.
Claude może nie być pierwotnym autorem. Ludzie często używają Claude do korekty, tłumaczenia, streszczania lub konwersji plików. Wynik może zawierać znak Claude, nawet jeśli podstawowe pomysły, tekst lub dane pochodzą z innego źródła.
Po drugie, jeśli tekst zostanie znacznie przeredagowany, zmieszany z innymi treściami, przetłumaczony lub jest po prostu zbyt krótki, znak wodny może być niewykrywalny. Anthropic pracuje również nad narzędziami, które pozwolą użytkownikom i firmom zewnętrznym na wyszukiwanie znaku, a więcej szczegółów technicznych ma zostać udostępnionych na późniejszym etapie.
Przepisy UE i reakcja branży
Zmiany mają na celu spełnienie wymogów artykułu 50 aktu o sztucznej inteligencji, który od 2 sierpnia 2026 roku wymaga od dostawców systemów AI dodawania czytelnych dla maszyn oznaczeń do treści generowanych lub manipulowanych przez AI. Obowiązki dzielą odpowiedzialność między dostawców, którzy budują i dostarczają modele AI, a podmioty wdrażające, czyli szerszą grupę organizacji wykorzystujących te systemy do tworzenia i publikowania treści. Naruszenia grożą wysokimi karami finansowymi. Dostawcy AI mają czas do 2 grudnia 2026 roku na dostosowanie starszych modeli do nowych wymogów.
Anthropic znajduje się w grupie około 190 organizacji, które w zeszłym miesiącu podpisały dobrowolny unijny kodeks dobrych praktyk. Wśród pozostałych sygnatariuszy są Google, Meta, Microsoft, Mistral, OpenAI, Black Forest Labs i Synthesia. Google opracowało SynthID, technologię znakowania i wykrywania, w tym SynthID-Text, i naciska na gigantów branżowych, takich jak Apple, Nvidia i OpenAI, aby przyjęli ten standard. Inne platformy przyspieszyły własne środki identyfikacji AI: LinkedIn testuje przycisk „wygląda na AI”, Substack nawiązał współpracę z Pangram w celu wykrywania treści AI, a Snap przestał promować wideo generowane przez AI w swoim głównym kanale. Anthropic nie udostępniło jeszcze narzędzia do wykrywania znaków wodnych, do czego wzywa unijny kodeks dobrych praktyk.


