
Anthropic wprowadza niewidoczne znaki wodne w tekstach generowanych przez Claude w celu spełnienia wymogów unijnego aktu o sztucznej inteligencji
Od 2 sierpnia Anthropic umieszcza niewidoczne znaki wodne we wszystkich tekstach tworzonych przez modele Claude. System działa globalnie we wszystkich produktach firmy oraz na platformach zewnętrznych, aby spełnić wymogi przejrzystości unijnego aktu o sztucznej inteligencji.
System znakowania wodnego
Firma Anthropic ogłosiła 11 sierpnia, że jej modele Claude będą umieszczać niewidoczne znaki wodne we wszystkich generowanych tekstach. Rozwiązanie to jest zgodne z unijnym aktem o sztucznej inteligencji (artykuł 50 ust. 2), który wszedł w życie 2 sierpnia. Modele wydane po tej dacie już zawierają technologię znakowania, która osadza sygnał bezpośrednio w sekwencji tokenów wyjściowych. Znak jest niewidoczny dla ludzi i nie zmienia znaczenia, jakości ani czytelności tekstu.
Ponieważ znak wodny jest częścią tekstu, będzie on przenoszony wraz z nim podczas kopiowania i wklejania w inne miejsca i może przetrwać niektóre edycje. Znakowanie będzie stosowane na poziomie modelu, co oznacza, że będzie obecne niezależnie od tego, z jakiego produktu lub interfejsu Claude pochodzi tekst.
- Wchodzi w życie unijny kodeks przejrzystości aktu o AI; modele Claude wydane po tej dacie zawierają znaki wodne
- Anthropic publicznie ogłasza system znakowania wodnego
- Unijny termin dodania znakowania wodnego do starszych modeli Claude
Zasięg globalny i zakres produktów
Środek ten ma zastosowanie globalne, nie tylko na terenie Unii Europejskiej. Znakowanie będzie obecne w usłudze Claude, API platformy Claude, Claude Code, Claude Cowork i Claude Tag, a także w wynikach modeli Claude dostępnych za pośrednictwem platform zewnętrznych, takich jak AWS, Google Cloud i Microsoft Foundry. W przypadku generowanych plików Anthropic będzie dołączać cyfrowo podpisane metadane pochodzenia przy użyciu otwartego standardu C2PA, stosowanego przez Adobe, Microsoft i znaczną część branży fotograficznej. Starsze modele otrzymają funkcję znakowania stopniowo, zgodnie z wyznaczonym przez UE terminem 2 grudnia, który Anthropic zamierza dotrzymać.
Ograniczenia i zastrzeżenia
Anthropic jasno określiło ograniczenia systemu. Wykrycie znaku wodnego wskazuje, że treść mogła zostać przetworzona przez Claude, ale nie stanowi ostatecznego dowodu na to, że Claude jest jej autorem. Użytkownicy wykorzystujący Claude do edycji, tłumaczenia, streszczania lub przekształcania tekstów napisanych przez ludzi mogą stwierdzić, że wynikowy tekst zawiera znak Claude, mimo że pierwotne idee pochodzą z innego źródła.
Wykryty znak stanowi sygnał, że treść została przetworzona przez Claude, ale nie jest w pełni rozstrzygający.
Z kolei brak znaku wodnego nie dowodzi, że tekst nie został wygenerowany lub przetworzony przez sztuczną inteligencję. Znak może zniknąć, jeśli tekst zostanie poddany intensywnej edycji, parafrazowaniu, tłumaczeniu, zmieszaniu z innymi tekstami lub jeśli fragment jest zbyt krótki, aby pozostawić wiarygodny sygnał. Metadane plików mogą zostać utracone w wyniku konwersji formatu, zrzutów ekranu, ponownego zapisywania lub generowania na platformie, która nie obsługuje znakowania.
Kontekst regulacyjny i krajobraz branżowy
Znakowanie wodne jest odpowiedzią na artykuł 50 unijnego aktu o sztucznej inteligencji, który wymaga, aby treści syntetyczne były automatycznie wykrywalne, a deepfake'i oraz niektóre teksty dotyczące spraw interesu publicznego były odpowiednio oznaczone. Anthropic podpisało unijny Kodeks dobrych praktyk w zakresie przejrzystości treści generowanych przez AI. Inne firmy, w tym OpenAI, Google, Meta, Microsoft, Black Forest Labs i Synthesia, również zobowiązały się do przestrzegania unijnego kodeksu. System SynthID firmy Google, pełniący podobną funkcję, został przyjęty przez Apple, ElevenLabs, Kakao, Nvidia i OpenAI. Niezależnie od tego platforma muzyczna AI Suno ogłosiła, że będzie oznaczać utwory stworzone na swojej platformie, a serwis newsletterowy Substack nawiązał współpracę z Pangram w celu oznaczania treści generowanych przez AI, przy czym dyrektor generalny Substack, Chris Best, zwrócił uwagę na zjawisko "Claudefishing", czyli używanie AI do generowania treści.
Reakcje użytkowników i dalsze kroki
Ogłoszenie wywołało krytykę na platformie X, gdzie niektórzy użytkownicy wyrazili sprzeciw, a inni zapowiedzieli rezygnację z korzystania z Claude. Obawy koncentrują się na ryzyku, że tekst jedynie edytowany lub poprawiony przez Claude może zostać błędnie oznaczony jako wygenerowany przez AI. Anthropic nie ujawniło mechanizmu technicznego osadzania znaku wodnego, prawdopodobnie po to, aby utrudnić jego usunięcie. Firma poinformowała, że pracuje nad umożliwieniem użytkownikom i innym podmiotom wykrywania znaków oraz metadanych pochodzenia, a szczegóły dotyczące wykrywania mają zostać opublikowane w ciągu kilku tygodni.


