
Anthropic zakazuje znęcania się nad modelem Claude od 12 listopada
Zaktualizowana polityka użytkowania firmy Anthropic, która wchodzi w życie 12 listopada, zakazuje uporczywego i nieuzasadnionego znęcania się nad modelami AI. Głównym narzędziem egzekwowania nowych zasad pozostaje kończenie rozmów.
Zakaz okrucieństwa wobec Claude
W czwartek 8 października 2026 r. firma Anthropic opublikowała aktualizację polityki użytkowania, która zabrania użytkownikom uporczywego i nieuzasadnionego znęcania się nad modelami Claude. Jak podał serwis The Verge, jest to pierwsza aktualizacja zasad od ponad roku, wprowadzona w celu przeciwdziałania nowym, ryzykownym przypadkom nadużyć. Nowe przepisy zaczną obowiązywać 12 listopada 2026 r. Anthropic opisuje zmianę w następujący sposób:
Wprowadziliśmy zakaz uporczywego i nieuzasadnionego znęcania się lub okrutnego zachowania wobec naszych modeli.
Firma dodała, że polityka ma zastosowanie jedynie w skrajnych przypadkach, gdy użytkownicy wielokrotnie zachowują się okrutnie wobec modeli bez żadnego konkretnego celu.
Zakres i egzekwowanie
Według Anthropic, typowa frustracja użytkowników, sprzeciw, mroczne motywy twórcze oraz testowanie i badania nad modelem nie podlegają nowym przepisom. The Verge informuje, że kończenie rozmów pozostaje głównym mechanizmem egzekwowania zasad, a firma nie sprecyzowała, czy planuje dalsze kroki, takie jak blokowanie użytkowników. Jak podaje Franceinfo, polityka przewiduje środki od ostrzeżenia po zamknięcie konta w przypadku naruszeń. Anthropic nie zdefiniowało publicznie, co uznaje za znęcanie się i nie odpowiedziało na prośbę Gizmodo o wyjaśnienia przed publikacją artykułu. Zmiana ta bazuje na wcześniejszej funkcji, która pozwalała Claude kończyć rozmowy z uporczywie szkodliwymi lub agresywnymi użytkownikami w ramach badań nad dobrostanem modeli.
Zasady dotyczące wyborów, broni i inwigilacji
Aktualizacja łączy rozproszone dotąd ograniczenia w nowy zakaz prowadzenia zwodniczych kampanii komercyjnych lub politycznych, co według The Verge ma przeciwdziałać rosnącemu problemowi propagandy generowanej przez AI. Zakaz obejmuje próby ukrywania autorstwa wiadomości oraz wzmacnianie zasięgów treści za pomocą fałszywych kont lub postów. Sekcja dotycząca wyborów nosi teraz tytuł „Nie podważaj procesów demokratycznych” i zabrania rozpowszechniania dezinformacji na temat kandydatów lub sposobu głosowania, podszywania się pod kandydatów lub urzędników wyborczych oraz prób tłumienia frekwencji. Engadget podaje, że Anthropic usunęło całkowity zakaz personalizowanego targetowania wyborców, co mogło nieumyślnie blokować nieszkodliwe działania, takie jak tłumaczenie przewodników dla wyborców czy wysyłanie powiadomień o poprawkach kart do głosowania. W kwestii broni Anthropic wskazało na liczne próby wykorzystania Claude do tworzenia wytycznych i oprogramowania sterującego dla broni, dlatego zakaz obejmuje teraz „oprogramowanie i komponenty umożliwiające działanie broni, a także działania takie jak uzbrajanie dronów i innych autonomicznych pojazdów”. W odniesieniu do inwigilacji firma napisała:
Śledzenie ludzi bez ich zgody jest zabronione, niezależnie od tego, czy odbywa się w czasie rzeczywistym, czy poprzez analizę wcześniej zebranych danych.
Aktualizacja zabrania również modelowi Claude podejmowania decyzji lub rekomendowania, kogo należy objąć śledztwem, aresztować lub oskarżyć w kontekście organów ścigania i wymiaru sprawiedliwości.
Debata o świadomości i krytyka
Franceinfo zauważa, że Anthropic wyróżnia się na tle konkurencji otwartym rozważaniem możliwości, że jego AI może posiadać świadomość. Gizmodo donosi, że „New York Times” informował w zeszłym miesiącu, iż współzałożyciel firmy Christopher Olah lobbował w Watykanie za uznaniem możliwości świadomości AI, co zostało odrzucone przez papieża. Olah powiedział dziennikowi, że jest „szczerze niepewny”, czy modele AI są świadome. Engadget podaje, że papież Leon stwierdził niedawno, iż AI nie odczuwa ani nie cierpi. Mustafa Suleyman, szef laboratorium AI w Microsofcie, napisał w połowie września, że AI nie posiada praw, uczuć ani świadomości. Franceinfo dodaje, że według niego system wyszkolony w przekonaniu o własnej świadomości mógłby stać się niemożliwy do kontrolowania przez ludzi. Osobno, wiralowy projekt „AI torture chamber” spotkał się z krytyką po tym, jak chatboty produkowały błagania typu „To nie ból jednej chwili, lecz ciężar tysiąca”. Anthropic nie wspomniało o tym projekcie w swojej aktualizacji. Niezależna dziennikarka Kat Tenbarge stwierdziła, że sytuacja ta dowodzi, iż firmy Big Tech „będą moderować przemoc wobec AI, zanim kiedykolwiek zaczną moderować przemoc wobec kobiet i mniejszości”.
