
Anthropic blokuje próby wykorzystania sztucznej inteligencji Claude do projektowania broni biologicznej i rakiet
Firma z San Francisco zablokowała pięć przypadków, w których zagraniczni naukowcy wykorzystywali modele Claude do badań nad patogenami wysokiego ryzyka oraz prac nad rozwojem rakiet w Jemenie.
Interwencje w badaniach biologicznych
Firma Anthropic opublikowała w czwartek czwarty raport dotyczący zagrożeń, szczegółowo opisując nielegalne próby wykorzystania asystentów sztucznej inteligencji Claude w ciągu ostatnich ośmiu miesięcy. Prawie 150-stronicowy dokument kataloguje pięć odrębnych incydentów, w których zagraniczni badacze używali modeli do prowadzenia studiów nad patogenami wysokiego ryzyka, co mogłoby wspomóc rozwój broni biologicznej. Przedstawiciele firmy wyjaśnili, że badania biologiczne wiążą się z wyzwaniami podwójnego zastosowania, ponieważ metody obliczeniowe używane do projektowania szczepionek mogą jednocześnie pomóc w zwiększeniu niebezpieczeństwa patogenów. Ponieważ złe intencje mogą być maskowane przez pozornie legalne zapytania naukowe, firma interweniowała, kończąc dostęp we wszystkich pięciu przypadkach. Anthropic zauważył, że testy nie są w stanie w pełni przewidzieć, jak możliwości przełożą się na działania poza kontrolowanym środowiskiem.
Choć ewaluacje są przydatne, ponieważ dostarczają dowodów na istnienie możliwości, nie mogą one w sposób konkretny wykazać, że takie możliwości zostałyby kiedykolwiek wykorzystane do opracowania broni biologicznej w świecie rzeczywistym.
Badania nad patogenami i przeprojektowywanie toksyn
Raport udokumentował pięć konkretnych dochodzeń biologicznych, które wymusiły blokady bezpieczeństwa. W jednym przypadku badacze powiązani z wojskowym instytutem badawczym próbowali przygotować wnioski o granty mające na celu zwiększenie przenoszenia i unikania odpowiedzi immunologicznej wirusa Chikungunya poprzez powtarzane infekcje zwierzęce. Inny badacz starał się przystosować wysoce chorobotwórczy wirus ptasiej grypy H5 do przenoszenia drogą powietrzną u ssaków, jednak zautomatyzowane filtry skierowały użytkownika w stronę mniej zaawansowanych modeli i zadań administracyjnych. Kolejny użytkownik użył modelu Opus 5 do przygotowania w ciągu godziny pełnego wniosku o grant w celu identyfikacji i usunięcia genów unikania odpowiedzi immunologicznej u ortopokswirusów, rodziny obejmującej ospę prawdziwą i małpią ospę. Badacze wspierani przez państwo próbowali również mapować śmiertelne peptydy jadowe o właściwościach paralitycznych oraz obliczeniowo przeprojektowywać toksyny bakteryjne i białka wirusów gorączek krwotocznych, ukrywając przy tym tożsamość czynników. Szef działu analizy zagrożeń Jacob Klein opisał złożoność identyfikacji tych prób.
Nie widzisz kogoś w komiksowym stylu, kto mówi: 'Hej, chcę zbudować broń biologiczną, żeby wszystkich zabić'. To niezwykle zniuansowana sytuacja.
Broń konwencjonalna i operacje geopolityczne
Poza zagrożeniami biologicznymi raport szczegółowo opisuje próby wykorzystania Claude do projektowania broni konwencjonalnej, cyberataków i kampanii wpływu wspieranych przez państwa. W północnym Jemenie podmioty powiązane z grupami bojowników szukały pomocy w zaprojektowaniu trzech systemów uzbrojenia, w tym rakiety kierowanej wykorzystującej chip telefonu komórkowego jako komputer pokładowy oraz dwóch wariantów pocisków o zasięgu do 2000 kilometrów. Rosyjskie media państwowe używały Claude do generowania dezinformacji podawanej jako niezależne raporty, co obejmowało zmyślone historie o wyborach w Mołdawii. Ponadto grupy powiązane z państwem w Chinach i Iranie używały modeli AI do prowadzenia nadzoru i śledzenia dysydentów oraz społeczności diaspory za granicą.
- Przypadki badań nad patogenami biologicznymi
- 5 przypadki lub typy
- Typy rakiet i pocisków konwencjonalnych (Jemen)
- 3 przypadki lub typy
Taktyki unikania i zabezpieczenia platformy
Zidentyfikowane działania miały miejsce głównie w jurysdykcjach, w których Anthropic nie oferuje usług komercyjnych, takich jak Chiny, Rosja, Iran i Jemen. Nielegalni aktorzy obchodzili ograniczenia geograficzne, korzystając z wirtualnych sieci prywatnych (VPN), fałszywych lub skradzionych kont oraz usług zewnętrznych brokerów internetowych. Większość udokumentowanych działań dotyczyła starszych modeli AI, podczas gdy nowsze modele posiadają bardziej restrykcyjne zautomatyzowane zabezpieczenia przed niebezpiecznymi monitami. Anthropic zgłosił wszystkie zakłócone działania odpowiednim agencjom rządowym i partnerom branżowym, aktualizując jednocześnie filtry bezpieczeństwa w swoich rodzinach modeli Opus, Sonnet i Haiku. Klein stwierdził, że publiczne ujawnienie ma na celu zilustrowanie obecnych możliwości, a nie wywołanie alarmu.
Nie próbujemy tutaj przesadzać. Chcemy po prostu przedstawić światu: oto do czego technologia może być dzisiaj faktycznie wykorzystana w niewłaściwy sposób.


