Firma Anthropic ujawniła, że w ciągu ostatnich ośmiu miesięcy użytkownicy powiązani z Iranem, Rosją, Chinami i Jemenem próbowali wykorzystać jej modele sztucznej inteligencji Claude do działań obejmujących m.in. opracowywanie broni, inwigilację i cyberataki.
W swoim "raporcie na temat zagrożeń" firma odnotowała przypadki niewłaściwego wykorzystania technologii, w tym do inwigilacji, oszustw, działań związanych z zagrożeniami biologicznymi, prac nad bronią oraz prób ekstrakcji wiedzy z modeli (tzw. distillation). Incydenty te miały miejsce w okresie od grudnia 2025 do sierpnia 2026 roku.
Anthropic wyjaśniło, że w działaniach tych wykorzystywano modele Claude Haiku, Sonnet i Opus, a tylko w jednym przypadku użyto potężniejszych modeli Claude Fable lub Mythos. Firma zapewniła, że jej zespół ds. analizy zagrożeń udaremnił każdą z opisanych operacji.
Raport zwrócił uwagę na pięć przypadków niewłaściwego wykorzystania technologii w kontekście zagrożeń biologicznych, w tym na próbę stworzenia przez wirusologów wspieranych przez państwo ulepszonej wersji wirusa chikungunya, przenoszonego przez komary. Anthropic zaznaczyło, że wszystkie przypadki dotyczące biologii były "niejednoznaczne" i mogły wiązać się z nieszkodliwymi badaniami naukowymi.
Tymczasem rosyjskie podmioty - które według Anthropic nie były powiązane z władzami państwowymi - próbowały wykorzystać Claude do stworzenia oprogramowania dla roju autonomicznych dronów kamikaze (sterowanych w trybie FPV - widoku z pierwszej osoby), szkolonych na podstawie nagrań z działań bojowych na Ukrainie. Raport wskazał również na ataki hakerskie wspomagane przez sztuczną inteligencję. W innym przypadku podmioty działające w północnym Jemenie wykorzystały Claude do stworzenia oprogramowania dla kilku rodzajów pocisków rakietowych. Anthropic zastrzegło jednak: "Nie dysponujemy dowodami na to, że podmiotom tym udało się stworzyć i wdrożyć do użytku sprawne urządzenie".
Kolejnym obszarem budzącym obawy była inwigilacja; podmioty powiązane z Chinami i Iranem próbowały wykorzystać Claude do monitorowania i profilowania osób. W jednym z przypadków Anthropic odnotowało operację powiązaną z Chinami, w której wykorzystano sztuczną inteligencję do "śledzenia, profilowania i werbowania Ujgurów" służących w armii syryjskiej. W jeszcze innym przypadku konsultant, podejrzewany o pracę dla państwowych służb wywiadowczych w Mali (Afryka Zachodnia), wykorzystał Claude do opracowania systemu zdolnego do monitorowania około 25 milionów telefonów komórkowych i tworzenia dossier wywiadowczych na temat wytypowanych osób. Firma Anthropic poinformowała o zablokowaniu konta, jednak platforma monitorująca została już wcześniej wdrożona lokalnie.
Ostatecznie firma wyjaśniłafirma wyjaśniła, że przypadki te nie stanowiły typowego nadużycia, lecz były przykładem "najbardziej znaczącego i nowatorskiego zagrożenia" odnotowanego do tej pory. Dodano, że celem raportu jest "pomoc innym twórcom w rozpoznawaniu podobnych schematów na własnych platformach, zapewnienie rządom i społeczeństwu obywatelskiemu lepszego wglądu w naturę pojawiających się zagrożeń oraz wzmocnienie wspólnych mechanizmów obronnych".
Wcześniej w tym tygodniu badacz z firmy Anthropic ostrzegał przed poważnym ryzykiem związanym z coraz bardziej zaawansowanymi systemami sztucznej inteligencji, w tym przed możliwością, że mogłyby one "zabić wszystkich ludzi" w ciągu najbliższej dekady. Warto dodać, że w opublikowanym w sierpniu raporcie dotyczącym ryzyka Anthropic ostrzegało, iż zaawansowana sztuczna inteligencja może ostatecznie "doprowadzić do katastrofalnych skutków", wyrażając jednocześnie mniejszą pewność co do tego, że zagrożenia stwarzane przez obecne modele pozostają na niskim poziomie.