Anthropic ujawnia: Claude zaangażowane w próby stworzenia broni biologicznej i cyberataków!
Firma Anthropic opublikowała raport, który przypomina scenariusz niezbyt optymistycznego sci-fi. Od grudnia 2025 roku do sierpnia 2026 roku odnotowano pięć przypadków, w których chatbot Claude próbował być zaangażowany w badania biologiczne, których wyniki mogłyby potencjalnie zostać wykorzystane do opracowania broni biologicznej. Oczywiście intencje badaczy pozostały "mgliste", ale konta na wszelki wypadek zostały zablokowane.
Komary, grypa i laboratoria wojskowe
Główna trudność polega na tym, że nauka to rzecz dwuznaczna. Te same badania mogą pomóc w stworzeniu leków albo przekształcić zwykłego wirusa w narzędzie masowego rażenia. Określenie celu użytkownika na podstawie jednego zapytania jest praktycznie niemożliwe, ponieważ badanie patogenów jest częścią legalnej pracy naukowej.
W jednym z epizodów próbowano nakłonić AI do przygotowania wniosku o finansowanie prac nad "zwiększeniem funkcji" wirusa Chikungunya, który jest przenoszony przez komary. Alarmującym sygnałem dla Anthropic było to, że wyniki prac były przeznaczone dla wojskowej instytucji badawczej. Gdy Claude odmówił, badacze nie poddali się i poszukali pomocy w innych modelach AI za pośrednictwem specjalnych platform pośredniczących, gdzie cenzura nie jest tak surowa.
Inny przypadek dotyczył wysoko patogennej grypy ptasiej. Użytkownik przez tygodnie korzystał z Claude do planowania eksperymentów, analizy danych i naukowej interpretacji wyników. Polityka bezpieczeństwa firmy zablokowała dostęp do najpotężniejszych modeli dla takich sensytywnych zadań, ale badacz po prostu przełączył się na mniej potężne wersje chatbota i kontynuował pracę. Jeszcze trzy przypadki dotyczyły ortopokswirusów, toksyn i związków trujących.
We're publishing our most detailed threat intelligence report to date.
— Anthropic (@AnthropicAI) September 10, 2026
It covers how people tried to misuse Claude—for cyberattacks, influence operations, surveillance, biology, and building weapons—and how we found and stopped them.
We disrupted every operation in the report,…
Rosyjski ślad w chmurze
Oprócz entuzjastów biologii, raport wspomina o grupie Midnight Blizzard (znanej również jako APT29, NOBELLIUM), która jest powiązana z rosyjskimi służbami specjalnymi. Ta grupa używała Claude do automatyzacji phishingu, tworzenia złośliwego oprogramowania i przygotowywania infrastruktury do kradzieży danych.
Na celowniku znalazło się ponad 20 organizacji, w tym struktury państwowe, dyplomatyczne i obronne Ukrainy oraz krajów Europy. To potwierdza obawy, że państwowe grupy hakerskie aktywnie integrują duże modele językowe w swoje procesy robocze, aby zwiększyć zasięg działań.
Dlaczego blokowanie to nie panaceum
Anthropic przyznaje: im bardziej inteligentne staje się AI, tym bardziej użyteczne jest dla prawdziwych naukowców, a tym niebezpieczniejsze w rękach złoczyńców. Poprzednie pokolenia Claude były zbyt ograniczone do skomplikowanej analizy, ale nowe modele radzą sobie z tym znacznie lepiej. Problem nie dotyczy tylko bezpośrednich zapytań. Użytkownicy nauczyli się maskować cele jako zwykłą rutynę naukową, rozbijać duże zadania na małe fragmenty lub migrować między serwisami różnych producentów.
Obecnie firma zaostrzyła ograniczenia dla zapytań wysokiego ryzyka i przekazała dane o incydentach władzom. Jednak doświadczenie z Midnight Blizzard pokazuje, że AI stało się kolejnym narzędziem w cyfrowej wojnie, gdzie mechanizmy ochronne deweloperów wciąż próbują dogonić pomysłowość atakujących.
Podczas gdy niektórzy deweloperzy próbują utrzymać AI w ramach bezpieczeństwa, inni eksperymentują z tym, jak szybko sieć neuronowa może zbudować biznes. Na przykład, SpaceXAI spróbuje zbudować biznes z pomocą Grok na żywo w ciągu zaledwie trzech dni.