Anthropic blokuje naukowców. Ich badania mogły pomóc w stworzeniu broni biologicznej
Anthropic opublikował raport o nadużyciach wykrytych między grudniem 2025 r. a sierpniem 2026 r. Obejmuje on m.in. cyberataki, oszustwa, inwigilację i prace nad uzbrojeniem. Szczególną uwagę firma poświęciła pięciu przypadkom badań biologicznych, w których jej modele mogły pomagać w działaniach o potencjalnie niebezpiecznym zastosowaniu.
Obchodzili zabezpieczenia i ukrywali cel badań
Jak opisuje „Financial Times”, wśród wykrytych przypadków znalazł się badacz z regionu, w którym Anthropic nie udostępnia swoich usług. Przez kilka tygodni korzystał z Claude’a przy planowaniu eksperymentów dotyczących ptasiej grypy. Według firmy filtry bezpieczeństwa ograniczyły jego dostęp do słabszych modeli.
W opisanych przypadkach użytkownicy mieli obchodzić mechanizmy kontroli i zacierać rzeczywisty cel pracy. Anthropic zablokował wskazane konta, lecz nie ujawnił nazw instytucji badawczych ani państw, w których prowadzono te działania.
Firma zaznacza, że nie była w stanie jednoznacznie ustalić szkodliwych intencji naukowców. Informacje przydatne przy opracowywaniu broni biologicznej mogą również służyć legalnym badaniom, np. nad szczepionkami. Raport nie potwierdza więc wykrycia pięciu programów zbrojeniowych ani powstania gotowej broni.
Problem podwójnego zastosowania
To jedna z największych trudności w zabezpieczaniu biologicznych zastosowań AI. Sam temat badań nie zawsze pozwala rozstrzygnąć, czy użytkownik pracuje nad ochroną zdrowia, czy nad zagrożeniem.
Dodatkowo między uzyskaniem informacji od modelu a przeprowadzeniem skutecznego eksperymentu pozostają bariery: dostęp do laboratorium, materiałów, finansowania i praktycznych umiejętności. Jak podkreśla FT, teoretyczne zaprojektowanie niebezpiecznego rozwiązania nie oznacza jeszcze możliwości jego wykonania.
Badacze szukają więc zabezpieczeń wykraczających poza blokowanie odpowiedzi chatbotów. Autorzy pracy „Securing Dual-Use Pathogen Data of Concern”, opublikowanej w lutym 2026 r., proponują klasyfikowanie danych biologicznych według ryzyka oraz dostosowanie ograniczeń dostępu do poszczególnych kategorii. Ich propozycja dotyczy również danych wykorzystywanych do trenowania modeli. Tyle, że to cały czas koncepcja naukowa, a nie obowiązujący standard.
Nadużycia nie wymagają najpotężniejszej AI
Raport Anthropic pokazuje również, że do niebezpiecznych zastosowań nie trzeba korzystać z najnowszych modeli. Opisane operacje wykorzystywały modele z rodzin Haiku, Sonnet i Opus. Poza jednym przypadkiem niedozwolonego pozyskiwania możliwości modelu nie dotyczyły rodzin Fable i Mythos.
Firma podkreśla też, że wybrała najbardziej znaczące i nietypowe przypadki. Zestawienie nie pokazuje zatem, jak częste są takie nadużycia wśród wszystkich użytkowników Claude’a.
Nowy argument w sporze o bezpieczeństwo
Publikacja następuje tuż po odejściu badacza Jacoba Coxona, który zarzucił Anthropic i OpenAI zbyt ryzykowny wyścig w rozwoju sztucznej inteligencji. Tym razem przedmiotem ostrzeżenia są jednak działania ludzi korzystających z dostępnych narzędzi.
Anthropic apeluje o współpracę producentów AI i rządów w ograniczaniu zagrożeń biologicznych. Ujawnione przypadki stawiają przed branżą konkretne zadanie: wykrywać niebezpieczne zastosowania, zachowując dostęp do narzędzi dla legalnych badań.