Największe zagrożenie nie musi polegać na tym, że jedna maszyna samodzielnie opanuje każdą drogę do katastrofy. Bardziej konkretny scenariusz to połączenie coraz lepszych porad z agentami AI, które mogą korzystać z narzędzi i wykonywać wieloetapowe zadania. Taki system może ułatwić wykorzystanie specjalistycznej wiedzy, zautomatyzować część działań i skrócić czas na ludzką reakcję. Trzeba jednak odróżniać niebezpieczną pomoc, próbę jej wykorzystania i potwierdzony skutek.
18
22
58
Biologia: odpowiedź chatbota to jeszcze nie broń
Modele ogólnego zastosowania pomagają poruszać się po literaturze naukowej, a narzędzia projektowane dla biologów wspierają badania. OpenAI opisuje GPT-Rosalind jako model rozwijający rozumowanie biologiczne i pracę nad eksperymentami. „Nature” wskazuje zarazem na korzyści oraz ryzyko podwójnego zastosowania narzędzi biologicznej AI, takich jak AlphaFold: technologia przydatna w badaniach może również ułatwiać działania szkodliwe.
10
19
To ryzyko nie jest wyłącznie hipotetyczne. „The New York Times” opisał zapisy rozmów, w których chatboty udzielały wskazówek dotyczących broni biologicznej i omawiały unikanie wykrycia.
21 Anthropic poinformował z kolei o przerwaniu pięciu potencjalnych przypadków użycia Claude, które mogły wspierać rozwój takiej broni. Według Axios dwa z nich dotyczyły próśb związanych z niebezpiecznymi badaniami nad zwiększaniem właściwości patogenów, określanymi jako gain-of-function.
25 Żadne z tych doniesień nie potwierdza, że powstała działająca broń.
Między poradą a jej zastosowaniem pozostają bariery: potrzebne są między innymi umiejętności, materiały i praca laboratoryjna. Mają one znaczenie, choć lepsze narzędzia mogą część z nich osłabiać.
19
26 OpenAI ostrożnościowo zakwalifikowało możliwości biologiczne GPT-5 jako wysokie ryzyko w swoich ramach oceny gotowości, zaznaczając jednocześnie, że nie ma rozstrzygających dowodów, iż model istotnie pomógłby początkującej osobie wyrządzić poważną szkodę biologiczną.
31 To ocena wymagająca zabezpieczeń, nie dowód bezpieczeństwa ani zapowiedź nieuchronnej katastrofy.
Cyberataki: większe tempo nie oznacza potwierdzenia każdej liczby
Agent AI z dostępem do narzędzi może pomagać na kilku etapach włamania. To potencjalnie zwiększa zasięg napastnika i skraca czas, w którym obrońcy mogą zareagować. Doniesienia o ujawnionych przez Anthropic przypadkach nadużyć opisują wsparcie AI w operacjach cybernetycznych i kradzieży danych.
50
53
W jednym z opisywanych przypadków napastnik używał narzędzi AI przeciwko dziewięciu meksykańskim instytucjom rządowym.
54 Wtórne opracowania podają, że ujawniono około 400 mln rekordów, ale dostępne tu materiały nie pozwalają niezależnie potwierdzić tej liczby.
56
57 Podobnie twierdzeń o skoordynowanych „rojach” agentów atakujących około 50 organizacji nie należy na podstawie tych źródeł przedstawiać jako ustalonego incydentu.
Te same zdolności mogą służyć obronie: wykrycie luki pozwala ją naprawić, zamiast wykorzystać do włamania. Dostarczone materiały nie potwierdzają jednak konkretnego twierdzenia, że GPT-5.6-Cyber znalazł błędy później usunięte w przeglądarce Chrome.
Dezinformacja i broń autonomiczna: ryzyko eskalacji
Wśród przypadków nadużyć opisywanych przez Anthropic znalazły się także operacje wpływu.
22
50 Ich możliwym skutkiem byłoby spotęgowanie innego kryzysu: fałszywe komunikaty lub podszywanie się pod wiarygodne osoby mogłyby utrudnić zrozumienie sytuacji podczas cyberataku czy konfliktu. Przytoczone przypadki nie dowodzą jednak, że masowa dezinformacja wywołała katastrofę o skali egzystencjalnej.
Anthropic podał również, że działający w Rosji programiści korzystali z Claude przy tworzeniu oprogramowania dla roju dronów uderzeniowych. Według relacji prace obejmowały naprowadzanie, koordynację i wybór celów.
51
60 Prace nad oprogramowaniem nie są równoznaczne z potwierdzonym użyciem takiego systemu na polu walki. Sam fakt użycia AI w dronie nie przesądza też, jaki wpływ człowiek zachowuje na decyzję o zastosowaniu śmiercionośnej siły. Międzynarodowy Komitet Czerwonego Krzyża ostrzega, że broń autonomiczna, której działania ludzie nie potrafią dostatecznie zrozumieć, przewidzieć i kontrolować, stwarza ryzyko dla cywilów oraz może sprzyjać eskalacji konfliktu.
58
Zabezpieczenia muszą obejmować cały proces
Odmowa udzielenia odpowiedzi przez chatbota jest użyteczna, lecz nie wystarcza. Badacze zajmujący się biotechnologią omawiają zarówno blokowanie szkodliwych próśb, jak i ograniczanie funkcji wysokiego ryzyka. RAND wskazuje, że wobec zdeterminowanego sprawcy potrzebne są zabezpieczenia działające na wielu poziomach, ponieważ żadna pojedyncza bariera nie daje pełnej ochrony.
17
29 Anthropic informuje, że wykrywał i przerywał nadużycia oraz wzmacniał zabezpieczenia dotyczące wrażliwych badań biologicznych.
22
23
W praktyce oznacza to testowanie systemów na zadaniach wieloetapowych, ograniczanie narzędzi i uprawnień agentów, monitorowanie nadużyć oraz zachowanie możliwości przerwania operacji. W systemach uzbrojenia rzeczywista kontrola człowieka powinna obejmować decyzję o użyciu śmiercionośnej siły, a nie sprowadzać się do formalnej obecności operatora. ONZ i Międzynarodowy Komitet Czerwonego Krzyża wzywają do silniejszych międzynarodowych zasad dotyczących śmiercionośnej broni autonomicznej; nie oznacza to, że obowiązuje już powszechny zakaz takiej broni.
55
58
Wniosek z dostępnych dowodów to potrzeba zapobiegania, nie pewność katastrofy. Istnieją doniesienia o niebezpiecznych odpowiedziach modeli oraz próbach wykorzystania AI w działaniach biologicznych, cybernetycznych i związanych z uzbrojeniem. Twierdzenie o skutkach katastrofalnych lub zagrażających istnieniu ludzkości wymagałoby dalszych dowodów — nie wystarczy alarmujący plan ani sama zdolność modelu.
21
22
46