앤트로픽의 2026년 9월 위협정보 보고서는 2025년 12월부터 2026년 8월까지 국가 연계가 의심되는 집단과 범죄 행위자들이 클로드를 악용하려 한 시도를 어떻게 적발하고 차단했는지 정리한다. 보고서가 다룬 분야는 사이버 작전, 영향력 작전, 감시, 사기·금융사기, 생물학적 악용, 재래식 무기 개발, 불법 모델 증류의 7가지다. 확인된 사례에는 Claude Haiku, Sonnet, Opus가 사용됐다.
16
핵심은 모든 시도가 성공했거나 실제 작전 단계에 이르렀다는 뜻은 아니라는 점이다. 오히려 이 보고서는 AI가 정찰, 감시, 사기, 사이버 활동에 드는 인력과 전문성의 문턱을 낮출 수 있으며, 모델의 거절 정책만으로는 접근 제한을 완전히 지키기 어렵다는 점을 보여준다. 앤트로픽은 클로드를 활용해 개발한 작전용 무기가 실제 배치됐다는 증거는 발견하지 못했다고 밝혔다.
4
6
접근 통제는 어떻게 우회됐나
보고서에 따르면 행위자들은 VPN, 사기성 계정, 탈취된 자격증명, 계정 교체 등을 이용해 지리적 제한과 플랫폼 통제를 피하려 했다. 즉, 모델이 특정 요청을 거절하는지 여부만큼이나 누가 어떤 계정으로 접속하는지를 확인·보호하는 일이 중요해진 것이다.
4
주변 AI 생태계를 겨냥한 악용도 있었다. 탈취하거나 재판매한 API 키·세션 토큰을 사용하고, Claude Code를 포함한 AI 제품 또는 제공자를 사칭한 웹사이트로 자격증명 탈취 악성코드를 배포한 사례가 언급됐다.
4
12
따라서 AI 안전성은 프롬프트 필터만의 문제가 아니다. 계정 개설과 신원 확인, 결제 부정 사용 방지, 자격증명 보호, 조직적인 다계정 활동 탐지 역시 중요한 방어선이다.
보고서가 제시한 악용 사례
무기 관련 공학과 드론 연구
앤트로픽은 예멘 기반 유도무기 공학 조직이 유도 로켓, 다단 탄도미사일, 극초음속 활공미사일과 연관된 소프트웨어 작업에 클로드를 사용했다고 설명했다. 다만 회사는 클로드를 이용해 개발된 작전용 무기가 배치됐다는 증거는 없다고 밝혔다.
6
러시아 연계 행위자는 자율형 자폭 드론 군집과 관련한 지원을 요청한 것으로 보고됐다. 공개된 자료는 이를 AI 보조 개발 시도로 규정할 뿐, 완성되거나 실전 배치된 시스템의 증거로 보지는 않는다.
5
감시·억압·영향력 작전
보고서에는 AI 보조 감시와 정보 수집 사례도 포함됐다. 중국 연계 사례에서 한 지방 공안국 사건관리 시스템을 담당한 엔지니어는 주민등록번호에 해당하는 국가 신분증 번호를 이용해 개인의 이동 정보를 경찰 기록과 대조하는 도구를 개발한 것으로 전해졌다.
4
말리 연계 행위자의 이동통신 사업자 전반에 대한 통신 감청 시도, 이란 작전의 소셜 네트워크 신원 수집 및 15만5,000건이 넘는 트윗 분석도 보고됐다. 다만 이용 가능한 자료는 앤트로픽의 탐지·차단 주장을 뒷받침하는 수준이며, 각 작전이 현실에서 어느 정도 효과나 영향을 냈는지까지 모두 입증하지는 않는다.
4
앤트로픽의 경고는 AI가 전혀 새로운 위해를 반드시 만들어낸다는 데 있지 않다. 기존의 감시와 억압 방식을 더 싸고 빠르게, 더 큰 규모로 실행할 수 있게 만들 수 있다는 데 있다.
4
사이버 첩보·사기·모델 역설계
사이버 관련 사례는 자격증명 탈취와 침입 지원부터 반자율적 AI 보조 공격 워크플로까지 걸쳐 있었다. 아시아 지역의 정부·금융·상업 조직을 겨냥한 활동도 기술됐다.
4
러시아 연계 활동에는 사이버 첩보와 함께, 모델 질의 라우팅을 통해 러시아 방위 관련 정부 데이터베이스와 연계된 자격증명이 노출된 사례가 포함된 것으로 전해졌다.
5
중국 연계 사례에는 다수의 사기 계정을 이용해 클로드의 역량을 추출하거나 모방하려 한 시도도 있었다. 앤트로픽은 이를 조사 대상 7개 위해 분야 중 하나인 불법 증류로 분류했다.
4
16
앤트로픽이 취한 조치와 남은 한계
앤트로픽은 식별된 작전을 차단하고 관련 계정을 금지했으며, 사례에서 얻은 정보를 바탕으로 안전장치를 업데이트하고 관련 정보를 적절한 정부 기관 및 업계 파트너와 공유했다고 밝혔다.
4
이런 조치는 특정 상용 모델에 접근하는 경로를 끊고 다른 방어 주체에 유용한 징후를 제공할 수 있다. 그러나 악용의 동기나 기반 도구 자체를 없애는 조치는 아니다.
앤트로픽은 이 문제가 클로드 접근권에만 국한되지 않는다고 명시했다. 한 서비스에서 차단된 행위자는 탈취 계정을 쓰거나 다른 제공자로 이동하고, 오픈소스 모델을 선택할 수도 있다.
4
결국 이 보고서는 몇 개 계정을 영구 차단하면 문제가 끝난다는 증거가 아니라, 위협 환경이 변하고 있다는 신호로 읽는 편이 맞다. 제공업체의 집행은 악용 비용을 높이고 캠페인을 드러내며 정상 이용자를 보호할 수 있다. 동시에 더 강한 신원·계정 통제, 자격증명 보안, 위협정보 공유, 특정 플랫폼 밖의 AI 도구까지 고려한 방어가 함께 필요하다.
결론
앤트로픽 보고서가 보여주는 것은 AI 악용의 ‘작업 규모 확대’다. 위협 행위자들은 VPN, 가짜 계정, 탈취 자격증명 같은 익숙한 우회 수단으로 범용 AI 모델을 무기 관련 연구, 감시, 영향력 작전, 사이버 활동, 사기에 적용하려 했다.
4
16
앤트로픽의 차단 조치는 해당 사례에서 클로드 접근을 제한했다. 하지만 더 큰 경고는 성능이 높아진 AI가 유해 활동의 진입장벽을 생태계 전반에서 낮추고 있다는 점이다. 동시에 무기 관련 작업을 포함해 보고된 모든 시도가 실제 배치 또는 작전 성공으로 이어졌다는 증거는 없다.
4
6