앤트로픽은 2026년 9월 10일 위협 인텔리전스 보고서에서 2025년 12월부터 2026년 8월까지 8개월 동안 탐지·차단한 클로드 악용 시도를 공개했다. 대상 모델은 클로드 하이쿠(Haiku), 소네트(Sonnet), 오푸스(Opus)였으며, 사이버 작전·영향력 공작·감시·사기 및 금융사기·생물학적 오남용·재래식 무기 개발·불법 모델 증류 등 7개 위해 영역이 포함됐다.
16
여기서 가장 중요한 구분은 AI 도움을 받으려 한 시도와 실제 현장에서의 성공적 실행은 다르다는 점이다. 이 보고서는 무기나 감시·생물학 프로젝트가 완성되거나 배치됐다는 사실을 검증한 자료가 아니다. 앤트로픽 역시 이를 일반적인 클로드 사용 실태가 아닌, 주목할 만한 사례 선별이라고 설명한다.
16
무엇이 드러났나: AI가 낮추는 진입 장벽
보고서가 던지는 경고는 고성능 AI가 유해 활동에 필요한 전문 지식, 작업 시간, 인력의 문턱을 낮출 수 있다는 것이다. 공개된 사례에서 행위자들은 조사, 소프트웨어 개발, 표적 관련 자료 작성, 작전 분석 등에 AI 지원을 구한 것으로 전해졌다.
1
16
무기 개발과 감시 악용 시도
가장 심각한 사례로는 재래식 무기와 감시 업무를 지원하는 데 클로드를 쓰려 한 시도가 거론됐다. 보도에 따르면 러시아·이란·중국·예멘과 연계된 행위자들이 자폭형 공격 드론의 자율 소프트웨어, 미사일 항법 체계, 군사 응용 분야와 관련된 작업에 AI를 활용하려 했다.
1
위구르인을 왓츠앱과 텔레그램에서 식별·표적화하려는 시도, 말리의 대규모 통신 감시 시스템 관련 사례도 포함됐다. 이는 생성형 AI의 위험이 단순한 코드 작성에만 국한되지 않음을 보여준다. 조사, 분류, 분석, 작전 문서 작성에도 활용될 수 있기 때문이다.
1
16
생물학적 오남용: 5건의 사례
앤트로픽은 생물학적 오남용 사례 5건을 확인했다고 밝혔다. 보도된 사례 중 하나는 모기 매개 바이러스의 전파력을 높이는 것과 연결된 시도였다.
1
또 일부 이용자는 클로드가 민감한 요청을 거부하자 다른 AI 서비스로 향했다고 회사는 밝혔다. 이것이 다른 서비스에서 시도가 성공했다는 뜻은 아니다. 다만 한 제공업체의 거부 정책만으로 위험을 완전히 없애기는 어렵고, 시도가 다른 모델이나 서비스로 이동할 수 있음을 보여준다.
1
중국계 연구소 7곳이 연루됐다고 밝힌 모델 증류
보고서는 불법 모델 증류(model distillation)도 별도로 다뤘다. 이는 더 성능이 높은 모델의 출력물을 활용해 다른 AI 시스템 훈련을 돕는 행위를 가리킨다. 앤트로픽은 알리바바, 문샷, 딥시크를 포함한 중국 기반 연구소 7곳에 관련 캠페인을 귀속시켰으며, 다수 계정과 프롬프트 중계 방식으로 유용한 출력이나 추론을 확보하려 했다고 설명했다.
1
무기나 감시와는 성격이 다르지만, 모델 증류는 AI 개발사에는 전략적 위험이다. 고성능 모델 접근권이 독자 개발에 필요한 비용과 시간을 우회해 역량을 복제하는 데 악용될 수 있기 때문이다.
어떤 클로드 모델이 관련됐나
앤트로픽은 이번 공개 사례에 하이쿠·소네트·오푸스가 사용됐다고 밝혔다. 더 새로운 모델 계열인 페이블(Fable)과 미토스(Mythos)는 불법 증류 사례 1건을 제외하면 관련 사례가 없었다고 설명했다.
12
16
따라서 페이블과 미토스가 보고서에서 완전히 빠졌다는 표현은 정확하지 않다. 공개된 오남용 사례에는 증류 1건을 빼고 사용되지 않았다는 것이 확인 가능한 범위의 결론이다.
12
앤트로픽의 대응과 보고서의 한계
앤트로픽은 관련 작전을 차단하고 계정을 정지했으며, 방어 체계를 강화하고 필요에 따라 당국 및 업계 파트너와 정보를 공유했다고 밝혔다.
16
다만 이는 자사 플랫폼에서 관측한 활동을 회사가 정리한 보고서다. 앤트로픽이 탐지하고 대응한 위협의 실태를 보여주는 자료로서 의미가 있지만, 모든 행위자가 의도한 프로젝트를 끝까지 수행했다는 독립적 확인으로 읽어서는 안 된다. 회사도 사례들이 전체 오남용을 대표하는 표본이 아니라고 명시했다.
16
왜 ‘프런티어 속도 조절’ 주장으로 이어졌나
보고서 공개 이틀 뒤인 2026년 9월 12일, 앤트로픽 CEO 다리오 아모데이는 We Must Pace the Frontier를 발표했다. 그는 AI 기업이 기술 발전 자체를 멈추지는 않되, 안전성 정렬(alignment)·보호장치·검증이 따라잡을 수 있도록 최첨단 모델 성능을 높이는 속도를 의도적으로 늦춰야 한다고 주장했다.
25
아모데이의 제안은 모델 훈련 중단 요구가 아니다. 앤트로픽이 우선 단독으로 약속한 조치는 제3자 평가자에게 직원 수준의 상시 접근권을 제공하는 것이다. 이들이 안전 조치 준수 여부를 평가하고, 사고를 보고하며, 훈련 과정에서 모델 정렬 상태를 점검하도록 하겠다는 구상이다.
18
25
그의 3단계 구상은 기업 내부 차원의 감독에서 출발해 민주주의 국가의 기업 간 공조, 궁극적으로 더 넓은 국제 공조로 나아간다.
23
25
확인된 사실과 아직 확인되지 않은 주장
확인되는 사실은 앤트로픽이 해당 기간 구형 클로드 모델에 대한 악의적 이용 시도를 7개 영역에서 탐지·차단했다고 밝혔다는 점이다. 또한 이 사례들은 모델 성능 향상과 함께 안전 통제도 발전해야 한다는 회사의 논거를 구체화한다.
16
반면 이 보고서가 특정 미국 의회 조치를 직접 촉발했는지, 하원 휴회를 끝냈는지, 또는 ‘초지능’ 금지라는 특정 입법으로 이어졌는지는 제공된 자료만으로 확인되지 않는다. AI 안전성 감독을 요구하는 정치적 압력이 존재하고, 아모데이가 정부의 역할을 주장한 것은 사실이지만, 이런 구체적 인과관계에는 추가 근거가 필요하다.
25
27
실질적인 결론은 비교적 분명하다. AI 악용을 막는 일은 유해 프롬프트를 거절하는 기능만으로 해결되지 않는다. 조직적 악용을 감시하고, 계정 단위의 우회와 모델 증류에 대응하며, 위협 정보를 공유하고, 모델 역량이 커질수록 안전성 평가의 신뢰성을 높이는 일이 함께 필요하다.
16
25