미국 하원의원 로 칸나가 OpenAI, 앤스로픽, 구글, 메타, xAI 등 주요 AI 기업에 모델 가중치에 대한 불법 접근 시도와 사이버보안 대책을 공개하라고 요구한 배경에는 한 가지 핵심 질문이 있다. 기업이 만든 강력한 AI 모델의 핵심 구성 요소를 적대적 행위자로부터 실제로 지킬 수 있느냐는 것이다.
3
단순히 경쟁사가 비슷한 답변을 만들어 내는 것과 모델 자체의 핵심 정보를 손에 넣는 것은 다른 문제다. 칸나의 우려는 후자가 발생할 경우 미국의 기술 우위뿐 아니라 모델의 통제와 감시에도 영향을 줄 수 있다는 데 있다.
3
5
가중치 탈취와 모델 증류, 무엇이 다른가
모델 가중치는 학습 과정에서 형성된 매개변수로, 모델이 입력을 처리하고 답을 생성하는 데 쓰이는 핵심 정보다. 이를 탈취한다는 것은 모델을 운영하는 회사의 서비스에 접속해 답변을 받아보는 수준을 넘어, 그 내부 구성 요소 자체를 불법으로 확보하는 것을 뜻한다.
반면 모델 증류는 기존 모델의 응답을 활용해 별도의 모델을 학습시키는 방식이다. OpenAI와 앤스로픽은 중국 AI 기업들이 자사 모델의 출력을 이용해 모델을 훈련하는 증류 사례를 보고한 바 있다. 그러나 보도된 증류 사례만으로 원본 모델의 가중치가 탈취됐다고 볼 수는 없다. 공개된 보도에는 가중치를 실제로 훔친 것으로 확인된 사례가 많지 않다.
3
10
왜 국가안보 문제로 보나
가중치가 유출되면 개발사가 제공하는 서비스의 경계를 벗어나 모델이 복제되거나 운영될 가능성이 생긴다. 공개된 가중치를 가진 모델은 배포된 뒤 사용을 감시하거나 안전장치를 적용하기 어렵고, 이미 공개된 가중치는 회수하기도 쉽지 않다는 점이 위험으로 거론된다.
16 다만 현재 제공된 근거만으로는 질문에 등장한 기업들의 가중치가 중국에 의해 성공적으로 탈취됐다고 단정할 수 없다.
3
10
따라서 칸나가 요구한 것은 알려진 침입 시도와 보안 조치에 관한 정보다. 기업들이 어떤 위험을 인지하고 있는지, 모델을 어떻게 보호하는지 확인해야 기술 경쟁의 문제와 국가안보상 위협을 구분해 대응할 수 있다는 취지다.
3
5
자율 규제와 정부 감독 사이
도널드 트럼프 행정부는 주요 AI 기업의 자율적 안전 조치를 강조해 왔다. 백악관과 기업들이 외부 감사 및 내부 통제 등을 담은 자발적 약속에 나선 한편, 행정부는 자발적 시험 체계에서 오픈웨이트 모델을 안전성 평가 대상으로 삼지 않겠다는 입장도 밝혔다.
9
칸나는 의무적인 모델 감사와 더 강한 정부 감독, 검증 가능한 미·중 AI 안전 합의가 필요하다고 주장한다. 미·중 간 기본적인 점검과 안전 기준을 마련하자는 요구도 내놓았다.
2
5 이 관점에서 기업에 보안 현황을 묻는 일은 자율 규제가 충분한지 판단할 근거를 요구하는 과정이기도 하다.
다만 기업별 보안 조치의 구체적인 내용이나 공개되지 않은 침입 시도가 실제로 있었는지는 현재 확인된 자료만으로 알 수 없다. 증류가 보고됐다는 사실과 가중치 탈취가 확인됐다는 주장은 구분해서 봐야 한다.