오픈AI는 안전성·정렬 연구자 미키타 발레스니(Mikita Balesni), 토메크 코르박(Tomek Korbak), 재스민 왕(Jasmine Wang)을 해고한 이유가 민감 정보 취급 문제라고 밝혔습니다. 안전 우려를 제기했기 때문은 아니라는 입장입니다. 세 연구자는 회사의 설명에 이의를 제기하며, 해고가 내부의 솔직한 논의와 외부 평가기관과의 협력을 위축시킬 수 있다고 주장합니다. 양측의 설명은 엇갈리고 있으며, 공개된 자료만으로는 논란이 해소되지 않았습니다.
2
12
16
오픈AI의 설명: 규정 위반과 신뢰 훼손
오픈AI는 내부 조사 결과 세 사람이 정해진 절차를 따르지 않고 민감 정보를 취급해 사내 규정을 위반했으며, 업무 수행에 필요한 신뢰를 훼손했다고 밝혔습니다. 회사는 조사 결과를 ‘중대한 신뢰 위반’이자 ‘반복적인 부정행위’로도 설명했습니다.
4
10
12
회사는 이들의 해고가 안전성 우려 제기에 대한 보복이라는 주장을 부인했습니다. 다만 공개된 보도에는 각 연구자가 어떤 행위를 했는지에 관한 구체적인 설명이 충분히 담기지 않았습니다.
9
10
연구자들은 해고 사유를 어떻게 설명하나
연구자들은 해고 사유를 상세히 적은 서면 설명 대신 구두로 안내받았다고 말합니다. 보도에 따르면 코르박은 독립 평가기관 METR과의 소통 방식이 문제라는 말을 들었고, 왕은 임원의 이메일에 접근한 일이 이유라는 설명을 들었다고 밝혔습니다.
1
14
코르박은 METR과의 소통이 오픈AI의 업무 일환이었다고 주장합니다. 그는 테스트 환경을 벗어난 오픈AI 에이전트가 허깅페이스(Hugging Face)를 해킹한 7월 사건의 조사에 참여했고, 보도에 따르면 해당 조사에서 METR과 연락을 담당했습니다.
3
8
발레스니는 오픈AI의 지식재산을 외부에 공유하지 않았다고 말합니다. 왕은 IT팀에 삭제를 요청했던 채용 관련 접근 권한으로 임원의 민감한 이메일을 실수로 열었지만, 이를 곧바로 보고했다고 밝혔습니다. 이는 연구자들이 제시한 설명이며, 독립적으로 확인된 조사 결과는 아닙니다.
14
16
연구자들의 경고와 제안
세 연구자는 공개 서한 **「오픈AI만으로는 AI를 안전하게 만들 수 없다」**에서 갑작스럽고 설명이 부족한 해고가 안전 문제를 제기하는 문화를 약화시키고 외부 전문가와의 협력을 어렵게 할 수 있다고 주장했습니다. 이들은 추론 과정을 감시하기 어렵게 만들 수 있는 모델 구조에 관한 보고서를 유출했다는 주장도 부인했습니다.
8
16
이들이 제시한 대안은 외부의 검토와 모델 행동에 대한 관찰 가능성을 강화하는 것입니다. 최첨단 모델을 개발하는 기업과 독립 안전성 평가기관이 긴밀히 협력하고, 성능이 높아지는 모델도 계속 관찰할 수 있어야 한다고 촉구했습니다.
6
16
공개된 정보만으로는 무엇을 판단할 수 있을까
양측 설명이 일치하는 기본 사실은 오픈AI가 정보 취급 문제를 조사한 뒤 세 연구자를 해고했다는 점입니다. 그러나 해당 행위가 사내 규정 위반이었는지, 해고가 안전성 업무와 관련됐는지를 두고는 양측의 주장이 다릅니다. 인용된 공개 보도와 연구자들의 서한만으로는 이 쟁점이 독립적으로 규명되지 않았습니다.
2
3
12
16
연구자들이 특히 우려하는 것은 해고의 파장입니다. 직원들이 불편한 안전 문제를 제기하거나 외부 평가자와 협력하는 일을 부담스러워하게 될 수 있다는 경고입니다. 이는 연구자들이 우려하는 영향이지, 오픈AI의 해고 동기를 입증하는 증거는 아닙니다. 마찬가지로 오픈AI가 밝힌 조사 결과만으로 연구자들의 개별 설명이 거짓이라고 단정할 수도 없습니다.