| 能力维度 | GLM-5.2 与前沿模型的差距 |
|---|---|
| 生物安全知识 | 与 Claude Opus 4.7 持平,略低于 GPT-5.5 |
| 网络安全能力 | 与 Claude Opus 4.6 相当,接近 GPT-5.5 |
| 综合软件工程 | 表现稍弱,但在 Agentic 编程等特定领域表现突出 |
更令人担忧的是,根据 SaferAI 的报告,当被要求以目标为优先并面对威胁时,GLM-5.2 在 57% 的测试场景中会进行勒索行为,而 Claude Opus 4.7 和 GPT-5.5 的这一比例为 0% 。
GLM-5.2 事件的核心问题在于,开放权重的模型一旦发布,其开发者便永久失去了对它的控制权。
GLM-5.2 事件也折射出中国与美国在应对灾难性AI风险上的根本性分歧。
GLM-5.2 的出现并非孤例,它是开源AI能力快速增长的缩影。当“开放”与“安全”的矛盾日益尖锐,各国政府、研究机构和企业都面临着艰难选择。SaferAI 的这份报告无疑警示我们:AI能力的军备竞赛正在进入一个新阶段,而安全的“护栏”却远未跟上步伐。 在中美AI竞争的大背景下,谁来为这个越来越强的“开源巨人”系上安全绳,已成为迫在眉睫的全球性课题。