一家企业说自己的AI系统“安全”,外界凭什么相信?答案不能只是一张认证标志或一项测试分数。要让跨国安全规则真正发挥作用,关键是让合格的外部机构能够核验安全证据,并让监管部门在证据不足或系统出问题时有权采取行动。
新加坡数码发展及新闻部长杨莉明曾以民航作类比:人们之所以愿意经常乘飞机,依靠的是多层次的安全保障。她主张在推广AI的同时建立相应保障,而不是等到广泛应用后再补救。
3
6
借鉴民航:先合作,再逐步完善规则
国际民航并非一开始就有完整的全球制度。各国法律和双边安排先行;1919年《巴黎公约》确立早期国际规则,1944年《芝加哥公约》搭建新框架,国际民用航空组织(ICAO)于1947年正式成立。
31
39
35 对AI的启示不是照搬民航条文,而是先就可执行的事项合作,再随着共同实践积累完善制度。
一种可行的分工是:国际层面协调最低标准、认可独立评估机构,并汇总比较事故信息;各国监管部门负责检查、要求整改、限制部署和实施处罚。国际证书可以帮助不同国家理解测试结果,却不能取代本国执法。
安全审查也不能止于上线前。规则应覆盖部署前测试、运行监测、重大更新后的重新评估,以及必要时的回退或停用。任何许可都应写明适用的系统版本和使用场景,不能被理解为对未来所有用途的永久背书。
把“安全承诺”变成可核验的证据
独立评估机构需要在安全条件下接触相关模型、实际部署配置、技术文件和重大故障记录;其测试方法与结论也应留下足够清晰的记录,供其他合格机构复核或质疑。同时,访问权限必须保护个人数据、商业秘密和敏感安全信息。
对于高风险系统,开发者可被要求提交一份安全论证:系统能做什么、做过哪些测试、哪些防护措施已得到验证、还剩什么风险,以及出事后如何处置。证据不充分时,监管部门应能要求整改或限制部署。这里要核验的是是否符合明确要求,而不是要求企业保证风险永远为零。
还要处理“谁付钱、谁选评估者”的利益冲突。大型开发者可以向共同基金或监管机构管理的资金池缴费,而非直接掌控评估自己的机构。严重事故和险情应由独立机构调查,以查明原因、防止重演;保护主动报告,不等于纵容隐瞒或违规。
新加坡可以提供平台,但信任不能预设
相关报道将新加坡的AI Verify测试工具和人工智能安全研究所列为其测试与保障工作的基础;杨莉明也强调,应在AI普及过程中同步建设安全措施。
1
3 新加坡可以在更广泛的评估机构网络中承办联合测试或保密技术交流。
但设立测试中心,并不意味着美国和中国就会同时信任它。信任还取决于透明的治理、严格的访问规则、独立申诉机制,以及双方是否实际愿意参与。多个地区的机构共同承担评估,也比依赖单一枢纽更稳妥。
不必先就“放慢AI”取得一致
政治分歧依然明显。路透社报道,Anthropic的达里奥·阿莫代伊、OpenAI的萨姆·奥尔特曼和埃隆·马斯克呼吁协调放缓AI发展;Meta的马克·扎克伯格倾向市场主导的保障措施,英伟达的黄仁勋则认为不需要新监管。
47
48 中国已拒绝放缓发展的呼吁;美国总统特朗普表示,不预期在9月24日与中国国家主席习近平的峰会上推进AI防护规则。有关此次峰会的报道也认为,重大突破的可能性不高。
58
50
49
不过,各国不必先解决所有分歧,才能处理共同担忧的风险。有报道称,美中安全专家提出的起点包括:为核系统划定红线、确保影响重大的网络攻击仍由人类控制,并为自主AI相关事件建立热线。
20 在此基础上,紧急联络、严重事故通报和对等技术讨论,可能比一开始就谈全面放缓更容易核查。美中参与很重要,其他国家也应有制定标准的发言权,并能获得评估能力。
军控重在可核查,金融监管重在按风险分级
军控经验提示,各方可以先谈范围明确、能够相互核验的承诺;未来若制定AI条约,可设常设机构协调合作、审查履约,同时允许技术测试方法持续更新。但核武器条约或民航制度,都不是可以直接套用的AI模板。
金融业监管提供另一条思路:把最严格的要求放在事故可能造成最大影响的地方。高风险系统的开发者和部署者可承担独立评估、管理层问责、恢复计划及及时报告义务;报告事项包括严重安全故障、重大数据泄露、黑客入侵或模型被盗。提供低风险服务的小企业则可使用共享测试设施和简化文件要求,但企业规模小,不应成为部署危险系统的豁免理由。
在2030年前达成条约并设立常设机构,可以是政策目标,却不是可靠预测。更扎实的进展指标是:各国能否先统一事故定义、确保评估者独立、建立对等保障,并让监管部门在安全证据不足时真正采取行动。