AI 公司說自己的系統「安全」,外界要怎麼核實?如果測試只靠開發商自行公布的分數,出了問題又沒有人能要求改正,再響亮的國際宣言也難以換來信任。新加坡數位發展及新聞部長楊莉明(Josephine Teo)以民航為例指出,層層防護讓人們得以安心搭機;隨著 AI 使用日益普遍,也需要建立相應的安全機制。
3
6
民航的啟示:先合作,再逐步建立制度
國際民航規則不是一次到位。各國法律與雙邊協議先行,接著有 1919 年《巴黎公約》、1944 年《芝加哥公約》,國際民航組織(ICAO)則於 1947 年正式成立。
31
39
35 AI 不必照搬民航規則,但可以借鏡這種漸進方式:先就具體問題達成協議,再累積共同標準。
一種可行的分工是:國際層級研擬最低標準、認可獨立評估機構,並彙整各國事故資料;各國主管機關則保留查核、要求修正、限制部署及裁罰的權力。國際認證不能取代本國執法。
安全要求也不能停在產品推出前。系統上線後仍須監測;模型或使用情境有重大變更時,應重新評估,並備妥回退或停用方案。通過審查的範圍,應清楚限定於特定版本和使用情境,而非一張永久通行證。
把「安全」變成可查核的證據
獨立驗證不只是頒發標章或公布測試成績。具資格的評估機構需要在安全控管下,取得相關模型、實際部署設定、文件及重大故障紀錄;測試方法與結果也應留下足夠紀錄,供其他合格評估者檢視,同時保護個資、商業機密與敏感的安全資訊。
對高風險系統,開發商可被要求提出一份安全論證:系統能做什麼、如何測試、哪些防護已獲驗證、還有哪些風險,以及事故發生時如何應對。證據不足時,主管機關必須能要求改善或限制部署。目標是證明符合明確要求,而不是承諾絕不造成傷害。
測試經費也會影響獨立性。大型開發商可以透過共同基金或由主管機關管理的費用機制負擔成本,而非自行挑選並直接控制評估者。重大事故與「差點出事」的事件,則應由獨立調查著重找出成因、避免重演;保障通報者,不等於容許隱瞞或不當行為。
新加坡可提供場地,但信任不能自封
楊莉明主張在推廣 AI 的同時建立防護;報導也指出,新加坡的 AI Verify 測試工具與人工智慧安全研究所,是其推動測試及安全保證工作的基礎。
1
3 在更廣泛的合格實驗室網絡中,新加坡可以是共同評估或機密技術交流的場地之一。
但設有測試中心,不代表美中雙方就會信任它。透明的治理、嚴謹的資料存取規則、獨立申訴機制,以及雙方實際參與,才是取得信任的條件。採用分散式網絡,也能避免全球制度過度依賴單一樞紐。
不必先談妥「放慢 AI」,先處理共同風險
各方對 AI 發展速度意見分歧。據路透社報導,Anthropic 的 Dario Amodei、OpenAI 的 Sam Altman 與 Elon Musk 呼籲協調放慢發展;Meta 的 Mark Zuckerberg 傾向由市場推動防護,輝達執行長 Jensen Huang 則認為不需要新監管。
47
48 中國拒絕放慢發展的呼籲;美國總統川普表示,不預期在 9 月 24 日與中國國家主席習近平的峰會上推進 AI 防護規則。
58
50 關於這場峰會的報導,也指出各界對重大突破期待不高。
49
即使無法就發展速度達成共識,各國仍可先防範彼此都不願見到的事故。有關美中安全專家建議的報導提到,可能的起點包括避免 AI 介入核指揮系統、讓人類掌控影響重大的網路攻擊,以及為自主 AI 相關事件設立熱線。
20 接下來可討論緊急聯絡、重大事故通知與對等技術交流。美中參與至關重要,但其他國家也應有機會參與訂定標準,並取得評估能力。
高風險要嚴管,小業者不必承擔同一套成本
軍備管制可提供一項原則:先談範圍清楚、能相互核實的承諾;金融監管則提醒我們,要求應隨風險提高。高風險 AI 的開發者與部署者,可須接受獨立評估、明確的管理責任與復原規劃,並及時通報重大安全失誤、嚴重資料外洩、駭侵或模型遭竊。提供低風險服務的小型業者,則可使用共享測試資源與較簡化的文件要求;但規模小,不應成為危險系統的豁免理由。
在 2030 年前完成條約與常設國際機構,是有企圖心的政策目標,不是可靠預測。更務實的進度指標是:各國能否先對事故定義、評估者獨立性與對等防護達成共識,以及當證據不足時,主管機關是否真能採取行動。