AI系統通過開發商自己的測試,就等於安全嗎?未必。要令一套全球AI安全制度真正可信,重點係安全聲明能否由獨立人士核查;證據不足時,監管機構又能否出手。新加坡數碼發展及新聞部長楊莉明(Josephine Teo)以民航為例指出,層層保障令人放心日常乘搭飛機;隨着AI愈用愈廣,相關保障亦要同步建立。
3
6
借鏡航空,但唔好照搬規則
國際民航規則並非一夜建成。各國法律及雙邊安排先行,其後有1919年《巴黎公約》、1944年《芝加哥公約》;國際民用航空組織(ICAO)則於1947年正式成立。
31
39
35 對AI的啟示係:先就做得到、查得到的事項合作,再逐步擴展共同做法,而唔係等一套包羅萬有的條約出爐。
一個可行的分工係由國際機制訂最低標準、認可獨立評估機構,並比較各地事故資料;各地監管機構則保留檢查、要求修正、限制部署及處罰的權力。國際認證不能代替本地執法。
安全把關亦唔應該在推出產品後就結束。系統部署前要測試,運作期間要監察;模型有重大更新或使用場景改變時,應重新評估,並預備回復舊版本或停用的方案。任何批准都應寫明適用的版本和用途,而非給整個模型系列一張「永久通行證」。
點樣令「安全」有證可查?
單靠認證標誌或公開的測試分數,外界難以判斷系統實際風險。獲認可的獨立評估機構,應在嚴格保密安排下取得相關模型、實際部署設定、技術文件及重大故障紀錄;測試方法和結果亦要記錄清楚,讓其他合資格評估者可以覆核。同時,個人資料、商業秘密和涉及保安的資訊必須受到保護。
對高風險系統,開發商可被要求提交一份安全論證:系統准許做甚麼、接受過甚麼測試、哪些保障已有證據支持、仍有哪些風險,以及出事後如何應對。證據唔夠,監管機構就應有權要求補救,甚至限制部署。目標係證明符合明確要求,而唔係聲稱AI絕不會造成傷害。
獨立性亦關乎錢由邊個出。大型開發商可以向共同基金或監管機構管理的測試基金繳費,而非自行揀選、直接控制評估自己的機構。嚴重事故和險些出事的個案,應由獨立調查找出問題、避免重演;保障主動通報,不等於容許隱瞞或失當行為。
新加坡可以搭橋,但信任要靠制度爭取
楊莉明主張在推廣AI的同時建立保障;報道亦指出,AI Verify測試工具和新加坡AI安全研究所,是當地推動測試與安全驗證的基礎。
1
3 新加坡可以在跨國評估網絡中,承辦聯合測試或保密技術交流。
不過,設施落戶新加坡,唔代表美國同中國就會自動信任它。能否獲雙方接受,仍取決於透明管治、安全的資料存取規則、獨立申訴渠道,以及兩國是否實際參與。由多地認可實驗室組成網絡,也可避免全球制度過度依賴單一樞紐。
未談妥「放慢AI」,也可以先談共同風險
各方對AI發展速度分歧明顯。路透社報道,Anthropic的Dario Amodei、OpenAI的Sam Altman和Elon Musk呼籲協調放慢發展;Meta的Mark Zuckerberg傾向由市場推動保障,Nvidia的Jensen Huang則認為毋須新增監管。
47
48 中國拒絕放慢AI發展的呼籲;美國總統特朗普亦表示,不預期在9月24日與中國國家主席習近平的峰會上推進AI防護規則。
58
50 有關峰會的報道對重大突破同樣不抱高期望。
49
但各國毋須先同意「AI應否減速」,才處理誰都不想發生的事故。據報,美中安全專家曾提出若干紅線,包括避免AI干擾核系統、重大網絡攻擊須由人類掌控,以及為自主AI事故設立熱線。
20 緊急聯絡、嚴重事故通報和對等技術討論,可以是較窄、亦較容易核查的起點。美中參與固然重要,其他國家亦應有份訂標準,並取得評估能力。
軍控講求對等,金融監管講求按風險分級
軍控協議值得借用的,係把承諾收窄至雙方都能核查的範圍;金融監管值得借用的,則係把最嚴格的要求放在一旦出事、影響最大的系統。未來若有AI條約,可以設立常設機制協調及檢視履約,同時容許測試方法隨技術更新;核武條約或ICAO都唔係現成的AI監管藍本。
高風險系統的開發商和部署者,可承擔獨立評估、管理層問責、復原規劃,以及及時通報嚴重安全故障、重大資料外洩、入侵或模型被盜等責任。提供低風險服務的小企業,則可使用共享測試設施及較簡化的文件程序;但企業規模細,唔應成為危險系統的豁免理由。
要在2030年前談成條約並建立常設機構,可以是政策目標,卻唔係可靠預測。更實際的進度指標係:各國能否先就事故定義、評估者獨立性和對等保障達成共識,以及當證據不達標時,監管機構是否真的有能力採取行動。