
Create a landscape editorial hero image for this Studio Global article: What are Singapore’s and Microsoft’s plans, under their June 12, 2026 memorandum of understanding, to jointly test the safety and security o. Article summary: Singapore’s June 12 MOU with Microsoft is a framework for evaluating and governing frontier AI, not a public commitment to deploy a particular model. It supports joint safety-and-security research—including multilingual . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
新加坡資訊通信媒體發展局(IMDA)同微軟於 2026 年 6 月 12 日簽署的諒解備忘錄(MOU),應該理解為一份用來評估及管治前沿人工智能(frontier AI)的合作框架,而唔係宣布會喺新加坡部署微軟、或者任何特定名稱的前沿模型。協議聚焦共同研究、資訊分享、可信存取政策,以及代理式 AI 和跨語言安全測試。
換句話講,雙方想先處理一個更基本的問題:當 AI 系統能力強到可以規劃任務、使用工具,甚至影響敏感環境時,應該點樣測試佢、點樣限制存取,又由邊個負責監察同問責。
合作主要分為三個互相扣連的方向。
IMDA 同微軟會合作進行 AI 安全及保安研究,包括代理式 AI,以及多語言 AI 安全評估方法。跨語言測試之所以重要,係因為模型的安全防護未必喺唔同語言、語氣、文化背景或表達方式下都一樣有效;同一個有害意圖,換另一種語言或地方用語表達,模型可能會有唔同反應。
代理式 AI 就更加唔可以只係睇佢「答得啱唔啱」。如果系統可以自行分拆目標、呼叫工具或者跨越多個工作流程,評估就要包括:佢獲准做啲乜、遇到含糊指令時會點處理,以及技術控制能否阻止錯誤或有害行動。
協議講的是研究同測試方法,並冇公布任何特定模型會喺新加坡正式推出或部署。
雙方亦計劃分享資訊、最佳做法及 AI 管治框架。實際意義係將技術測試同日常營運決策接埋:應該測試邊類風險、用咩門檻判斷可以接受、邊啲人可以接觸模型,以及發現嚴重弱點後應該點處理。
呢個方向唔止係比較模型「識做幾多題」。一個模型即使喺基準測試表現出色,如果存取權限過闊、監察不足、漏洞披露程序唔清晰,或者缺乏人類監督,仍然未必適合用喺公共服務或重要基礎設施環境。
第三個重點係探索前沿模型的「可信存取」政策。核心概念係受控使用:能力非常強的系統,可以畀合資格人士用作合法測試及有用工作,但就唔應該喺欠缺相應安全措施下全面公開。
因此,今次 MOU 指向一套分層式 AI 安全做法:先測試系統,再分享所得資料;有需要時限制存取;同時用管治規則界定權限、責任及問責。
Anthropic 尚未公開發售的 Claude Mythos Preview,正好展示前沿 AI 的「雙重用途」問題。Anthropic 表示,佢同大約 50 個 Project Glasswing 合作夥伴,利用受限制的模型喺具系統重要性的軟件中發現超過 10,000 個高嚴重程度或關鍵嚴重程度漏洞。Anthropic 亦表示,Mythos 能夠喺主要作業系統及瀏覽器中識別及利用漏洞,包括零日漏洞。
呢種能力可以用嚟防守,例如協助研究人員喺罪犯之前搵出軟件漏洞;但如果模型被廣泛公開,或者存取控制做得唔嚴謹,同一種能力亦可能縮短由發現漏洞到發動攻擊的時間。正因如此,Anthropic 透過 Project Glasswing 將 Mythos 限定畀特定夥伴使用,而唔係向公眾開放。
不過,現有證據未能證明 Claude Mythos 直接促成或觸發新加坡同微軟喺 6 月 12 日簽署的 MOU。較穩妥的理解係:Mythos 係一個例子,反映前沿 AI 能力同網絡風險正快速轉變,亦解釋點解結構化測試、受控存取及清晰管治框架變得更加重要。
Project Glasswing 將 Mythos 只提供畀一批指定合作夥伴,用作防守性保安工作,而唔係直接公開發布。呢種安排可以減少高風險能力暴露,同時畀保安團隊研究模型實際做到咩。
當然,限制存取唔代表安全問題已經完全解決。佢仍然要靠嚴格審查使用者、持續監察、安全處理資料,以及負責任披露漏洞等措施配合。但呢個做法清楚展示咗「可信存取」背後的原則:模型能夠做幾多、風險有幾高,就應該決定邊個可以用、點樣用,而唔係將所有前沿模型當成普通公開軟件。
發現漏洞只係第一步。新加坡網絡安全局(Cyber Security Agency of Singapore,CSA)建議機構為關鍵及高嚴重程度漏洞打補丁、喺所有介面及閘道啟用多重因素認證,並檢討不必要的使用權限。呢啲措施可以喺機構調查及修復漏洞期間,減少攻擊者利用弱點的機會。
至於 Mythos 發現的約 10,000 個漏洞,現有資料亦唔支持將佢哋概括講成「大部分已經修復」。一份較後期的評估指,有 1,596 個漏洞已向維護者披露,但只有 97 個獲修復。呢個數字唔代表 Project Glasswing 冇防守價值,但「好多漏洞已經修好」呢類講法就應該審慎處理。
當中反映的重點唔止係技術問題,亦係一套實際操作流程:識別風險、負責任披露、按優先次序修復,並喺修復未完成之前盡量減少系統暴露。
微軟具備前沿模型開發、企業級基礎設施,以及評估 AI 系統和控制模型存取的營運經驗。可是,MOU 的公開範圍比單一個微軟模型闊,重點係研究前沿模型的安全測試方法及可信存取框架。
根據現有資料,以下幾項較具體說法,未能證實係今次新加坡—微軟 MOU 的正式承諾:包括微軟自家 MAI 模型、Azure AI Foundry 存取 OpenAI 及 Anthropic 模型,以及微軟同英國 AI Security Institute、美國 Centre for AI Standards and Innovation 的類似安排。因此,呢啲內容唔應該當成協議已經確認的一部分。
將協議各部分放埋一齊,可以睇到一條比較完整的安全鏈:
所以,今次 MOU 的意義唔係宣布前沿 AI 已經安全,亦唔係單靠一份協議就可以消除 Claude Mythos 所揭示的風險。佢更似係將技術評估、存取管治同網絡安全實務連成一體,務求喺「能力強」被誤當成「已經準備好」之前,先建立一套較安全、可靠、穩健及可問責的使用條件。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
新加坡資訊通信媒體發展局(IMDA)同微軟於 2026 年 6 月 12 日簽署的 MOU,旨在建立前沿 AI 的安全測試及管治框架,涵蓋多語言及代理式 AI 評估。
新加坡資訊通信媒體發展局(IMDA)同微軟於 2026 年 6 月 12 日簽署的 MOU,旨在建立前沿 AI 的安全測試及管治框架,涵蓋多語言及代理式 AI 評估。 合作有三大方向:AI 安全技術研究、交流知識及管治最佳做法,以及研究前沿模型的可信存取政策。
Claude Mythos 顯示前沿 AI 具備雙重用途:可以協助防守方搵漏洞,亦可能加快攻擊者發現及利用漏洞;不過,目前證據未能證明 Mythos 直接促成今次新加坡—微軟協議。