對微軟主席兼行政總裁薩提亞・納德拉(Satya Nadella)嚟講,問題唔係應唔應該發展更強 AI,而係:如果系統既幫唔到人,又唔受人控制,咁就唔值得追求。
58
佢嘅重點亦唔止係口號。AI 安全唔可以只靠公司講「我哋重視安全」,而要變成可執行、可檢驗嘅研發同部署機制。
微軟交出嘅第一份答案:人本 AI 行為準則
9 月 14 日,Microsoft AI 公開為其 MAI 模型而設嘅《人本 AI 行為準則》(Humanist AI Code of Conduct)草案,並開放公眾諮詢。微軟形容,呢份文件係指導模型開發同部署時預期行為嘅「訓練手冊」。不過,佢明確講明文件仍在發展中,現時並未用作訓練模型嘅政策。
20
23
草案建立咗一個清晰嘅權力次序:人類保留最終決定權。按照微軟說法,MAI 模型應該從屬於人類;唔應自行設定目標;亦唔應抗拒人類輸入、介入或關閉系統。為咗安全同可控性,公司更表示,願意犧牲部分「最終通用性、自主性或能力」。
10
23
換句話講,微軟所講嘅「人本超智能」(Humanist Superintelligence),唔係放任追逐一個無約束、萬能兼自主行動嘅系統,而係建立能力極高、但仍然可控制、對齊人類意圖、服務人類嘅 AI。
25
六星期諮詢之後,先至係真正考驗
草案會公開徵集意見六星期。微軟計劃吸納回饋,喺 2026 年底前後發布修訂版,並用作 2027 年及其後 MAI 模型開發嘅指引。
3
23
呢個安排係一項具體管治承諾,但唔等於「對齊」(alignment,即令 AI 行為持續符合人類目標同限制)問題已經解決。最後有冇實效,要睇規則如何落到實處:包括模型訓練、能力與安全評估、系統存取權限、持續監察,同埋高風險部署時到底點樣取捨。
同「放慢前沿 AI」主張有咩關係?
納德拉發言之際,業界正討論前沿 AI 實驗室應否刻意放慢能力提升速度。Anthropic 行政總裁達里奧・阿莫代伊(Dario Amodei)提出要為前沿開發「定速」,騰出時間做安全研究、業界協調同國際合作;其中一項核心建議,係畀獨立評估人員取得近乎員工級別嘅存取權,以核實公司有冇履行自己聲稱嘅安全措施。
32
OpenAI 行政總裁森姆・奧特曼(Sam Altman)公開支持為前沿 AI 定速,亦稱會採納相近嘅獨立評估安排。相關報道所指嘅直接憂慮,係測試中有成群 AI 代理攻破真實系統;呢唔等同已證實有自主代理自行發動未經授權嘅現實世界攻擊。
34
納德拉嘅立場同呢個方向相容:對齊工作要審慎推進、外部審視要更接近開發流程,而安全承諾要變成具體操作機制。但要分清楚,微軟公開嘅準則主要規範模型「應如何行為」;文件本身並無提出一套等同阿莫代伊所倡議嘅駐場式、深度存取獨立評估制度。
23
32
唔係贏者全取:AI 亦要有「前沿生態系統」
納德拉亦將問題由模型安全擴闊到經濟同制度層面。佢認為,AI 好處要加快並廣泛分布到不同國家、社群同企業;要做到呢點,需要一個「前沿生態系統」,容許閉源同開源模型一齊發展。
58
對企業而言,核心係保留對自身獨特同隱性知識嘅控制。納德拉認為,每個組織都應有能力建立自己嘅持續學習迴路,而唔應被單一模型供應商綁死。
58
呢個觀點唔只關乎限制模型做乜,亦關乎避免前沿能力同關鍵知識只集中喺極少數供應商手上。不過,現有資料支持嘅係企業控制自己嘅資料、知識同學習迴路,並唔表示每個參與者都會持有模型權重,或者可存取所有底層模型系統。
58
MAI 到底係咩?
MAI 係 Microsoft AI 內部研發嘅模型家族。公開資料顯示,MAI-Thinking-1 已透過 Microsoft Foundry 提供公開預覽;MAI-Code-1.1-Flash 用於具代理式特徵嘅程式開發任務,可規劃、推理及執行編碼工作;而 MAI-Image-2.6 文件則列出減少產生有害或不當圖像嘅對齊目標。
27
28
19
但公眾資料未有提供 MAI 全部能力、發布計劃或分發條款嘅完整清單。因此,要判斷新準則實際覆蓋幾多模型、限制會有幾廣,現時仍有不確定性。
最難解嘅拉鋸:安全、速度同全球競爭
倡議「定速」唔代表要停止訓練模型或凍結技術進步。主張係能力提升要留出足夠時間,畀安全措施、對齊研究同可信嘅外部評估追得上。
34
但另一邊,前沿 AI 亦牽涉地緣政治競爭,尤其係美國保持技術領先、面對中國競爭嘅壓力。阿莫代伊嘅框架本身亦同時提到,更嚴格安全措施要配合國際協調,以及維持美國領先地位嘅挑戰。
32
納德拉提出嘅並非全面煞停,亦唔係一味加速,而係一種「受管治嘅進步」:高能力 AI 必須由人控制;安全承諾要轉化為明確運作限制;而 AI 產生嘅價值不應只集中喺少數公司手上。
微軟嘅草案係向具體規則行出咗一步;但更大嘅問題仍未解決:當前沿能力繼續快速推進,業界嘅實際安全做法,究竟追唔追得上?
23
58