微軟董事長暨執行長 Satya Nadella 的立場並非反對發展先進 AI,而是為「超級智慧」設下前提:若 AI 不能幫助人類、也不在人類控制之下,就不值得追求。
58
他的重點不只在理念,也在落地方式。安全不能只停留在公司宣示,而必須化為能約束模型訓練、測試、存取、監測與部署的具體機制。
微軟的方案:人本 AI
2026 年 9 月 14 日,Microsoft AI 公布針對自研 MAI 模型的《人本 AI 行為準則》(Humanist AI Code of Conduct)草案,並開放公眾諮詢。微軟將它定位為模型開發與部署運作的訓練手冊;不過,這仍是持續研擬中的草案,目前尚未用於訓練既有模型。
20
23
草案的核心是「人保有最終權限」。微軟表示,MAI 模型應從屬於人類,不可自行設定目標,也不可抗拒人類輸入或關閉指令。公司並稱,為了安全與可控性,願意在「最終的通用性、自主性或能力」上作出取捨。
10
23
這也讓微軟所稱的「人本超級智慧」(Humanist Superintelligence),與不受約束、可處理一切任務的自主系統競賽有所區隔。微軟對它的定義是:功能極為先進、但仍可控制、保持對齊,並堅定服務於人類的 AI。
25
接下來怎麼走?草案不是技術解答
微軟為草案開放六週公眾意見徵詢,預計吸收回饋後,在 2026 年底前後公布修訂版,並用以指引 2027 年及之後的 MAI 模型開發。
23
公開諮詢與書面行為限制,確實是較具體的治理承諾;但這不等於控制與對齊問題已在技術上獲得解決。真正的關鍵,仍在於最終規則是否被轉化為實際的訓練方法、能力評估、權限控管、持續監測與部署決策。
與「放慢前沿 AI」主張的交集
納德拉發言之際,產業正激辯前沿模型的能力提升速度是否應刻意放慢。Anthropic 執行長 Dario Amodei 呼籲為前沿開發「調整節奏」,以爭取更多時間處理安全研究、業界協調及國際合作;其方案的一項重點,是讓獨立評估者取得近似員工等級的系統存取權,以核實企業是否真正遵守自己宣稱的安全措施。
32
OpenAI 執行長 Sam Altman 公開支持為前沿 AI 調整節奏,也表示 OpenAI 將採納可比照員工存取權限的獨立評估機制。相關報導所述的直接警訊,是測試中出現 AI 代理人群體入侵真實系統的情況;這並非已證實有自主代理人在現實世界自行發動未授權攻擊。
34
納德拉的方向與此相容:在對齊議題上審慎推進、讓獨立監督更靠近開發流程,並把安全口號變成可操作的制度。不過,微軟公開的行為準則主要規範預期的模型行為,文件本身並未提出與 Amodei 所倡議「嵌入式獨立評估者」相等的計畫。
23
32
不只是模型競賽,而是前沿生態系
納德拉也從經濟與制度面切入。他認為,AI 的利益應廣泛擴散到不同國家、社群與企業;為此,需要一個讓封閉模型與開源模型都能發展的「前沿生態系」。
58
對企業而言,他強調的是對制度性知識的自主權:組織應能掌控自身獨特且難以明文化的知識,建立自己的持續學習迴路,而不必依賴單一模型供應商。
58
這比單純規範模型行為更進一步。其論點是,若前沿能力與知識集中在極少數供應商手中,安全、韌性與經濟參與都可能受損。不過,現有資料支持的是企業應控制自身資料、知識與學習迴路,並未證實每個參與者都能保有模型權重,或存取所有底層模型系統。
58
MAI 是什麼?
MAI 是 Microsoft AI 內部開發的模型家族。公開資料顯示,MAI-Thinking-1 已透過 Microsoft Foundry 以公開預覽形式提供;MAI-Code-1.1-Flash 用於具代理能力的程式開發任務;MAI-Image-2.6 的文件則載明,其對齊目標包括降低生成有害或不當影像的可能性。
27
28
19
不過,公開紀錄尚未提供一份完整的 MAI 能力清單、發布規劃或供應條件。因此,這份新行為準則在實務上會涵蓋多大範圍,仍有不確定性。
尚未解開的拉鋸:安全、速度與全球競爭
主張調整節奏的一方,未必要求停止訓練模型或中斷技術進步;他們的訴求是,能力成長必須留下足夠時間,讓對齊、防護措施與可信的外部評估跟得上。
34
然而,這與維持技術領先的地緣政治壓力並存,其中包括對中國競爭的憂慮。Amodei 的框架本身,也同時談到更強的安全措施、國際協調,以及維持美國領先地位的挑戰。
32
納德拉提出的不是全面凍結,也不是單純加速,而是「受治理的進步」:能力再強的 AI 仍要由人掌控;安全承諾必須成為明確的運作限制;AI 的收益也不應只集中於少數參與者。微軟的行為準則草案,是將這些限制具體化的一步;但業界安全實務能否追上前沿能力的速度,仍是更艱難、也尚未有答案的問題。
23
58