Microsoft喺2026年10月7日於三藩市舉行Windows及Surface活動,提出Windows未來會採用「混合智能」(hybrid intelligence):AI工作適合喺電腦本機處理時就留喺本機,需要更多支援時再連接雲端,同時受Windows嘅安全及管理機制規管。Windows主管Pavan Davuluri形容,智能代理應該可以按需要喺本機運行、連接雲端,並喺Windows嘅安全控制下工作。
19
重點唔係所有AI工作都會搬到手提電腦,而係Microsoft想由Windows統一協調本機同雲端模型,當成同一套系統嘅不同部分。
Windows嘅「混合智能」係乜?
簡單講,有啲工作可以交畀電腦上嘅本機模型處理;需要其他能力時,雲端模型仍然可以派上用場。Microsoft將呢種配搭視為Windows智能代理及AI功能嘅基礎,而唔係雲端服務嘅替代品。
19
為咗令開發者更容易喺Windows運行本機模型,Microsoft表示會喺模型執行環境Windows ML加入對llama.cpp嘅支援。呢項支援有望令開發者更容易透過Windows支援嘅硬件執行更多開源模型。
39
43
DeepSeek、Nemotron同Microsoft自家編碼模型
Microsoft提到多款可供本機使用嘅模型,包括DeepSeek V4 Flash、Nvidia即將推出嘅Nemotron模型,以及Microsoft自家嘅MAI Code 1.1 Flash編碼模型。
33
據報,DeepSeek V4 Flash有2,840億個總參數,並以1.6-bit量化壓縮,將所需記憶體降至約60 GB。Microsoft形容佢嘅能力「接近前沿」(near-frontier),但呢個屬於效能宣稱;現有來源未有提供獨立基準測試結果作證。
26
Nvidia即將推出嘅Nemotron模型,據稱有超過700億個參數,並以2-bit量化,所需記憶體略多於20 GB。相關報道提到目標推出日期為10月15日;呢個應視為預定時間,而唔係模型已經上市嘅確認。
26
33
記憶體數字亦反映壓縮有幾重要。單計模型權重,2,840億個參數如果以4-bit儲存,大約需要142 GB,仲未計執行時額外開支。報稱只用約60 GB嘅版本,依賴更激進嘅量化壓縮。現有來源未能證實呢個特定壓縮版本喺獨立測試中嘅表現,因此Microsoft對模型質素嘅說法仍有待驗證。
26
由模型分流到限制代理權限
Microsoft亦介紹咗用軟件將模型同工作配對嘅方向。GitHub嘅HydraFusion方案可以按任務將工作分配畀合適模型,本機模型亦可以列入選項。
39
至於能夠操作電腦嘅智能代理,Microsoft公布Execution Containers,作為限制代理可以存取或執行乜嘢嘅隔離層。呢啲控制措施係Windows智能代理計劃嘅一部分:本機能力愈多,愈需要清楚界定代理可以接觸嘅範圍。
34
RTX Spark硬件令本機AI走入電腦
Microsoft已為Surface Laptop Ultra開放預訂。呢款手提電腦採用Nvidia RTX Spark硬件,售價由2,599美元起;Microsoft列出最高配備128 GB統一記憶體嘅配置。
18
31
呢類硬件旨在令較大型嘅本機模型更容易運行,但售價同記憶體需求亦顯示一個現實限制:要喺個人電腦運行規模較大嘅模型,可能需要昂貴而且記憶體充足嘅系統。Nvidia另一款DGX Spark嘅定價亦反映成本壓力:報道指128 GB型號售價升至6,950美元,而新推出嘅64 GB版本售價為4,999美元。
3
呢次公布證實咗乜,又未證實乜?
Microsoft嘅方向相當清楚:Windows會嘗試協調本機同雲端AI,為更多開源模型提供支援,亦會加入智能代理控制措施。不過,今次活動未能證明本機模型喺各類任務上都可以媲美雲端服務、公布嘅模型效能已獲獨立驗證,或者裝置端AI可以令雲端運算變得多餘。呢啲問題仍要視乎實際測試、軟件供應情況,以及用戶手上嘅硬件。
現階段,「混合智能」最適合理解為一項平台策略:Windows會嘗試喺合適嘅AI工作中使用電腦本身嘅運算能力,同時保留雲端模型作為另一個選項。