NVIDIA 同 Palantir 推出一套面向複雜、關鍵供應鏈嘅「主權 AI」技術棧,而 NVIDIA 會先喺自己嘅營運中使用它,等於擔任產品嘅首個實戰客戶。兩家公司之後會向其他機構提供這套架構。
11
重點唔係喺供應鏈資料上加個聊天機械人,而係將營運資料、最佳化軟件、AI 模型,同資深規劃人員嘅判斷整合到一個由企業自己掌控、並有管治機制嘅環境入面。
今次公布咗乜
呢套技術棧把 NVIDIA 開放式 Nemotron 模型整合進 Palantir Foundry 同 Artificial Intelligence Platform(AIP),並以 Palantir Ontology 作為底層嘅營運模型。兩家公司表示,系統可協助機構識別限制因素、把營運經驗轉化為可重用嘅知識,並支援供應鏈決策。
11
NVIDIA 首個應用目標係加快由半導體晶圓到「first token」嘅流程,即 AI 系統完成部署並開始產生輸出嘅階段。NVIDIA 將之形容為把供應鏈中嘅營運智慧編碼化。
11
點解 NVIDIA 自己條供應鏈會成為首個試點?
NVIDIA Vera Rubin 系統嘅供應鏈規模,正好說明問題有幾複雜:每個機架約有 130 萬個零件,涉及運算、記憶體、網絡、供電、冷卻及機械系統。
3
7
喺咁多環環相扣嘅零件之下,物料分配唔係靠試算表就處理到。生產計劃可能會受製造產能、零件供應、到貨時間,或者已承諾予客戶嘅供貨量所限制。NVIDIA 正利用 Palantir Ontology、供應鏈 Command Center 及 NVIDIA cuOpt,評估不同情境,並把稀缺物料分配到各個生產地點。
1
6
NVIDIA 採用嘅決策目標叫做 Time of Ownership,即物料仍由 NVIDIA 持有、未能轉化為已交付系統嘅時間。實際用途係找出邊一項限制正在卡住產出,並判斷哪個分配決定最能紓緩問題。
1
系統由邊幾部分組成?
各個組件分工不同:
- Nemotron 開放式模型:提供推理能力,可針對供應鏈決策再作專門化訓練。
- Palantir Foundry 及 AIP:提供資料與應用環境,讓團隊可以把模型連接到營運流程。
- Palantir Ontology:表達現實營運中重要嘅實體及關係,例如物料、地點、產能、分配、承諾及生產結果。
11
6
- NVIDIA cuOpt:支援最佳化及情境分析,例如物料分配決策。
1
兩家公司將它定位為一個具管治能力嘅營運環境,而唔係把通用模型接駁去零散資料庫。NVIDIA 開發者文章強調,專有供應鏈資料、模型權重同推理程序,都會留喺同一個受管治嘅環境內。
1
點解訓練模型時要加入人類規劃人員判斷?
NVIDIA 發現,單靠數學最佳化未必能夠涵蓋資深規劃人員所掌握嘅全部背景。現實決策往往要考慮非結構化、而且瞬息萬變嘅資訊,例如電郵、天氣預報、地緣政治發展、供應商簡報同機構內部經驗。
1
因此,NVIDIA 以規劃人員過往嘅物料分配選擇、背後理由及其後結果,作為後續訓練資料,建立專門化嘅 Nemotron 3.5 Lightning 模型。該模型總共有 300 億個參數,採用混合專家(mixture-of-experts)設計,每次前向運算約有 30 億個參數處於活躍狀態。
1
NVIDIA 在自家開發用的物料分配決策基準上公布以下成績:
| 模型 |
公布的物料分配決策準確率 |
| 經後續訓練的 Nemotron 3.5 Lightning |
86.7% |
| Nemotron 3 Ultra |
55.5% |
| 基礎版 Nemotron 3.5 Lightning |
17.5% |
以上係 NVIDIA 在其自身開發基準上公布嘅結果,並非獨立機構對所有供應鏈或所有部署情況作出嘅效能驗證。
1
AI 有建議,點解人仲要把關?
兩家公司並無將系統包裝成可完全取代供應鏈規劃人員嘅自動駕駛工具。物料分配牽涉重大取捨,而新出現嘅資訊亦可能未曾反映喺既有訓練資料之中。
所以,人類規劃人員仍然要負責檢視、調整同改善系統建議。呢些介入可以變成新嘅受管治決策紀錄,形成持續後續訓練及營運改善嘅回饋循環。
1
企業同政府點樣部署?
NVIDIA 同 Palantir 表示,其他機構可透過 Palantir Sovereign AI Operating System Reference Architecture,把這套架構用於自己嘅供應鏈,並可部署喺雲端或本地機房。目標客群包括複雜行業及政府環境,尤其係希望保留專有資料控制權嘅機構。
11
相關參考架構建基於 NVIDIA Enterprise Reference Architectures,並經測試及驗證可運行 Palantir 軟件套件,包括 AIP、Foundry、Apollo、Rubix 同 AIP Hub。
29
Dell 屬於相關基礎設施生態系統之一:其架構結合 Dell AI Factory 基礎設施,包括 PowerEdge、ObjectScale 及 PowerFlex,以及 Palantir 和 NVIDIA 技術。
17 有關 9 月公布嘅報道亦提到 Cisco、Rackspace 同 Nebius,作為硬件或雲端部署選項的合作夥伴。
25
喺邊度亮相?
這次供應鏈部署,以及較廣泛嘅主權 AI 應用,喺 Palantir 的 AIPCon 11 活動展示。
6
今次公布最值得留意之處,係 NVIDIA 先把聯合技術棧用喺自己高度受限制、極度複雜嘅供應鏈上。這會成為一次實戰測試:針對領域嘅模型、最佳化工具及受管治營運資料,究竟能否改善大型工業規劃環境中嘅關鍵決策。
11
1