Perplexity AI 喺 Computex 2026 宣布推出全新嘅混合推理編排器,佢會即時評估每個 AI 子任務,自動決定係留喺你部機上面處理以保障私隱,定係發送去雲端用更強大嘅模型。 呢個系統標榜唔受晶片限制(chip agnostic),雖然首發會獨家喺 Intel Core Ultra Series 3 嘅筆電上面登場。呢項技術亦係業界大趨勢嘅一部份,就係將 AI 工作負載由集中嘅數據中心,分散到邊緣裝置,以應付日益高漲嘅推理成本同用電需求。

Create a landscape editorial hero image for this Studio Global article: What is Perplexity AI's new "hybrid local/server agentic inference orchestrator" announced at Computex 2026, how does it dynamically split A. Article summary: Here is the full picture based on the announcements from Computex 2026.. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Perplexity’s new Computer is another bet that users need many AI models. The tool is available now, only on the company’s highest subscription tier, the $200/month Perplexity Max" source context "Perplexity's new Computer is another bet that users need many AI ..." Reference image 2: visual subject "# Perplexity AI unveils hybrid local-cloud inference system at Computex 2026. Perplexity AI, the fast-growing search startup now valued at $20 billion, unveiled
喺 Computex 2026 嘅舞台上,Perplexity 嘅 CEO Aravind Srinivas 同 Intel 嘅 CEO 陳立武 (Lip-Bu Tan) 聯手示範咗一個 AI 運作嘅全新玩法:一個「混合本機/伺服器代理推理編排器」。以後大家唔使再喺「功能有限嘅本機 AI」同「勁但係無私隱嘅雲端 AI」之間做痛苦抉擇。呢層新嘅軟件會自動幫你「解構」複雜嘅任務,將敏感嘅部份鎖死喺你部機上面,然後將需要龐大運算力嘅部份掟上雲端處理。最終,佢會將兩邊嘅結果無縫整合,變成一個完整嘅輸出。根據早期嘅生態系統分析,咁樣做可以慳返 30% 至 50% 嘅推理成本 。
Perplexity 將呢個編排器比喻為 AI 任務嘅「空管系統」,呢個比喻真係好貼切 。當你叫個系統分析一份機密嘅投資交易文件時,佢唔會盲目咁將你所有數據送上雲端。
成個過程分成四個步驟:
呢個唔係一個單純根據檔案大細或者任務類型嚟做決定嘅系統。正如 Srinivas 所講,呢個編排器係會「實時『思考』邊啲工作應該喺你嘅裝置上面行,邊啲工作應該交畀雲端嘅代理」。
喺 Computex 嘅發布入面,有幾個重點功能令到呢個編排器好適合企業使用:
天生唔受晶片限制 (Chip-Agnostic)
雖然台上嘅示範係用咗 Intel 嘅硬件,但 Perplexity 好小心咁強調,呢個編排器係唔會鎖死喺 Intel 嘅生態系統入面。喺主題演講之後嘅訪問,CEO Aravind Srinivas 明確咁話呢個平台係「唔受晶片限制嘅」(chip agnostic),設計上可以喺唔同廠商嘅晶片上面運作 。佢最先喺 Intel 平台嘅 Windows PC 上面推出,只係一個合作里程碑,並唔係永久嘅封鎖
。
大規模多模型協作
呢個編排器係喺 Perplexity 嘅「Computer」AI 作業系統入面運作,呢個系統可以同時協調多達 20 個唔同嘅 AI 模型。對於任何一個子任務,系統都會根據模型嘅能力、速度同成本,揀選最合適嘅模型——確保你唔會殺雞用牛刀 。
真正嘅私隱防火牆
對於金融、醫療呢類受嚴格規管嘅行業嚟講,機密數據唔可以掂到第三方嘅雲端伺服器係無得傾嘅條件。呢個編排器就扮演住私隱把關者嘅角色,確保同合規相關嘅文件會喺本機分析完,先至將啲唔敏感嘅內容送去雲端做進一步處理 。
顯著嘅成本縮減
吓吓都將企業嘅 AI 查詢送去雲端嘅最強模型,成本已經開始貴到唔合理。透過將簡單或者涉及私隱嘅任務,聰明咁卸載畀本機嘅 NPU 處理,呢種混合模式估計可以將推理成本削減 30% 到 50% 。
喺 Computex 嘅現場示範度,佢哋用咗一部搭載 Intel 新 Core Ultra Series 3 處理器嘅筆電,呢粒 U 係用咗佢哋最先進嘅 18A 製程 。示範展示咗一個私募基金分析員點樣載入一個代號叫「Project Falcon」嘅機密項目——入面包含咗保密協議 (NDA)、財務模型同機密會議記錄——然後由本機嘅 Intel 晶片處理敏感文件嘅分析,同時間雲端代理就喺度搜集外部市場研究,全程都無曝露過任何私隱數據
。
Intel 將今次合作定位為一個有力嘅證明,話畀大家知喺裝置上面做推理已經唔係得個樣。Core Ultra Series 3 嘅整合式 GPU 同 NPU 已經有能力處理一啲以前一定要喺數據中心先做到嘅 AI 工作,實現咗一種真正嘅分工,可以「將每瓦特嘅 token 價值最大化」。喺推出初期,呢個混合推理功能會係 Perplexity 喺 Intel 平台 Windows PC 上面嘅 App 獨家提供,但係個編排器底層嘅架構設計係將來可以支援更加廣泛嘅硬件
。
Perplexity 同 Intel 嘅示範並唔係一個單一嘅實驗——佢係成個 Computex 2026 嘅旗艦級發布,揭示咗一個主導性嘅主題:AI 工作負載開始由雲端移向邊緣裝置。
Intel 用咗成個 Computex 嘅主題演講嚟強調呢個分布式運算嘅未來,宣布同 SambaNova、Vista Equity 同 Cambium 建立互補合作關係,提供高成本效益嘅推理方案,並且將混合式運算定位為即將來臨嘅「代理式 AI」時代嘅基礎架構 。
當中嘅訊息好清晰:數據中心唔會消失,但佢已經唔再係智能運算嘅唯一地方。喺 Perplexity 同 Intel 押注嘅混合模式之下,AI 嘅未來係你嘅裝置同雲端之間嘅一場對話——一場自動、智能,而且保障私隱嘅對話。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Perplexity AI 喺 Computex 2026 宣布推出全新嘅混合推理編排器,佢會即時評估每個 AI 子任務,自動決定係留喺你部機上面處理以保障私隱,定係發送去雲端用更強大嘅模型。
Perplexity AI 喺 Computex 2026 宣布推出全新嘅混合推理編排器,佢會即時評估每個 AI 子任務,自動決定係留喺你部機上面處理以保障私隱,定係發送去雲端用更強大嘅模型。 呢個系統標榜唔受晶片限制(chip agnostic),雖然首發會獨家喺 Intel Core Ultra Series 3 嘅筆電上面登場。呢項技術亦係業界大趨勢嘅一部份,就係將 AI 工作負載由集中嘅數據中心,分散到邊緣裝置,以應付日益高漲嘅推理成本同用電需求。