中國於 2026 年 7 月 17 日公布首批 AI 終端測試結果,11 款行動裝置達到 L3,包括 9 款手機與 2 款平板。 L3 是目前已有明確測試要求的最高等級,但不是整個品牌的評級,也不是手機上市所必需的強制性監管認證。 L3 的核心是「受監督的任務委派」:手機能理解目標、拆解工作、串聯工具並運用記憶,但涉及付款、敏感資料或不可逆操作時,仍應交回使用者確認。
研究答案

Create a landscape editorial hero image for this Studio Global article: What is China’s MIIT national AI-terminal intelligence grading standard, what does the first July 2026 batch of 11 certified devices—includi. Article summary: China’s AI-terminal grading system is a voluntary capability benchmark, not a phone-approval regime. The July 2026 L3 results show that some specific devices can act as bounded, user-supervised agents—not that they are a. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
中國的 L3 AI 手機分級,最容易被誤解成「手機版自動駕駛等級」。更準確的理解是:它是一套評估完整 AI 終端能力的基準,衡量特定手機配置能否在使用者監督下,協助完成較複雜的跨步驟任務,而不是宣告裝置可以在所有情境中自行做決定。2026 年 7 月 17 日公布的首批結果,列出 11 款達到 L3 的行動終端,包括 9 款手機與 2 款平板。2
5
這套框架稱為 GB/Z 177—2026《人工智能終端智能化分級》。其中「GB/Z」代表國家標準化指導性技術文件,因此它主要提供一套共同的能力評估方法,而不是手機銷售前必須取得的強制性市場准入證明。1
5
6
評估對象也不是單一語言模型,而是整部裝置及其軟硬體系統,包括模型、作業系統、應用程式與工具介面、記憶機制、權限管理,以及裝置端與雲端之間如何分工。5
19
標準把終端智能化拆成五個核心面向:
五大面向之下再細分為 14 項子能力,當中包括使用者感知、任務規劃、工具呼叫、短期與長期記憶,以及情境適應等。19
四個等級代表終端從回應明確指令,逐步走向理解目標、安排工作與協調不同系統。目前 L1 至 L3 已有較明確的能力要求;L4 雖然已被列入框架,但詳細規範與測試方法仍待完善。5
21
25
| 等級 | 實際上代表什麼 |
|---|---|
| L1・回應級 | 理解清楚、直接的指令,完成通常只有一步的操作,例如開啟功能或設定提醒。 |
| L2・工具級 | 理解較簡單的意圖,進行有限推理,並透過預設工具或固定流程完成受限制的多步任務。它更像功能較完整的聊天機器人或應用程式內助理。 |
| L3・輔助級 | 理解較完整的目標,在資訊不足時主動追問,把工作拆成步驟,動態選擇並編排工具,支援多模態互動,並運用短期及長期記憶。 |
| L4・協同級 | 目標是讓不同 AI 智能體、裝置與服務互相協作,但詳細能力要求及測試方式仍在制定中。 |
因此,L3 的重點不是手機「像人一樣思考」,而是能否把理解、規劃、工具使用、記憶與執行串成一個較完整的任務流程。5
19
7 月公布的行動終端結果涵蓋華為、Motorola、榮耀、vivo、OPPO、小米與階躍星辰等品牌,共有 9 款手機及 2 款平板達到 L3。2
3
5
這個結果最嚴謹的解讀是:送測的特定產品及其軟體、硬體配置,符合目前 L3 測試要求。
它並不代表:
首批結果來自廠商主動提交的產品,而不是對市面手機進行隨機抽樣。因此,L3 是「產品與配置」層級的評級,不是品牌整體的智能排名。5
6
把這次結果簡化稱為「中國國家 L3 認證」,容易讓人誤會其法律效力。由於 GB/Z 177—2026 屬於指導性技術文件,L3 並不是手機上市前必須取得的監管許可,也不是沒有它就不能銷售的准入門檻。它更接近供產業共同使用的能力標尺與評估基準。1
6
同時,L3 也不等於裝置取得了無限制的自主權。標準評估的是終端在指定條件下能否提供複雜協助,不代表手機可以任意存取個人資料、帳戶、付款功能或所有第三方應用程式。涉及高風險或不可逆操作時,使用者仍是控制流程的一部分。5
19
一部 L2 手機可能可以回答「杭州今日天氣如何」、搜尋資料,或按照預設流程產生旅遊建議。但任務通常停留在單一對話或受限的工具路徑內,記憶也主要集中於當前使用情境。5
19
L3 手機則是嘗試理解請求背後的完整目標。以「幫我規劃一趟週末杭州之旅」為例,它可以:
最後一點正是 L3 的邊界:它是受監督的任務委派,不是無限制的代理權。 AI 可以替你準備付款或訂房,但涉及金錢、敏感資料或不可撤回承諾時,最終決定權應回到使用者手上。5
L4 的難題不只是模型能力再提升一級,而是不同智能體、裝置與服務之間如何安全協作。要建立可重複、可驗證的 L4 測試,至少要先回答幾個問題:
在這些關係尚未被整理成穩定、安全而且可重複測試的情境前,L4 很難真正成為可執行的認證等級。5
7
這也意味著,AI 手機下一個重要進展,未必只是更快的晶片或更大的模型;跨裝置互通、權限管理、同意機制與責任歸屬,同樣可能成為關鍵。5
手機與汽車都使用 L1 至 L4 的標籤,並不代表兩套分級可以互相比照。汽車自動駕駛分級主要關注動態駕駛任務由誰負責、誰需要監控車輛,以及何時必須由人類接管。AI 終端分級則評估感知、意圖理解、推理、工具使用、記憶與學習等能力。5
所以,L3 手機不是「有條件自動駕駛汽車」的手機版本;即使未來手機達到 L4,也不代表它可以在所有涉及金錢、個資或其他重大後果的情境下,完全不經人類確認便安全行動。5
華為 Pura X Max,以及聯想旗下 Motorola 系列的相關裝置,都是首批 L3 結果中的代表例子。2
5但購機時,不應只看機身上的 L3 標籤。
手機實際能否完成某項智能體任務,還可能取決於作業系統更新、助理與模型是否開放、應用程式整合、權限設定,以及雲端連線狀況。換句話說,實用的 L3 式功能不一定要靠購買新手機才能獲得;新硬體或許能改善速度、隱私或電池表現,但不代表換機是唯一途徑。5
反過來說,擁有 L3 評級型號,也不代表每一項宣傳功能都能在所有應用程式、服務、地區、帳戶或付款流程中穩定運作。評級針對的是送測配置及已測試能力,不是對現實世界所有服務的通用互通性保證。5
在把 L3 當成購買理由之前,可以先確認:
首批結果最值得注意的地方,是 AI 手機開始從「會聊天」走向可以量化評估的任務型系統。但 L3 仍然只是針對特定配置的受監督輔助基準:它不是全面自主行為的保證,不是強制上市認證,也不是終端智能化的終點。1
5
7
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
中國於 2026 年 7 月 17 日公布首批 AI 終端測試結果,11 款行動裝置達到 L3,包括 9 款手機與 2 款平板。
中國於 2026 年 7 月 17 日公布首批 AI 終端測試結果,11 款行動裝置達到 L3,包括 9 款手機與 2 款平板。 L3 是目前已有明確測試要求的最高等級,但不是整個品牌的評級,也不是手機上市所必需的強制性監管認證。
L3 的核心是「受監督的任務委派」:手機能理解目標、拆解工作、串聯工具並運用記憶,但涉及付款、敏感資料或不可逆操作時,仍應交回使用者確認。