Qwen3.7 Plus係阿里巴巴通義千問團隊喺2026年6月2日推出嘅多模態AI智能體模型,將視覺同語言整合成一個統一嘅智能基礎 [1][2][3]。 核心賣點係「有眼睇」:可以理解圖像、影片、截圖內容,讀取GUI介面,仲可以自動操作瀏覽器同桌面應用程式 [4][8]。

Create a landscape editorial hero image for this Studio Global article: What is Alibaba's Qwen3.7-Plus multimodal AI model, what are its key features and capabilities, how does it compare to the Qwen3.7-Max varia. Article summary: ## What is Qwen3.7-Plus?. Topic tags: general, documentation, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Qwen 3.7 vs Qwen 3.6: What Actually Exists and What to Use in Production. Qwen 3.7-Max launched May 19, 2026 as a proprietary API-only model from Alibaba. Qwen 3.6 remains the op" source context "Qwen 3.7 vs Qwen 3.6: What Actually Exists and What to Use in ..." Reference image 2: visual subject "The company claims the model demonstrates performance comparable to GPT-5.2-Thinking, Claude-Opus-4.5, and Gemini 3 Pro." source context "Alibaba’s Qwen3-Max-Thinking expands enterprise AI model
阿里巴巴旗下嘅AI研究團隊「通義千問」(Qwen),喺2026年6月2日凌晨正式推出咗一款叫 Qwen3.7-Plus 嘅多模態AI模型。呢個新模型一推出,唔單止令科技界眼前一亮,仲令阿里嘅股價即刻彈起,究竟佢有咩咁巴閉?等我哋逐一拆解。
Qwen3.7-Plus係一個多模態智能體模型(Multimodal Agent Model)。簡單嚟講,即係佢唔單止識處理文字,仲有視覺能力——可以「睇」圖像、影片、截圖,理解畫面入面嘅內容
。
佢嘅定位係「視覺同語言統一嘅智能體基座」,建基於Qwen3.7本身嘅文字處理能力之上,再全面升級視覺語言功能 。佢支援100萬token嘅上下文窗口,即係可以一次過處理海量資訊
。
Qwen3.7-Plus賣點唔單止係多模態,而係一個真正嘅「智能體」(Agent),具備以下五大能力 :
可以讀取截圖、理解GUI圖形介面,仲可以操控瀏覽器同桌面應用程式。例如你畀個網頁截圖頁截圖佢,佢可以明白個掣喺邊、個欄位要入咩資料 。
對圖像同文字都可以做多步驟邏輯推理,唔係死記硬背,而係真係「諗嘢」 。
識自己寫Code、自己Debug、自己執行,唔使人手干預 。
執行任務期間,可以自己Call外部API同工具,例如駁去數據庫、搜尋引擎咁 。
做完嘢會自己檢查答案,有錯會自己改,不斷迭代直到結果正確。官方示範入面,佢用咗11個鐘頭,自己由頭到尾開發咗一個完整嘅真實App,寫咗超過一萬行程式碼 。
呢個模型目前已經喺阿里雲百煉平台(Model Studio)上線,開發者可以經API呼叫使用 。
阿里巴巴同時推出咗兩個版本嘅Qwen3.7預覽模型:Qwen3.7-Max 同 Qwen3.7-Plus。好多人未必分得清楚佢哋嘅分別,以下幫你用個表清楚對比:
簡而言之:Max係純文字旗艦,專攻編程同複雜推理;Plus就係喺Max嘅文字基礎上面加咗「對眼」,仲要平好多。如果你嘅任務需要睇圖、操作GUI、理解影片,就一定係揀Plus 。
Qwen3.7系列嘅預覽版喺2026年5月進入LM Arena(前稱LMArena)嘅擂台比拼,成績幾亮眼:
雖然Plus嘅獨立跑分數據仲未完全公開(因為仲係預覽階段),但初步成績已經顯示佢喺多模態領域有一定競爭力。
消息觸發點係通義千問喺X(前稱Twitter)上公布新模型,以及隨即喺阿里雲百煉平台上線 。市場普遍認為,Qwen3.7-Plus展示嘅多模態智能體能力(特別係GUI操作同自動編程),進一步鞏固咗阿里巴巴喺AI領域嘅競爭力,亦令投資者對其雲業務同AI商業化前景更有信心。
Qwen3.7-Plus嘅定位好清晰:佢唔係要取代Max做純文字霸主,而係開拓一條新賽道——將AI智能體由純文字延伸至視覺互動領域。呢個模型可以「睇住你個螢幕做嘢」,對於自動化辦公流程、軟件測試、GUI操作等企業場景有直接應用價值。
相比其他多模態模型,Qwen3.7-Plus嘅定價策略亦相當進取,輸入成本只係Max嘅七分之一左右,對於需要大量調用視覺理解功能嘅開發者嚟講,性價比好高 。
隨住AI智能體(Agentic AI)成為下一個戰場,阿里巴巴呢步棋明顯係想搶佔「視覺型智能體」嘅市場先機。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Qwen3.7 Plus係阿里巴巴通義千問團隊喺2026年6月2日推出嘅多模態AI智能體模型,將視覺同語言整合成一個統一嘅智能基礎 [1][2][3]。
Qwen3.7 Plus係阿里巴巴通義千問團隊喺2026年6月2日推出嘅多模態AI智能體模型,將視覺同語言整合成一個統一嘅智能基礎 [1][2][3]。 核心賣點係「有眼睇」:可以理解圖像、影片、截圖內容,讀取GUI介面,仲可以自動操作瀏覽器同桌面應用程式 [4][8]。
具備深度推理、自我編程、工具調用、自我驗證同自動迭代五大能力,示範中仲用11個鐘自己搞掂一個完整App開發 [4][5][7]。