今次發布的一個重點是 agentic coding(編程智能體能力)。
阿里表示,Qwen3.7‑Max 可以由需求分析開始,一路完成多步驟工程任務,例如:
在多個編程代理測試中,模型亦取得不錯成績。例如在 SWE‑Pro、SWE‑Multilingual 等測試中表現領先,而 Terminal Bench 2.0‑Terminus 得分為 69.7。
模型亦支援多種智能體工作流程,例如:
這些能力反映 AI 發展正逐步由「聊天助手」轉向 能夠與人協作工作的智能代理系統。
另一個被強調的能力是 長時間自主運作(long‑horizon autonomy)。
在峰會展示的一個測試中,Qwen3.7‑Max 在幾乎沒有人工干預的情況下,連續運行約 35 小時,期間進行了 超過 1000 次工具調用,仍然保持一致推理流程。
在這個實驗中,模型甚至在一個新的晶片平台上 自動優化 AI 推理核心(inference kernel),最後令推理速度比原始版本 提升約 10 倍。
阿里認為,這類能夠執行 數百至數千步連續任務 的 AI,將會是未來企業自動化與軟件工程的重要形態。
中國媒體引用第三方 Arena 全球模型盲測排行榜 指出,Qwen3.7‑Max 在榜單中 位列中國本土模型第一,整體表現接近 OpenAI、Anthropic 與 Google 的頂級模型。
不過這些結果主要來自公開報告與媒體引用,實際性能仍需更多獨立測試驗證。
除了模型本身,阿里亦公布新的 AI 硬件與基建:
真武 M890 AI 晶片 由阿里半導體公司 平頭哥(T‑Head) 研發。
公開資訊顯示:
這套基建將透過 阿里雲百煉平台 向企業客戶提供,用於大模型訓練與推理服務。
阿里雲高級副總裁 劉偉光 在峰會上形容,AI 發展正逐漸像工業生產——由 「訓練工廠」與「推理工廠」 產生價值。
他的說法是:阿里正在打造 「中國的 AI 工廠」。
根據公司描述,這個 AI 技術體系包含五層:
透過控制整條技術鏈,阿里希望成為中國少數能夠提供 完整 AI 基礎設施(full‑stack AI) 的科技公司之一。
Qwen3.7‑Max 不只是一個新模型版本。它代表 AI 產業正在由單純聊天模型,走向 能長時間自主運作、處理複雜任務的智能體系統。
對阿里而言,這個模型只是整個戰略中的 軟件核心。配合自研晶片、超大規模雲算力、模型平台與應用生態,阿里正嘗試建立一個 端到端 AI 產業平台。
如果這個模式成功,阿里可能會成為全球少數同時掌握 晶片、雲、模型與應用 的 AI 技術供應商之一,在「智能體計算時代」的競爭中佔據重要位置。