Qwen3.7 Plus là mô hình AI 'đại diện thông minh' (AI agent) đa phương thức, tích hợp khả năng xử lý hình ảnh (thị giác) và văn bản (ngôn ngữ) trên nền tảng Qwen3.7, được Alibaba công bố ngày 02/06/2026. Điểm nhấn cốt lõi là khả năng 'hỗn hợp tương tác': đọc ảnh chụp màn hình, tự động hóa thao tác trên giao diện ngườ...

Create a landscape editorial hero image for this Studio Global article: What is Alibaba's Qwen3.7-Plus multimodal AI model, what are its key features and capabilities, how does it compare to the Qwen3.7-Max varia. Article summary: ## What is Qwen3.7-Plus?. Topic tags: general, documentation, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Qwen 3.7 vs Qwen 3.6: What Actually Exists and What to Use in Production. Qwen 3.7-Max launched May 19, 2026 as a proprietary API-only model from Alibaba. Qwen 3.6 remains the op" source context "Qwen 3.7 vs Qwen 3.6: What Actually Exists and What to Use in ..." Reference image 2: visual subject "The company claims the model demonstrates performance comparable to GPT-5.2-Thinking, Claude-Opus-4.5, and Gemini 3 Pro." source context "Alibaba’s Qwen3-Max-Thinking expands enterprise AI model
Vào ngày 02 tháng 06 năm 2026, đội ngũ Qwen của tập đoàn Alibaba đã chính thức trình làng một 'siêu AI' mới mang tên Qwen3.7-Plus, đánh dấu một bước tiến lớn trong cuộc đua trí tuệ nhân tạo toàn cầu. Đây không chỉ là một bản nâng cấp thông thường, mà là một mô hình nền tảng (foundation model) hoàn toàn mới, lần đầu tiên hợp nhất hoàn hảo khả năng thị giác (vision) và ngôn ngữ (language) vào một thực thể thông minh duy nhất .
Điểm đột phá lớn nhất của Qwen3.7-Plus nằm ở tư duy 'đại diện thông minh' (AI agent). Mô hình này không chỉ hiểu văn bản, mà còn có thể 'nhìn' và hiểu hình ảnh, video, và đặc biệt là ảnh chụp màn hình các giao diện người dùng (GUI). Nhờ đó, AI có thể tự mình thao tác trên trình duyệt web hay các ứng dụng máy tính giống hệt như con người. Nó cũng sở hữu một bộ nhớ ngữ cảnh khổng lồ lên đến 1 triệu token, cho phép xử lý các tác vụ cực kỳ phức tạp và kéo dài .
Qwen3.7-Plus được xây dựng trên nền tảng sức mạnh văn bản của Qwen3.7, nhưng đã được nâng cấp toàn diện với năm khả năng cốt lõi của một 'nhân viên AI' thực thụ :
Mô hình này đã sẵn sàng phục vụ qua nền tảng Alibaba Cloud Model Studio (Bách Luyện), cung cấp API cho các nhà phát triển .
Để hiểu rõ vị trí của Qwen3.7-Plus, cần so sánh nó với 'người anh em' Qwen3.7-Max, vốn được phát hành trước đó. Cả hai đều mạnh, nhưng phục vụ những mục đích khác nhau.
Kết luận: Nếu bạn cần một 'lập trình viên siêu hạng' cho các bài toán hóc búa, Qwen3.7-Max là lựa chọn hàng đầu. Nhưng nếu bạn cần một 'trợ lý AI toàn năng' có thể vừa nhìn, vừa hiểu và vừa thao tác trên thế giới số như một con người, với chi phí tiết kiệm hơn, thì Qwen3.7-Plus chính là câu trả lời .
Trước khi ra mắt chính thức, các phiên bản xem trước (Preview) của cả hai mô hình đã được đưa lên đấu trường AI nổi tiếng thế giới, Arena AI (trước đây là LMArena), vào tháng 5 năm 2026 và đạt được những kết quả đầy hứa hẹn:
Phản ứng của thị trường dành cho Qwen3.7-Plus là vô cùng tích cực và tức thì. Ngay sau thông báo trên mạng xã hội X và việc mô hình xuất hiện trên nền tảng Alibaba Cloud Model Studio, giá cổ phiếu của 'gã khổng lồ' công nghệ Trung Quốc đã tăng vọt :
Sự kiện này một lần nữa khẳng định vị thế dẫn đầu trong lĩnh vực AI của Alibaba và cho thấy kỳ vọng rất lớn của giới đầu tư vào chiến lược phát triển trí tuệ nhân tạo của tập đoàn này.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Qwen3.7 Plus là mô hình AI 'đại diện thông minh' (AI agent) đa phương thức, tích hợp khả năng xử lý hình ảnh (thị giác) và văn bản (ngôn ngữ) trên nền tảng Qwen3.7, được Alibaba công bố ngày 02/06/2026.
Qwen3.7 Plus là mô hình AI 'đại diện thông minh' (AI agent) đa phương thức, tích hợp khả năng xử lý hình ảnh (thị giác) và văn bản (ngôn ngữ) trên nền tảng Qwen3.7, được Alibaba công bố ngày 02/06/2026. Điểm nhấn cốt lõi là khả năng 'hỗn hợp tương tác': đọc ảnh chụp màn hình, tự động hóa thao tác trên giao diện người dùng (GUI), tự viết và sửa lỗi code, gọi công cụ bên ngoài và tự kiểm chứng kết quả mà không cần con...
Mô hình này đã chứng minh sức mạnh bằng việc độc lập phát triển hoàn chỉnh một ứng dụng thực tế chỉ trong 11 giờ, tạo ra hơn 10,000 dòng code.