نموذج وكيلي موحد: يدمج Qwen3.7 Plus الرؤية واللغة في عقل ذكي واحد، مطوراً قدرات Qwen3.7 النصية بإضافات بصرية شاملة [1][2][3]. عيون رقمية متقدمة: يفهم الصور والفيديو ولقطات الشاشة، ويستطيع قراءة واجهات المستخدم والتنقل خلالها [4][8].

Create a landscape editorial hero image for this Studio Global article: What is Alibaba's Qwen3.7-Plus multimodal AI model, what are its key features and capabilities, how does it compare to the Qwen3.7-Max varia. Article summary: ## What is Qwen3.7-Plus?. Topic tags: general, documentation, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Qwen 3.7 vs Qwen 3.6: What Actually Exists and What to Use in Production. Qwen 3.7-Max launched May 19, 2026 as a proprietary API-only model from Alibaba. Qwen 3.6 remains the op" source context "Qwen 3.7 vs Qwen 3.6: What Actually Exists and What to Use in ..." Reference image 2: visual subject "The company claims the model demonstrates performance comparable to GPT-5.2-Thinking, Claude-Opus-4.5, and Gemini 3 Pro." source context "Alibaba’s Qwen3-Max-Thinking expands enterprise AI model
تخيل مساعداً ذكياً لا يكتفي بفهم كلماتك، بل "يرى" شاشتك، يفهم الصور المعقدة، ويبحر في واجهات سطح المكتب بنفسه. هذا هو بالضبط ما قدمته علي بابا في 2 يونيو 2026 مع إطلاقها لنموذج Qwen3.7-Plus. إنه ليس مجرد نموذج جديد، بل هو عامل ذكي متعدد الوسائط (Multimodal Agent) يدمج بين الرؤية واللغة في عقل واحد .
بُني هذا النموذج على الأساس النصي القوي لـ Qwen3.7، لكن مع ترقية شاملة لقدرات "الرؤية-اللغة"، مما يجعله يفهم الصور ومقاطع الفيديو إلى جانب النصوص (أي أنه للفهم البصري وليس للتوليد البصري)، مع نافذة سياق ضخمة تصل إلى مليون رمز (Token) .
ما يجعل Qwen3.7-Plus فريداً هو قدرته على إغلاق الحلقة بشكل ذاتي. فهو لا يفهم فقط ما يراه، بل يمكنه :
باختصار، النموذج ليس مجرد شات بوت، بل "مهندس برمجيات" يمكنه العمل على مشاريع برمجية معقدة بشكل شبه مستقل.
أطلقت علي بابا نموذجين معاً: Qwen3.7-Max الرائد في النصوص، و Qwen3.7-Plus الذي يضيف الرؤية. إليك الفروقات الجوهرية:
الخلاصة: Max هو بطل السباقات النصية والبرمجية المعقدة. أما Plus فهو الخيار الأذكى والأرخص لمن يحتاج أن "يرى" نموذجه العالم الرقمي ويتفاعل معه بشكل بصري .
دخلت النسخ التجريبية من النموذجين Arena AI (المعروفة سابقاً بـ LMArena) في مايو 2026 لتثبت وجودها سريعاً:
لم يمر إعلان النموذج مرور الكرام على المستثمرين، الذين رأوا فيه دليلاً جديداً على تقدم علي بابا في سباق الذكاء الاصطناعي :
أكدت السوق برسالة واضحة أن سباق الذكاء الاصطناعي هو الآن المحرك الأكبر لقيمة شركات التكنولوجيا الصينية العملاقة .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
نموذج وكيلي موحد: يدمج Qwen3.7 Plus الرؤية واللغة في عقل ذكي واحد، مطوراً قدرات Qwen3.7 النصية بإضافات بصرية شاملة [1][2][3].
نموذج وكيلي موحد: يدمج Qwen3.7 Plus الرؤية واللغة في عقل ذكي واحد، مطوراً قدرات Qwen3.7 النصية بإضافات بصرية شاملة [1][2][3]. عيون رقمية متقدمة: يفهم الصور والفيديو ولقطات الشاشة، ويستطيع قراءة واجهات المستخدم والتنقل خلالها [4][8].
مهندس برمجيات ذاتي: يمتلك قدرات تفكير عميق، برمجة ذاتية، استدعاء أدوات، واختبار وتكرار مستقل، حيث طوّر تطبيقاً كاملاً في 11 ساعة [4][5].