| النموذج | إجمالي المعلمات | المعلمات النشطة | نافذة السياق | أقصى إخراج |
|---|---|---|---|---|
| V4-Pro | 1.6 تريليون (MoE) | ~49B لكل رمز | 1 مليون رمز | 384 ألف رمز |
| V4-Flash | 284 مليار (MoE) | ~13B لكل رمز | 1 مليون رمز | 384 ألف رمز |
كلا النموذجين متعدد الوسائط (نص، صورة، فيديو)، ويدعمان إخراج JSON واستدعاء الأدوات، وهما متاحان عبر API والويب .
| النموذج | الإدخال (خارج الذروة) | الإخراج (خارج الذروة) | إصابة ذاكرة التخزين المؤقت |
|---|---|---|---|
| V4-Pro | 0.435 دولار | 0.87 دولار | خصم 90% |
| V4-Flash | 0.14 دولار | 0.28 دولار | خصم 90% |
كما أجرت DeepSeek عرضًا ترويجيًا بخصم 75% على V4-Pro حتى أوائل مايو 2026 . للمقارنة، يبلغ سعر إخراج GPT-5.5 حوالي 30 دولارًا/ مليون رمز، مما يجعل V4-Flash أرخص بحوالي 107 مرات على الإخراج .
تروي نتائج DeepSeek V4 القياسية قصة دقيقة:
تحذير مهم من تقييم NIST CAISI (مايو 2026): تدعي معايير DeepSeek المبلغ عنها ذاتيًا التكافؤ مع GPT-5.4 و Opus 4.6، لكن تقييم CAISI المستقل وجد V4 "أقل قدرة بشكل كبير" على المعايير غير العامة، مما يشير إلى أن بعض الدرجات المبلغ عنها ذاتيًا قد تكون مضخمة . يصنف مؤشر الذكاء من Artificial Analysis GPT-5.5 (عالٍ) عند 53 مقابل DeepSeek V4 Pro (Reasoning, High Effort) عند 41* - GPT-5.5 أكثر ذكاءً وأسرع (69 مقابل 56 رمزًا/ثانية)، لكن DeepSeek أرخص بشكل كبير (0.18 دولار مقابل 4.35 دولار/ مليون رمز في وضع التفكير) .
استعرض فريق Qwen من Alibaba نموذج Qwen 3.8 Max في المؤتمر العالمي للذكاء الاصطناعي في شنغهاي في 19 يوليو 2026 . إنه أول نموذج رئيسي للفريق يتجاوز تريليون معلمة.
| السمة | التفاصيل |
|---|---|
| إجمالي المعلمات | 2.4 تريليون (MoE متفرق) |
| الهندسة المعمارية | Mixture-of-Experts، متعدد الوسائط (نص + رؤية مؤكدة) |
| نافذة السياق | 983,616 رمزًا لكل نقطة نهاية Qwen Cloud ؛ تكررت كـ ~1 مليون في بعض المصادر |
| أقصى إخراج | 64,000 رمز |
| الترخيص | لم يُنشر بعد؛ تقول Alibaba أنها ستجعل الأوزان مفتوحة "قريبًا" |
لم يُنشر أي تسعير للدفع حسب الاستخدام. الوصول حاليًا عبر الاشتراك من خلال Qwen Chat وشركاء API محددين. يسرد BenchLM تسعير معاينة Qwen 3.8 Max Preview على أنه "غير مُدرج" . تظهر بعض أدوات التتبع الخارجية تسعيرًا آليًا عند 1.50 دولار/ 5.00 دولار لكل مليون رمز إدخال/ إخراج، لكن هذا غير مؤكد من قبل Alibaba .
تذكر Alibaba أن Qwen 3.8 هو "الثاني بعد Fable 5" (نموذج Claude الأفضل من Anthropic)، مما يضعه أمام GPT-5.5 و DeepSeek V4 في تصنيف Alibaba الخاص . تُدعى المكاسب في البرمجة والإنتاجية المهنية وتطوير المكدس الكامل وتحليل البيانات وسير العمل المكتبي مقارنة بـ Qwen 3.7 Max .
ومع ذلك، لم يتم نشر أي معايير مستقلة. يتتبع BenchLM، وهو موقع تتبع المعايير، 321 معيارًا لـ Qwen 3.8 Max Preview مع 0 نتيجة تم التحقق منها حتى 20 يوليو 2026 . كما قالت أحد التحليلات، "Qwen 3.8 يستحق الاختبار، لكن من السابق لأوانه اعتباره بديل إنتاج مستقر لـ Kimi K3 أو GPT-5.6 Sol أو Claude Fable 5" .
للحصول على سياق، سبقت نماذج Qwen السابقة أساسًا قويًا: كان Qwen 3.6-Max-Preview (20 أبريل 2026) نموذجًا نصيًا فقط بـ 35B إجمالي / 3B معلمات نشطة ونافذة سياق 262 ألفًا، وادعى المركز الأول في ستة معايير برمجة وعمل وكيل . توسع Qwen 3.7-Max (مايو 2026) إلى نافذة سياق مليون رمز مع قدرات وكيل التفكير . لكن لم يُعتبر أي منهما على المستوى الحدودي خارج نطاق البرمجة الوكيلة.
تضع Alibaba Qwen 3.8 صراحةً باعتباره "الثاني بعد Fable 5" . إذا صمد هذا الادعاء في ظل التقييم المستقل، فسيضع Qwen 3.8 أمام GPT-5.5 ومتقدمًا بفارق كبير على DeepSeek V4. لكن مع عدم وجود معايير تم التحقق منها، يظل هذا ادعاءً تسويقيًا، وليس حقيقة ثابتة. يبدو أن Fable 5 من Anthropic هو القائد الحدودي المعترف به حاليًا وفقًا لتصنيف Alibaba الخاص .
دفعت تسعيرة DeepSeek العدوانية إلى سباق نحو القاع في تكاليف API. V4-Flash بسعر 0.14 دولار/ مليون إدخال أرخص بشكل جذري من أي نموذج حدودي غربي. لم تحدد Alibaba بعد سعر Qwen 3.8، لكن Qwen 3.6 كان مسعرًا بالفعل بشكل عدواني (~1.25 دولار/ 7.50 دولار إدخال/ إخراج) .
ترخيص MIT مفتوح الأوزان لـ DeepSeek V4 يعني أن الاستضافة الذاتية ممكنة أيضًا، مما يزيد من الضغط على هوامش مزودي الخدمات مغلقي المصدر . كما قال أحد التحليلات، فإن التأثير العملي هو أن "المطورين يمكنهم الآن الوصول إلى قدرة شبه حدية (في مهام البرمجة) بجزء بسيط من تكلفة GPT-5.5 أو Claude."