| वेरिएंट | इनपुट (ऑफ-पीक) | आउटपुट (ऑफ-पीक) | कैश हिट |
|---|---|---|---|
| V4-Pro | $0.435 | $0.87 | 90% छूट |
| V4-Flash | $0.14 | $0.28 | 90% छूट |
DeepSeek ने मई 2026 की शुरुआत तक V4-Pro पर 75% छूट का प्रचार भी चलाया । तुलना के लिए, GPT-5.5 आउटपुट मूल्य लगभग $30/MTok है, जिससे V4-Flash आउटपुट पर लगभग 107 गुना सस्ता हो जाता है
।
DeepSeek V4 के बेंचमार्क परिणाम एक बारीक कहानी बताते हैं:
NIST CAISI मूल्यांकन (मई 2026) से महत्वपूर्ण चेतावनी: DeepSeek के स्व-रिपोर्ट किए गए बेंचमार्क GPT-5.4 और Opus 4.6 के साथ समानता का दावा करते हैं, लेकिन CAISI के स्वतंत्र मूल्यांकन में पाया गया कि गैर-सार्वजनिक बेंचमार्क पर V4 'काफी कम सक्षम' है, जो बताता है कि कुछ स्व-रिपोर्ट किए गए स्कोर बढ़ा-चढ़ाकर बताए जा सकते हैं । आर्टिफिशियल एनालिसिस का इंटेलिजेंस इंडेक्स GPT-5.5 (हाई) को 53 पर रेट करता है, जबकि DeepSeek V4 Pro (रीज़निंग, हाई एफर्ट) को 41* पर रेट करता है — GPT-5.5 अधिक बुद्धिमान और तेज़ (69 बनाम 56 टोक/सेकंड) है, लेकिन DeepSeek नाटकीय रूप से सस्ता ($0.18 बनाम $4.35/MTok रीज़निंग मोड में) है
।
Alibaba के Qwen टीम ने 19 जुलाई, 2026 को शंघाई में वर्ल्ड AI कॉन्फ्रेंस में Qwen 3.8 Max का प्रीव्यू पेश किया । यह 1 ट्रिलियन पैरामीटर से ऊपर टीम का पहला फ्लैगशिप मॉडल है।
कोई पे-एज़-यू-गो मूल्य निर्धारण प्रकाशित नहीं किया गया है। पहुंच वर्तमान में Qwen Chat और चुनिंदा API भागीदारों के माध्यम से सदस्यता के माध्यम से है। BenchLM ने Qwen 3.8 Max Preview मूल्य निर्धारण को 'सूचीबद्ध नहीं' के रूप में सूचीबद्ध किया है । कुछ तृतीय-पक्ष ट्रैकर्स $1.50/$5.00 प्रति मिलियन इनपुट/आउटपुट टोकन पर ऑटो-प्राइसिंग दिखाते हैं, लेकिन Alibaba द्वारा इसकी पुष्टि नहीं की गई है
।
Alibaba का कहना है कि Qwen 3.8 'फेबल 5 के बाद दूसरा सबसे बेहतर' है (Anthropic का शीर्ष क्लॉड मॉडल), जो Alibaba की अपनी रैंकिंग में इसे GPT-5.5 और DeepSeek V4 से आगे रखेगा । Qwen 3.7 Max की तुलना में कोडिंग, पेशेवर उत्पादकता, फुल-स्टैक डेवलपमेंट, डेटा एनालिसिस और ऑफिस वर्कफ़्लो में लाभ का दावा किया गया है
।
हालांकि, कोई स्वतंत्र बेंचमार्क प्रकाशित नहीं किया गया है। बेंचमार्क ट्रैकिंग साइट BenchLM, 20 जुलाई, 2026 तक Qwen 3.8 Max Preview के लिए 321 बेंचमार्क को ट्रैक करता है, जिसमें 0 सत्यापित परिणाम हैं । जैसा कि एक विश्लेषण ने कहा, 'Qwen 3.8 का परीक्षण करना उचित है, लेकिन इसे Kimi K3, GPT-5.6 Sol, या Claude Fable 5 के लिए एक स्थिर उत्पादन प्रतिस्थापन के रूप में मानना बहुत जल्दबाजी होगी'
।
संदर्भ के लिए, Qwen के पूर्ववर्तियों ने एक मजबूत नींव रखी थी: Qwen 3.6-Max-Preview (20 अप्रैल, 2026) एक 35B कुल / 3B सक्रिय पैरामीटर टेक्स्ट-ओनली मॉडल था जिसमें 262K कॉन्टेक्स्ट था और इसने छह कोडिंग और एजेंट बेंचमार्क पर #1 होने का दावा किया था । Qwen 3.7-Max (मई 2026) ने रीज़निंग एजेंट क्षमताओं के साथ 1M टोकन कॉन्टेक्स्ट विंडो तक विस्तार किया
। लेकिन एजेंटिक कोडिंग के बाहर उनमें से किसी को भी आम तौर पर फ्रंटियर-स्तर नहीं माना जाता था।
Alibaba स्पष्ट रूप से Qwen 3.8 को 'फेबल 5 के बाद दूसरा सबसे बेहतर' बताता है । यदि यह दावा स्वतंत्र मूल्यांकन में सही साबित होता है, तो यह Qwen 3.8 को GPT-5.5 से आगे और DeepSeek V4 से काफी आगे रखेगा। लेकिन शून्य सत्यापित बेंचमार्क के साथ, यह एक विपणन दावा बना हुआ है, कोई स्थापित तथ्य नहीं। Anthropic का Fable 5, Alibaba के अपने ढांचे के अनुसार वर्तमान मान्यता प्राप्त फ्रंटियर लीडर प्रतीत होता है
।
DeepSeek के आक्रामक मूल्य निर्धारण ने API लागतों पर एक रेस-टू-द-बॉटम शुरू कर दिया है। V4-Flash $0.14/M इनपुट पर किसी भी पश्चिमी फ्रंटियर मॉडल की तुलना में काफी सस्ता है। Alibaba ने अभी तक Qwen 3.8 मूल्य निर्धारण निर्धारित नहीं किया है, लेकिन Qwen 3.6 पहले से ही आक्रामक रूप से मूल्य निर्धारित किया गया था (~$1.25/$7.50 इनपुट/आउटपुट) ।
DeepSeek V4 के लिए ओपन-वेट MIT लाइसेंस का मतलब सेल्फ-होस्टिंग भी संभव है, जो बंद-स्रोत प्रदाताओं के लिए मार्जिन को और कम करता है । जैसा कि एक विश्लेषण ने कहा, व्यावहारिक प्रभाव यह है कि 'डेवलपर्स अब GPT-5.5 या Claude की लागत के एक अंश पर निकट-फ्रंटियर क्षमता (कोडिंग कार्यों पर) तक पहुंच सकते हैं।'