| मॉडल | इनपुट ($/1M टोकन) | आउटपुट ($/1M टोकन) | DeepSeek V4 Flash से लागत |
|---|---|---|---|
| DeepSeek V4 Flash | $0.14 | $0.28 | 1× (आधार) |
| DeepSeek V4 Pro | $0.435 | $0.87 | ~3× |
| Alibaba Qwen 3.6 Plus | $0.33 | $1.95 | ~2–7× |
| OpenAI GPT-5.5 | ~$5.00 | ~$30.00 | ~12–107× |
| Claude Opus 4.8 | ~$15.00 | ~$25.00 | ~54–89× |
स्रोतों से प्रमुख डेटा:
NIST के CAISI मूल्यांकन से स्वतंत्र बेंचमार्क दिखाते हैं कि DeepSeek V4 Pro सीधे OpenAI और Anthropic के सर्वश्रेष्ठ मॉडलों से मुकाबला करता है :
| बेंचमार्क | DeepSeek V4 Pro | OpenAI GPT-5.5 | Anthropic Opus 4.6 |
|---|---|---|---|
| GPQA Diamond (विज्ञान तर्क) | 90.1% | 96% | 91% |
| MMLU-Pro (व्यापक ज्ञान) | 87.5% | ~92% | 89.1% |
| SWE-bench Verified (कोडिंग) | 80.6% | ~75% | ~78% |
प्रदर्शन की अन्य मुख्य बातें:
चीनी AI की वित्तीय कहानी तकनीकी जितनी ही नाटकीय है:
Alibaba (Qwen) एक ओपन-सोर्स इकोसिस्टम रणनीति अपनाता है: अधिकांश मॉडल Apache 2.0 के तहत जारी किए जाते हैं, फाइन-ट्यून करने में आसान होते हैं, और खुद होस्ट करने के लिए स्वतंत्र होते हैं । इसने Qwen को Hugging Face पर सबसे ज्यादा डाउनलोड किया जाने वाला मॉडल परिवार बना दिया। इसका नकारात्मक पक्ष मुद्रीकरण है - Alibaba का AI एक हिट है लेकिन इसे सीधा पैसा कमाने वाला बनाना मुश्किल है, जैसा कि न्यूयॉर्क टाइम्स ने रिपोर्ट किया । हालांकि, Alibaba ने रुख बदलना शुरू कर दिया है: फ्लैगशिप Qwen 3.6 Max Preview को अप्रैल 2026 में एक बंद, मालिकाना API मॉडल के रूप में जारी किया गया ।
DeepSeek एक हाइब्रिड दृष्टिकोण अपनाता है: यह MIT लाइसेंस के तहत अपने V4 वेट (1.6 ट्रिलियन पैरामीटर Mixture-of-Experts, 49 बिलियन एक्टिव पैरामीटर) को ओपन-सोर्स करता है, साथ ही एक सस्ता API टियर भी प्रदान करता है । इसकी आर्किटेक्चर - बेहद स्पार्स एक्टिवेशन के साथ MoE - नाटकीय रूप से कम इन्फ्रेंस लागत पर फ्रंटियर प्रदर्शन को सक्षम बनाती है।
पश्चिमी कंपनियां (OpenAI, Anthropic, Google) मुख्य रूप से बंद, मालिकाना API पर प्रीमियम मूल्य निर्धारण के साथ निर्भर करती हैं। OpenAI और Anthropic ने दबाव के जवाब में सस्ते "नैनो" और "मिनी" टियर जारी किए हैं, लेकिन कोई भी DeepSeek के फ्रंटियर-टियर प्रदर्शन-मूल्य अनुपात से मेल नहीं खाता ।