| מודל | קלט ($/מיליון טוקנים) | פלט ($/מיליון טוקנים) | יחס לעומת DeepSeek V4 Flash |
|---|---|---|---|
| DeepSeek V4 Flash | 0.14$ | 0.28$ | 1× (קו בסיס) |
| DeepSeek V4 Pro | 0.435$ | 0.87$ | ~3× |
| Alibaba Qwen 3.6 Plus | 0.33$ | 1.95$ | ~2–7× |
| OpenAI GPT-5.5 | ~5.00$ | ~30.00$ | ~12–107× |
| Claude Opus 4.8 | ~15.00$ | ~25.00$ | ~54–89× |
נתוני מפתח ממקורות שונים:
מבחנים עצמאיים של המכון הלאומי לתקנים וטכנולוגיה (NIST) מראים ש-DeepSeek V4 Pro מתחרה ישירות בטובים ביותר של OpenAI ואנתרופיק :
| מבחן | DeepSeek V4 Pro | OpenAI GPT-5.5 | Anthropic Opus 4.6 |
|---|---|---|---|
| GPQA Diamond (חשיבה מדעית) | 90.1% | 96% | 91% |
| MMLU-Pro (ידע כללי). | 87.5% | ~92% | 89.1% |
| SWE-bench Verified (תכנות) | 80.6% | ~75% | ~78% |
נקודות נוספות לביצועים:
הסיפור הפיננסי של ה-AI הסיני דרמטי לא פחות מהטכני:
אליבאבא (Qwen) נוקטת אסטרטגיית אקוסיסטם פתוח: רוב הדגמים משוחררים תחת רישיון Apache 2.0, קלים לכיוונון עדין (fine-tuning) וחופשיים לאירוח עצמי . זה הפך את Qwen למשפחת הדגמים הפופולרית ביותר ב-Hugging Face. המחיר הוא מונטיזציה – ה-AI של אליבאבא הוא להיט, אבל קשה להפוך אותו לעסק ישיר, כפי שדיווח הניו יורק טיימס . עם זאת, אליבאבא החלה לשנות כיוון: הדגל Qwen 3.6 Max Preview שוחרר באפריל 2026 כמודל API קנייני וסגור .
DeepSeek נוקטת גישה היברידית: היא משחררת את משקולות מודל V4 תחת רישיון MIT (1.6 טריליון פרמטרים בארכיטקטורת Mixture-of-Experts, 49 מיליארד פעילים), תוך שהיא מציעה גם שכבת API זולה . הארכיטקטורה שלה – MoE עם הפעלה דלילה במיוחד – מאפשרת ביצועים ברמת חזית בעלות הסקה נמוכה באופן דרמטי.
השחקניות המערביות (OpenAI, אנתרופיק, גוגל) מסתמכות בעיקר על APIs קנייניים וסגורים במחירי פרימיום. OpenAI ואנתרופיק השיקו שכבות זולות יותר (