מבחנים עצמאיים של המכון הלאומי לתקנים וטכנולוגיה (NIST) מראים ש-DeepSeek V4 Pro מתחרה ישירות בטובים ביותר של OpenAI ואנתרופיק :
| מבחן | DeepSeek V4 Pro | OpenAI GPT-5.5 | Anthropic Opus 4.6 |
|---|---|---|---|
| GPQA Diamond (חשיבה מדעית) | 90.1% | 96% | 91% |
| MMLU-Pro (ידע כללי). | 87.5% | ~92% | 89.1% |
| SWE-bench Verified (תכנות) | 80.6% | ~75% | ~78% |
נקודות נוספות לביצועים:
הסיפור הפיננסי של ה-AI הסיני דרמטי לא פחות מהטכני:
אליבאבא (Qwen) נוקטת אסטרטגיית אקוסיסטם פתוח: רוב הדגמים משוחררים תחת רישיון Apache 2.0, קלים לכיוונון עדין (fine-tuning) וחופשיים לאירוח עצמי . זה הפך את Qwen למשפחת הדגמים הפופולרית ביותר ב-Hugging Face. המחיר הוא מונטיזציה – ה-AI של אליבאבא הוא להיט, אבל קשה להפוך אותו לעסק ישיר, כפי שדיווח הניו יורק טיימס
. עם זאת, אליבאבא החלה לשנות כיוון: הדגל Qwen 3.6 Max Preview שוחרר באפריל 2026 כמודל API קנייני וסגור
.
DeepSeek נוקטת גישה היברידית: היא משחררת את משקולות מודל V4 תחת רישיון MIT (1.6 טריליון פרמטרים בארכיטקטורת Mixture-of-Experts, 49 מיליארד פעילים), תוך שהיא מציעה גם שכבת API זולה . הארכיטקטורה שלה – MoE עם הפעלה דלילה במיוחד – מאפשרת ביצועים ברמת חזית בעלות הסקה נמוכה באופן דרמטי.
השחקניות המערביות (OpenAI, אנתרופיק, גוגל) מסתמכות בעיקר על APIs קנייניים וסגורים במחירי פרימיום. OpenAI ואנתרופיק השיקו שכבות זולות יותר (