Qwen 3.7 Max של עליבאבא, שהושק במאי 2026, הוא דגל בעל 2.8 טריליון פרמטרים בארכיטקטורת mixture-of-experts (MoE) שנראה כי משתווה או עולה על Fable 5 של Anthropic במדדים, בעלות של כשישית . לשימוש בהיקפים גבוהים, Qwen3.6 Flash של עליבאבא עולה רק $0.19 למיליון טוקני קלט .
GLM-5.2 של Zhipu AI, שיצא ב-13 ביוני 2026, משתמש בארכיטקטורת MoE עם 744 מיליארד פרמטרים (40 מיליארד פעילים) וחלון הקשר של מיליון טוקנים, ודורג כמודל בעל המשקולות הפתוחות הטוב ביותר במדד הבינה של Artificial Analysis . במחיר של $1.40 למיליון טוקני קלט ו-$4.40 למיליון טוקני פלט, הוא זול בכפי 5-6 בערך ממודלי החזית האמריקאיים .
Kimi K3 של Moonshot AI, שנחשף ב-16 ביולי 2026, הוא מערכת הבינה המלאכותית בעלת המשקולות הפתוחות הגדולה ביותר שהוכרזה אי פעם: 2.8 טריליון פרמטרים, חלון הקשר של מיליון טוקנים והבנה חזותית טבעית . Moonshot הבטיחה משקולות פתוחות מלאות עד 27 ביולי 2026 . תמחור ה-API שלה עומד על $3 למיליון טוקני קלט ו-$15 למיליון טוקני פלט, מה שהופך אותו למודל הסיני היקר ביותר – אך עדיין מתחת להצעות האמריקאיות המקבילות .
פער העלות בין מודלי החזית הסיניים והאמריקאיים קיצוני:
| מודל | מחיר קלט (למיליון טוקנים) | מחיר פלט (למיליון טוקנים) |
|---|---|---|
| DeepSeek V4-Flash | $0.14 | $0.28 |
| Alibaba Qwen3.6 Flash | $0.19 | $1.13 |
| Zhipu GLM-5.2 | $1.40 | $4.40 |
| Alibaba Qwen3.7 Max | $1.25 | $3.75 |
| Moonshot Kimi K3 | $3.00 | $15.00 |
| Anthropic Claude Fable 5 (הערכה) | ~$15.00 | ~$50.00 |
| OpenAI GPT-5.5 (הערכה) | ~$5.00 | ~$15.00 |
מקורות: מצטט טבלה קודמת ו-
המספרים מספרים את הסיפור: V4-Flash של DeepSeek עולה לפי הערכה 3 סנטים למבחן מדד, לעומת $1.86 של GPT-5.5 ו-$3.33 של Claude Fable 5 . המשקיע מארק אנדריסן ציין ש-GLM-5.2 היה "מודל הבינה המלאכותית הסיני הראשון שמשתווה ולעתים קרובות עולה על מודלי הבינה המלאכותית הציבוריים הגדולים של המעבדות האמריקאיות ללא פשרות" – בשבריר מהמחיר .
החוד השני של האסטרטגיה הסינית הוא שחרור משקולות פתוחות. מודלים כמו GLM-5.2 (רישיון MIT), Kimi K3 (רישיון Modified MIT מובטח) וסדרת Qwen ניתנים להורדה בחינם, כלומר כל אחד יכול להריץ, לשנות או לכוונן אותם ללא עלות לכל טוקן . אסטרטגיית "מתן מודלים בחינם" זו מרוקנת את שוק הביניים שבו חברות אמריקאיות נהגו לגבות מחירי פרימיום .
נקודת מפנה מרכזית הגיעה ביוני 2026, כאשר ממשל טראמפ ביקש מ-Anthropic להפסיק את פעילותן של שתיים ממערכות הבינה המלאכותית המתקדמות ביותר שלה (Fable ו-Mythos) על רקע ביטחון לאומי . תוך שבועיים, Z.ai חשפה מודל שהתמודד היטב עם ההצעות של Anthropic – זול יותר וללא מגבלות אמריקאיות . חברות סיניות ראו פתח ומיהרו למלא אותו .
התגובה האמריקאית מקוטעת. Anthropic ציית לבקשת הממשלה. גוגל נאבקת לכאורה עם הגרסה העדכנית ביותר של מודל Gemini שלה, בעוד מודלים סיניים סוגרים את הפער . לא הוכרזה שום מדיניות אמריקאית מתואמת כנגד; אנליסטים מציינים כי בקרות היצוא על שבבים לא מנעו מחברות סיניות להשיג ביצועים תחרותיים באמצעות יעילות ארכיטקטורית (למשל, MoE, קשב היברידי) במקום כוח חישוב גולמי .
בינתיים, חברות אמריקאיות בוחנות ומאמצות יותר ויותר מודלים סיניים מסיבות עלות, מה ששוחק עוד יותר את יתרון הבית של מעבדות הבינה המלאכותית האמריקאיות .