התמחור עומד על $0.435 למיליון טוקני קלט, $0.87 למיליון טוקני פלט בתעריפים רגילים, עם הנחות מטמון של עד 97% . במצב מאמץ מקסימלי, התמחור הוא $1.32/$3.96 למיליון טוקנים
.
Moonshot AI שחררה מודל שהיא מכנה "המודל הפתוח הראשון בעולם במחלקת 3 טריליון פרמטרים" – 2.8 טריליון פרמטרים בארכיטקטורת MoE המפעילה 16 מתוך 896 מומחים לכל טוקן, עם חלון הקשר של מיליון טוקנים ויכולות מולטימודאליות (חזון + טקסט) . המשקלים המלאים שוחררו ב-Hugging Face ב-27 ביולי תחת רישיון Modified MIT
. המודל זמין ב-Kimi.com, Kimi Work, Kimi Code, וב-Kimi API
.
המודל שהתחיל את הגל. GLM-5.2 הוא מודל MoE בעל 744 מיליארד פרמטרים, עם כ-40 מיליארד פעילים לכל טוקן, חלון הקשר של מיליון טוקנים, ורישיון MIT . הערכת ה-CAISI של NIST מדרגת את היכולות הכוללות שלו כדומות ל-GPT-5.2 (דצמבר 2025) ויכולות הסייבר שלו כדומות ל-Claude Opus
. הוא מקבל ציון 81.0 ב-Terminal-Bench 2.1 ו-62.1 ב-SWE-bench Pro – הציון הגבוה ביותר למודל במשקל פתוח במדד ה-Artificial Analysis Intelligence
. התמחור API זול בערך פי 10 מ-Claude או GPT-5
.
מודל MoE בעל 1.6 טריליון פרמטרים (48 מיליארד פעילים לכל טוקן) עם חלון הקשר של מיליון טוקנים, שוחרר תחת רישיון MIT . ההבחנה הקריטית שלו: זהו מודל ענק בעל טריליון פרמטרים שאומן ורץ כולו על שבבים סיניים מתוצרת מקומית – חוות של 50,000 שבבי Huawei Ascend 910B/C
. לפי בדיקות Meituan, הוא עוקף את GPT-5.5 במבחני הנדסת תוכנה
. הוא שתק בראש טבלת ה-OpenLLM תחת השם "Owl Alpha" לפני ההשקה הרשמית
. תמחור API עומד על $0.75/$2.95 למיליון טוקני קלט/פלט, עם מבצע השקה ב-$0.30/$1.20
.
לארגונים מחוץ לסין יש כעת חלופות אמינות, זולות ופתוחות למודלי API אמריקאיים. רישיון MIT של GLM-5.2 ללא הגבלות אזוריות מאפשר לכל חברה לארח אותו מסחרית ללא הגבלה . משמעות הדבר היא שינוי בהחלטות רכש בדרום-מזרח אסיה, המזרח התיכון, אפריקה, ובחלקים מאירופה.
הראיות תומכות בתיזה שהסנקציות האמריקאיות על ייצוא שבבים השיגו תוצאה הפוכה לפחות בשתי דרכים:
לא נמצאו מקורות תומכים לתמחור ספציפי של $0.06 למשימה עבור DeepSeek V4 Pro או $2.34 עבור Claude Opus 5. גם למודלים Tencent Hy3 ו-Alibaba Qwen3.8-Max אין מפרטים מאומתים או תאריכי שחרור בראיות הקיימות. טענות לגבי מניפסט קוד פתוח אחרון של מארק צוקרברג לא ניתן היה לאשש.
מאמר זה מבוסס על ראיות זמינות נכון לאמצע אוגוסט 2026. כל הטענות לגבי יכולות מודלים מבוססות על מבחני בנצ'מרק שדווחו על ידי מפתחים והערכות צד שלישי (כולל CAISI של NIST). אימות עצמאי של כל ציוני הבנצ'מרק מתבצע ברחבי התעשייה. השוואות עלות מבוססות על תמחור API ציבורי לטוקנים; עלויות בפועל למשימה משתנות משמעותית לפי מורכבות המשימה, אורך הקשר ושיעורי פגיעות מטמון.