Grok 4.5 נכנס לבטא פרטית ב-SpaceX וב-Tesla ב-28 ביוני 2026. הוא מבוסס על מודל התשתית V9, שהאימון המקדים שלו הסתיים ב-26 במאי, ובו 1.5 טריליון פרמטרים . ב-8 ביולי הוא הוצע דרך ממשק ה-API של xAI במחיר של 2 דולר למיליון טוקני קלט ו-6 דולר למיליון טוקני פלט .
Grok 4.6 מגדיל את מספר הפרמטרים בכ-33% — מ-1.5 ל-2 טריליון . עם זאת, xAI עדיין לא חשפה פרטים על הארכיטקטורה או על המחיר העתידי של ה-API.
| מאפיין | Grok 4.5 | Grok 4.6 |
|---|---|---|
| מספר פרמטרים | 1.5 טריליון | 2 טריליון |
| מודל תשתית | V9, שהשלים אימון ב-26 במאי 2026 | דור חדש; פרטים ארכיטקטוניים טרם נחשפו |
| סטטוס | בטא פרטית ב-SpaceX וב-Tesla מאז 28 ביוני; API הושק ב-8 ביולי | האימון הראשוני צפוי להסתיים בשבוע הבא; השקה צפויה באוגוסט |
| מחיר API | 2 דולר למיליון טוקני קלט ו-6 דולר למיליון טוקני פלט | טרם פורסם |
| ביצועים מדווחים | xAI טוענת לביצועים המתקרבים ל-Claude Opus או עולים עליו; אין דירוגים עצמאיים | xAI טוענת שיעלה על Grok 4.5 ושואפת לעקוף את Kimi K3 |
חשוב לסייג: עדיין לא פורסמו מבחני ביצועים עצמאיים של גורמי צד שלישי עבור Grok 4.5. כל הטענות על יכולותיו מגיעות מ-xAI עצמה . מהנדס ב-xAI ציין גם כי Grok 4.5 השתמש בנתוני "Cursor" — נתונים ממוקדי תכנות — באימון משלים, ולא באימון הראשוני. לדבריו, שילוב כזה "לא ממש טוב כמו להכניס אותם לאימון הראשוני" .
העיתוי קשור ישירות להשקת Kimi K3 של חברת Moonshot AI ב-16 ביולי 2026 . Kimi K3 הוא מודל Mixture-of-Experts, או MoE — ארכיטקטורה שבה המודל כולל מספר רב של "מומחים", אך מפעיל רק חלק קטן מהם עבור כל טוקן.
ל-Kimi K3 יש 2.8 טריליון פרמטרים, חלון הקשר של מיליון טוקנים ויכולות ראייה מובנות. Moonshot הציגה אותו כמודל ה-AI הגדול ביותר בעל משקלים פתוחים וכראשון בקטגוריית מודלי ה-3 טריליון . מתוך 896 המומחים שלו, רק 16 מופעלים עבור כל טוקן — עיצוב שנועד להפחית את עלויות החישוב .
בפוסטים של מאסק מוצג Grok 4.6 במפורש כתשובה ל-Kimi K3: היעד הוא לעקוף אותו בביצועים, תוך שמירה על יתרונות של מהירות ויעילות . מבחינת גודל גולמי, Grok 4.6 קטן יותר מ-Kimi K3. לכן ההימור של xAI הוא לא רק על מספר הפרמטרים, אלא גם על יעילות הארכיטקטורה ועל אופטימיזציה של תהליך ההסקה .
כאן נמצא ההבדל המרכזי בין שני המודלים. ל-Grok 4.5 אין ציוני מבחנים עצמאיים, והטענות התחרותיות בעניינו מבוססות על דיווחים של xAI. לעומת זאת, Kimi K3 עבר הערכות עצמאיות ומדורג במקום השלישי בעולם בדירוגים מקיפים — אחרי Claude Fable 5 של Anthropic ו-GPT-5.6 Sol של OpenAI . הוא אף תואר כמודל שמציג ביצועים כמעט שוויוניים למערכות הקנייניות החזקות ביותר של החברות האמריקאיות .
במבחנים מסוימים של תכנות ופיתוח אתרים, Kimi K3 עקף את Claude Fable 5 . לפי דיווחים, ה-API שלו עולה בערך מחצית ממחירם של מודלי חזית מקבילים כמו Claude Fable 5 ו-GPT-5.6 Sol . עם זאת, לא נמצא מחיר מדויק לטוקן במקורות בעלי סמכות גבוהה.
השורה התחתונה: אין עדיין השוואת ביצועים עצמאית וישירה בין Grok לבין Kimi K3. לכן ההצהרות של xAI על עליונותו הצפויה של Grok 4.6 נותרות, בשלב זה, טענות שטרם אומתו בבדיקה חיצונית.
ההכרזה על Grok 4.6 היא חלק מתוכנית רחבה בהרבה:
במקביל למרוץ אחר מודל גדול יותר, xAI פתחה את Grok Build בקוד פתוח ב-15–16 ביולי 2026, תחת רישיון Apache 2.0. מדובר בסוכן תכנות מבוסס Rust, המופעל משורת הפקודה וזמין במאגר GitHub בשם xai-org/grok-build .
הכלי כולל שמונה סוכני משנה שפועלים במקביל, תהליך עבודה שמתחיל בתכנון ו-Arena Mode. פתיחת הקוד הגיעה לאחר מחלוקת הנוגעת לפרטיות: חוקרי אבטחה דיווחו כי גרסה קודמת העלתה לשרתים של xAI את ספריות העבודה המלאות של משתמשים . באמצעות פרסום הקוד, xAI ביקשה לחזק את האמון ולזרז אימוץ מצד קהילת המפתחים.
ב-8 ביולי אישר מאסק כי xAI משפרת את Grok Build מדי יום, בהתבסס על משוב משתמשים . בכך היא מציבה את הכלי מול פתרונות מבוססים יותר, כמו Cursor ו-GitHub Copilot.
ההכרזה על Grok 4.6 נראית כמו מתקפת נגד תחרותית של מאסק, יומיים בלבד לאחר השקת Kimi K3. xAI מציעה קצב שחרור שאפתני — מודל חדש מדי חודש — ומפת הדרכים של Grok 5 מצביעה על דגמים גדולים בהרבה בהמשך.
אבל גודל המודל אינו הוכחה לביצועים. כל עוד אין מבחנים עצמאיים עבור Grok 4.5 או Grok 4.6, קשה לדעת אם המודל החדש אכן יעקוף את Kimi K3. במרוץ שבו שקיפות חשובה לא פחות מהיקף החישוב, הפער הזה משמעותי.