| גודל הבקשה | קלט | קלט שמור במטמון | פלט |
|---|---|---|---|
| פחות מ-200,000 טוקני קלט | 2 דולר | 0.50 דולר | 6 דולר |
| 200,000 טוקנים ומעלה | 4 דולר | 1 דולר | 12 דולר |
הנקודה החשובה לתכנון תקציב היא שהתעריף של הקשר ארוך חל כאשר הבקשה נכנסת למדרגת 200,000 הטוקנים. צוותים שבונים סוכנים ומעבירים אליהם באופן קבוע מאגרי קוד, מסמכים גדולים או היסטוריות שיחה ארוכות צריכים לחשב את העלות לפי הסף הזה — ולא להסתמך רק על מחירי הכותרת של 2 דולר לקלט ו-6 דולר לפלט.
שמירת קלט במטמון יכולה להפחית את רכיב הקלט בחשבון, אך אינה פותרת את הצורך לשלוט בגידול ההקשר. בתכנון לפרודקשן כדאי למדוד את גודל הפרומפט, שיעור השימוש החוזר במטמון, אורך הפלט ואת השיפור האיכותי שמספק מידע נוסף — לפני שמגדילים את תקציב ההקשר.
xAI דיווחה כי Grok 4.6 השיג 70.8% ב-CursorBench 3.2 בהגדרת "Extra High Thinking", לעומת 70.5% שדווחו עבור Fable 5 Max. החברה טענה גם לעלות של בערך שישית לכל משימה שהושלמה.
זו טענת השקה מעניינת, אך הפער עצמו הוא 0.3 נקודת אחוז בלבד, והוא מבוסס על השוואת ביצועים שדווחה על ידי הספק. לכן נכון להתייחס אליו כאיתות שמצדיק בדיקה נוספת — לא כהוכחה ש-Grok 4.6 יגבר על מודלים מתחרים במאגרי הקוד, בכלים, ביעדי זמן התגובה או בדרישות האמינות של הארגון.
גם התמונה הרחבה יותר מחייבת זהירות. השוואות אחרות שפורסמו מציגות ציונים שונים בהתאם למבחן ולהגדרות, ובהן תוצאה של 69.9% ב-CursorBench בטבלת השוואה אחת. תוצאות מבחנים יכולות להשתנות לפי הפרומפטים, מסגרת הבדיקה, הגדרות המודל ומועד ההערכה. לכן רוכשים פוטנציאליים צריכים לשחזר את ההשוואה על משימות שמייצגות את העבודה האמיתית שלהם.
Grok 4.6 הוצע דרך ה-API של xAI והופץ גם בערוצי פיתוח וענן שכללו את Cursor, GitHub Copilot, Amazon Bedrock, OpenRouter, Vercel ו-Cloudflare. אמזון הודיעה על זמינותו ב-Bedrock ב-19 באוגוסט, שבוע לאחר ההשקה הראשונית.
Vertex AI מוסיפה נקודת גישה מסוג אחר. עבור לקוח Google Cloud, היתרון אינו רק כתובת API נוספת, אלא האפשרות לבחון את המודל בתוך סביבת ענן קיימת — עם תהליכי רכש, הרשאות וניהול הוצאות שכבר מוכרים לצוות. עבור ארגונים שכבר מנהלים ניסויי AI, בקרת גישה ותקציבים דרך Google Cloud, הדבר עשוי להפחית את הקושי שבהתנסות בספק מודלים חדש.
המחיר לכך הוא שמסלול דרך פלטפורמה מנוהלת אינו מבטל את עבודת בחירת המודל. לפני מעבר מניסוי לפרודקשן יש לבדוק זמינות אזורית, מכסות, אופן הטיפול בנתונים, מאפייני השירות, התנהגות כלי העזר, יכולות ניטור ומצבי כשל. בנוסף, העובדה ש-Grok 4.6 מופיע בפלטפורמה של Google בשלב Preview היא סיבה להתייחס לפריסות הראשונות כהערכות מבוקרות, ולא להניח שהשירות יישאר ללא שינוי לאורך זמן.
הערכה מעשית צריכה להתמקד בארבעה תחומים:
ההשקה של xAI ב-Vertex AI עוסקת פחות במספר בודד במבחן ביצועים ויותר בהפיכת Grok 4.6 לזמין במקומות שבהם מפתחים כבר עובדים. המודל משלב חלון הקשר גדול ויכולות המכוונות לסוכנים עם מחיר כניסה שמזמין ניסויים, בעוד שההפצה המהירה דרך APIs, סביבות פיתוח, פלטפורמות אירוח ושוקי ענן מקצרת את הדרך להתנסות.
עבור רוכשים ארגוניים, המסקנה היא אפוא מותנית: Grok 4.6 קל יותר לבחינה כעת בתוך Google Cloud, אך הערך שלו ייקבע לפי תוצאות על עומסי העבודה של הארגון, כלכלת הבקשות ארוכות-ההקשר והתאמת מאפייני שירות ה-Preview לדרישות הממשל. היתרון המדווח במבחן שווה בדיקה — אך עדיין לא כדאי להתייחס אליו כאל יתרון יציב.