המהלך מציב את GPT-5.6 Luna כאפשרות זולה במיוחד לעומסי עבודה בהיקף גבוה — וממחיש עד כמה התחרות בשוק הבינה המלאכותית עוברת גם דרך העלות של כל טוקן.
המחיר של GPT-5.6 Luna, הדגם המהיר והזול ביותר במשפחה, ירד ב-80% . המחירים למיליון טוקנים ב-API הם:
| רכיב חיוב | המחיר הקודם | המחיר החדש |
|---|---|---|
| טוקני קלט | 1.00 דולר | 0.20 דולר |
| קלט מאוחסן (Cached input) | 0.25 דולר | 0.10 דולר |
| טוקני פלט | 6.00 דולר | 1.20 דולר |
במילים פשוטות, העלות המשולבת של מיליון טוקני קלט ומיליון טוקני פלט ב-Luna היא כעת 1.40 דולר . המחירים החדשים נכנסו לתוקף מיד ב-30 ביולי וחלים על מסלול ה-API הסטנדרטי .
גם GPT-5.6 Terra, הדגם שנועד לאזן בין יכולת לעלות, הוזל — אך בשיעור מתון יותר של 20%: מ-2.50 ל-2 דולר למיליון טוקני קלט, ומ-15 ל-12 דולר למיליון טוקני פלט .
לעומתו, GPT-5.6 Sol, הדגם המוביל בסדרה, נשאר במחיר של 5 דולר לקלט ו-30 דולר לפלט למיליון טוקנים .
OpenAI הציגה שתי סיבות מרכזיות, הקשורות זו בזו .
בפוסט הרשמי שלה הסבירה החברה כי שיפורים בכל שכבות המערכת — החל בקוד ועד לאופטימיזציות תשתיתיות — מאפשרים לה לספק "הרבה יותר אינטליגנציה תמורת כל דולר" . OpenAI תיארה את המהלך כקידום "חזית היחס בין מחיר לביצועים" .
לדברי החברה, עבודת אופטימיזציה ברמת ה-kernel הורידה את עלות הפעלת המודל מקצה לקצה ב-20%, וניסויים נוספים שיפרו את יעילות יצירת הטוקנים ביותר מ-15% . חלק מהשיפורים נבעו גם מיכולת של GPT-5.6 Sol לשכתב באופן אוטונומי קוד המשמש בסביבת הייצור, ובכך להפחית את עלויות השירות ב-20% .
ההוזלה מגיעה בתקופה שבה חברות בוחנות בזהירות רבה יותר את תקציבי הבינה המלאכותית. ארגונים רבים מהססים להטמיע מודלים יקרים בלי ודאות ברורה לגבי התשואה על ההשקעה . במקביל, מודלים זולים יותר, בהם מודלים סיניים בעלי משקלים פתוחים, מגבירים את הלחץ על OpenAI ועל מתחרותיה להוכיח שהמחיר הגבוה מצדיק את עצמו .
רויטרס ציינה כי ההוזלות התאפשרו בחלקן בזכות שיפורי היעילות של GPT-5.6, אך הן משקפות גם את העובדה שעסקים בוחנים בקפידה רבה יותר את הוצאות הבינה המלאכותית .
מנכ"ל OpenAI, סם אלטמן, כתב ב-X: "אנחנו רוצים להציע את האיזון הטוב ביותר בין מחיר לאינטליגנציה בכל רמה" .
עבור מפתחים שבונים שירותים על גבי ה-API, ההנחה של 80% הופכת את Luna לאפשרות אטרקטיבית במיוחד למשימות בהיקף גדול, שבהן מהירות ועלות נמוכה חשובות יותר מהיכולת המרבית של דגם הדגל .
ההוזלות משפיעות גם על אופן ספירת השימוש במנויים בתשלום של ChatGPT Work ושל Codex. בפועל, משתמשים עסקיים יוכלו לבצע יותר עבודה עם Luna ו-Terra בלי לשלם יותר .
השורה התחתונה: OpenAI מציגה את המהלך כתוצאה של התייעלות הנדסית, אך התזמון והיקף ההנחה מצביעים גם על שוק תחרותי יותר ועל לקוחות עסקיים שפחות מוכנים לקבל חשבונות AI גבוהים בלי הצדקה ברורה.