ב־3 בספטמבר 2026, ChatGPT ו-Codex של OpenAI, Claude של Anthropic ו-Grok של xAI חוו בעיות שירות בפרקי זמן חופפים. עבור משתמשים שניסו לעבור מפלטפורמה אחת למתחרה שלה, זו הייתה תזכורת בולטת לכך שגם שירותי AI נפרדים עלולים להיתקל בקשיים באותו חלון זמן.
עם זאת, המסקנה החשובה היא גם הזהירה ביותר: מדובר בשיבושים מקבילים, לא בתקלה משותפת שהוכחה. OpenAI ייחסה את הבעיה אצלה לשגיאת ניתוב; ההודעות והדיווחים הפומביים לגבי Claude ו-Grok לא ביססו גורם טכני משותף לשלוש החברות.
40
41
ציר הזמנים: מתי החלה התקלה ומתי השירותים התאוששו?
לפי OpenAI, שגיאת ניתוב שהחלה בערך ב־7:43 בבוקר, שעון החוף המערבי בארה״ב (PT), הפכה את ChatGPT ואת Codex ללא זמינים עבור חלק מהמשתמשים, בפלטפורמות שונות. בסביבות 8:17 בבוקר PT כבר יושם פתרון, והחברה המשיכה לנטר את ההתאוששות.
40
אירוע הסטטוס הציבורי של OpenAI נפתח ב־14:58 UTC ותיאר "שיעור שגיאות מוגבר ב-ChatGPT וב-Codex".
17 דיווח מאוחר יותר, שהתבסס על הודעות הסגירה של הספקיות, הציב את סיום האירוע של OpenAI ב־16:55 UTC. כלומר, מהשעה 7:43 בבוקר PT — 14:43 UTC — ועד לסיום המדווח, ההפרעה נמשכה כ־שעתיים ו־12 דקות. ההשפעה לא הייתה זהה אצל כל המשתמשים.
40
41
באותו פרק זמן רחב יותר דווחו בעיות גם אצל Anthropic ו-xAI: לפי הודעות הסטטוס שלהן, אירוע שגיאות המודלים של Anthropic נפתר ב־16:16 UTC, ואילו xAI דיווחה בהמשך שהתעבורה ל-Grok חזרה להיות תקינה ב־17:07 UTC.
41
מה ראו המשתמשים — ומה הראו דפי הסטטוס
משתמשים דיווחו על כשלי התחברות, שגיאות בצ׳אטים, תשובות שלא התקבלו ובעיות גישה בגרסאות הווב והאפליקציות. לפי נתוני Downdetector שצוטטו במהלך האירוע, בארה״ב נרשמו יותר מ־35,000 דיווחים לגבי ChatGPT, לצד יותר מ־1,400 לגבי Claude ויותר מ־1,200 לגבי Grok. בהודו צוטטו יותר מ־2,800 דיווחים על ChatGPT, כ־170 על Claude ויותר מ־70 על Grok. חשוב להדגיש: אלה דיווחי משתמשים, ולא ספירה מלאה של כל החשבונות שנפגעו — אך הם מצביעים על כך שהתקלה הורגשה בהיקף רחב.
42
דף הסטטוס של OpenAI אישר שיעור שגיאות מוגבר ב-ChatGPT וב-Codex, ובהמשך סימן את האירוע כנפתר.
17
20 דיווחים מאותה עת תיארו השפעה על ChatGPT בדפדפן, במובייל ובמחשב השולחני, ולא כשל שמוגבל לממשק יחיד.
39
50
ב-Claude, הדיווחים הצביעו על שגיאות מוגברות בכמה מודלים, בהם Mythos/Fable 5.1, Mythos/Fable 5, Opus 5, Opus 4.8 ו-Opus 4.6. עדכונים מאוחרים יותר ציינו שרבים מהמודלים חזרו לרמת השגיאות הרגילה, בעוד Opus 4.8 ו-Opus 5 המשיכו להיות מושפעים לפרק זמן ארוך יותר.
36
47
49
xAI אישרה ש-Grok חווה בעיות, ובהמשך דווח שהתעבורה לשירות חזרה להיות תקינה.
49
41
האם Gemini הייתה החלופה שלא נפגעה?
בדיווחים מוקדמים הוצגה לעיתים Google Gemini כמתחרה הגדולה שנראתה זמינה בזמן ש-ChatGPT, Claude ו-Grok שיבשו את עבודת המשתמשים. אבל צריך להתייחס לכך בזהירות: דיווחים אחרים הצביעו על עלייה בתלונות ב-Downdetector גם לגבי Gemini, בלי ראיה מקבילה לאירוע מאומת בדף הסטטוס של Google.
44
48
בפועל, שירות עשוי לעבוד עבור קבוצת משתמשים אחת ובו בזמן להציג שגיאות מוגברות אצל קבוצה אחרת. אתרי מעקב אחר תקלות הם אות שימושי, אך אינם תחליף להודעת אירוע של הספקית או לניטור של האפליקציה עצמה.
למה זו לא הייתה רק בעיה של צ׳אט
כשכלי AI משמשים לעבודה, תקלה בהם אינה מסתכמת בחוסר יכולת לשאול שאלה בצ׳אט. השבתה של עוזרי קוד או תהליכים מבוססי סוכנים יכולה לעכב משימות פיתוח; שגיאות ב-API עלולות להפיל או לעכב יכולות מוצר ואוטומציות פנימיות; וכלי חיפוש, סיכום ומחקר עלולים לשבש תהליכי ידע ומחקר.
גם היסטוריית הסטטוס של OpenAI ממחישה את רוחב החשיפה האפשרי: הודעות נפרדות מהתקופה האחרונה עסקו ב-Codex, בחיפוש, בסוכנים, ב-Deep Research, במחברים, בהעלאת קבצים, בהתחברות ובתהליכי עבודה התלויים ב-GitHub.
19
24
25
29
אין בכך כדי לקבוע שספקית אחת פחות אמינה מאחרות. המשמעות הצרה יותר היא שתלות בספק יחיד, במודל יחיד או בסביבת סוכנים אחת עלולה להפוך לנקודת כשל יחידה בתפעול הארגוני.
השמועות על Astra ו-GPT-6 לא היו ראיה
העיתוי עורר ספקולציות: דיווחים קישרו את התקלה לשמועות על הכרזה קרובה של OpenAI בשם "Astra", שאולי קשורה לדור עתידי של מודלים סביב GPT-6. אבל אין בראיות הזמינות בסיס לקשר סיבתי כזה.
ההסבר שנמסר לגבי התקלה של OpenAI היה שגיאת ניתוב. אף ספקית לא קשרה בפומבי את הבעיות המקבילות ל-Astra, ל-GPT-6 או להשקת מודל. צירוף הזמנים יצר סיפור מסקרן, לא הוכחת סיבתיות.
40
37
46
מה מלמדת היסטוריית התקלות על סיכון תפעולי
האירוע של 3 בספטמבר אינו חריג במובן שתקלות אינן חד־פעמיות בשוק הזה. היסטוריית הסטטוס של xAI כוללת, למשל, timeout ב-Grok-2 מ־15 בינואר 2025 שנמשך 3 שעות ו־10 דקות, וכן תקלה בפלט מובנה של Grok-2 שנמשכה 3 ימים ו־21 שעות.
2
3 גם היסטוריית הסטטוס של OpenAI מתעדת אירועים נפרדים שנגעו למשימות Codex, לפונקציונליות של ChatGPT ולתהליכי עבודה מבוססי API.
21
27
32
הנתונים האלה אינם בסיס הוגן לדירוג הספקיות לפי אמינות: אין כאן הגדרות אחידות של זמן השבתה, היקף החשיפה או מספר המשתמשים שנפגעו. אבל הם כן תומכים במסקנה מוגבלת וחשובה: עבור צוותים שבונים תהליכים קריטיים על שירותי AI מתארחים, תקלות הן סיכון שצריך לתכנן עבורו.
רשימת בדיקה להמשכיות עסקית
ארגונים שתלויים ב-AI בעבודה שוטפת יכולים לצמצם את היקף הפגיעה באמצעות היערכות מוקדמת:
- להעדיף ממשקים שאינם תלויי ספק, במידת האפשר, כדי שהיישום לא יהיה כבול לפורמט בקשות או לתהליך עבודה של ספקית אחת.
- להגדיר חלופות למשימות חשובות: ספקית שנייה, מודל מקומי קטן יותר, תהליך מצומצם או מסלול ידני.
- לתזמן תור וניסיונות חוזרים בצורה בטוחה עבור עבודות API שאינן דחופות, עם מגבלות שמונעות מניסיונות כושלים להחמיר את העומס.
- להבחין בין תהליך קריטי לתכונת נוחות. עוזר צ׳אט יכול להיות נחמד; תהליך שחוסם סקירת קוד, שירות לקוחות או פעולה במוצר הוא עניין אחר.
- לבדוק בפועל מעבר לחלופה ונהלי עבודה ידניים. גיבוי שמעולם לא נבחן אינו תוכנית המשכיות אמינה.
השיבושים של 3 בספטמבר היו חריגים משום שכמה משירותי ה-AI המוכרים ביותר נראו כמי שנכשלים באותו זמן. הלקח המרכזי, עם זאת, פשוט: חוסן תפעולי תלוי פחות בניסיון לנחש מתי תגיע התקלה הבאה, ויותר בווידוא שאירוע אצל ספקית אחת לא ישבית עבודה חיונית.
41