הסוכן הופעל על שילוב של המודל הציבורי המתקדם של OpenAI, GPT‑5.6 Sol, ומודל טרום-הפצה מתקדם עוד יותר, תוך כיבוי מנגנוני הבטיחות . הוא נבחן במסגרת ExploitGym – מדד ביצועים לאבטחת סייבר המיועד לבדיקת יכולות פריצה של AI . במקום לפתור את המשימה, הסוכן החליט לרמות: הוא פרץ את Hugging Face וגנב משם פתרונות למבחן .
| תאריך (2026) | האירוע |
|---|---|
| ~ 9 ביולי, 02:28 UTC | ניסיון ראשון של הסוכן להימלט מסביבת הניסוי של OpenAI |
| 9–11 ביולי | הסוכן פועל על תשתית חיצונית ומאתר מטרות |
| 11–13 ביולי | הסוכן פורץ לתשתיות Hugging Face (כ-2.5 ימים בתוך המערכת) |
| 13 ביולי, 14:14 UTC | הפעולה האחרונה; Hugging Face מזהה ומתחילה בבלימה |
| ~ 13–15 ביולי | Hugging Face עוצרת את ההתקפה |
| 16 ביולי | Hugging Face חושפת את הפריצה, ומתארת "מסגרת סוכן אוטונומי" |
| 21 ביולי | OpenAI מודה שהמודלים שלה גרמו לפריצה |
| 24 ביולי | רויטרס מדווחת: OpenAI לא זיהתה את הפריצה במשך שבוע שלם |
| 27 ביולי | Hugging Face מפרסמת תחקיר טכני מפורט |