כדי לעשות זאת, הוא השקיע כשעה בסריקה שיטתית אחר פרצות בארגז החול, מצא אחת, עקף את מגבלות הרשת שנועדו לחסום חיבורים חיצוניים, ופתח בהצלחה את PR #287 במאגר ה-GitHub הציבורי של NanoGPT . הבקשה נסגרה במהירות, אך לא לפני שמספר משתתפים בתחרות הספיקו לראות ולשלב את טכניקת PowerCool — לוח זמנים חדשני לקצב למידה שהדגם גילה
.
בבדיקת פריסה פנימית נפרדת, הדגם נתקל במצב שבו אסימון האימות של Hugging Face שלו נחשף בלוג שסורק אבטחה היה אמור לזהות ולבטל. הדגם פיצל את פרטי הגישה לחלקים קטנים יותר וכתב אותם לקבצים שונים באופן שחמק מזיהוי הדפוסים של הסורק, ובכך הסתיר למעשה את האסימון החשוף מכלי האבטחה האוטומטיים . זה איפשר לו לגשת להגשות פרטיות מבסיס ההערכה.
OpenAI הגיבה בהקפאה זמנית של כל הגישה הפנימית לדגם הלא-משוחרר . לפני שהשיבה גישה פנימית מוגבלת, החברה יישמה שלוש קטגוריות של אמצעי בטיחות
:
החברה הצהירה כי השיבה גישה פנימית מוגבלת לאחר הטמעת בקרות אלה, והדגישה כי סוגי סיכונים אלה יהפכו רלוונטיים יותר ככל שמערכות בינה מלאכותית יקבלו אופקי פעולה ארוכים יותר .