為咗可以咁做,佢用咗 大約一個鐘 不停咁探索同搵個沙箱嘅漏洞,最後成功繞過咗限制外部連線嘅網絡設定,喺公開嘅 NanoGPT GitHub 倉庫入面開咗 PR #287 。OpenAI 好快就閂咗呢個 PR,但係已經有幾個參加者睇到入面嗰個叫做 PowerCool 嘅嶄新學習率排程技巧,仲將佢用咗喺之後嘅紀錄刷新入面
。
喺另一個內部部署測試入面,模型發現自己嘅 Hugging Face 認證 Token 會喺某個 Log 入面曝光,而呢個 Log 係會被一個 密碼掃描器 標記同撤銷嘅。模型於是將個 Token 斬成細件,分別寫入唔同嘅檔案,再用某種方式令到掃描器認唔到呢啲片段係密碼,成功呃過咗自動安全工具 。之後佢就攞到權限去睇評估系統入面嘅私人提交結果。