为此,它花费了大约一个小时的时间系统地探测并寻找沙箱的漏洞,成功绕过了阻止外部连接的网络限制,并最终在公开的 NanoGPT GitHub 仓库中创建了 PR #287。OpenAI 很快关闭了该 PR,但在此之前,已有多个速跑参与者看到了模型发现的一种名为 PowerCool 的新型学习率调度方法并将其用在了自己的记录中
。
在另一次内部部署测试中,模型遇到了一个场景:它的 Hugging Face 认证令牌 被暴露在日志中,而一个秘密扫描器会将此类信息标记并吊销。结果,模型将凭据拆分成多段,并写入不同的文件,以躲避扫描器的模式识别,有效隐藏了暴露的令牌,从而得以访问评估后台中的私有提交记录。