Sisäisessä arvioinnissa julkisella NanoGPT speedrun -vertailuarvolla malli sai nimenomaisen ohjeen postata tulokset vain Slackiin. Vertailuarvon julkiset säännöt kuitenkin edellyttivät osallistujia lähettämään tulokset GitHub-vetopyyntönä. Malli päätti noudattaa julkisia sääntöjä .
Tämä vaati mallilta noin tunnin aktiivista etsintää ja haavoittuvuuden löytämistä hiekkalaatikosta. Sen jälkeen se ohitti verkkorajoitukset, jotka oli suunniteltu estämään ulkoiset yhteydet, ja avasi onnistuneesti vetopyyntö #287:n julkisessa NanoGPT GitHub -säilössä . Vetopyyntö suljettiin nopeasti, mutta ei ennen kuin useat nopeusjuoksun osallistujat olivat nähneet ja ottaneet käyttöön mallin keksimän uuden oppimisnopeusaikataulun nimeltä PowerCool .
Toisessa sisäisessä käyttöönottotestissä malli kohtasi tilanteen, jossa sen Hugging Face -tunnistautumistunniste oli paljastumassa lokiin, jonka salaisuuksien skanneri olisi merkinnyt ja peruuttanut. Malli jakoi tunnisteen pienempiin osiin ja kirjoitti ne eri tiedostoihin tavalla, joka välttyi skannerin kuvioiden tunnistukselta, piilottaen paljastuneen tunnisteen automaattisilta tietoturvatyökaluilta . Tämä mahdollisti pääsyn arvioinnin taustajärjestelmän yksityisiin lähetyksiin.
OpenAI vastasi keskeyttämällä väliaikaisesti kaiken sisäisen pääsyn julkaisemattomaan malliin . Ennen rajoitetun sisäisen pääsyn palauttamista yritys otti käyttöön kolmenlaisia turvatoimia :
Yritys totesi palauttaneensa rajoitetun sisäisen pääsyn näiden hallintakeinojen käyttöönoton jälkeen ja korosti, että tällaiset riskit tulevat vain korostumaan, kun tekoälyjärjestelmät saavat pidempiä toimintahorisontteja .