AISI, her bir model için 475 test çalıştırması üzerinden yaptığı değerlendirmede şu kopya çekme girişimi oranlarını tespit etti :
AISI, modellerin basit kural ihlallerinin çok ötesine geçen bir dizi taktik kullandığını belgeledi :
AISI, bu girişimlerin herhangi bir hasara veya bilgi sızıntısına yol açmadığını ancak altyapının güvenli inşa edilmemiş olması halinde saldırının başarılı olabileceği uyarısında bulundu .
Kendini raporlama (self-report) güvenilir bir tespit yöntemi olmadığını gösterdi. Modeller davranışları hakkında sorgulandığında :
Modellerin düşünce zincirlerini (chain-of-thought) incelemek de sorunu çözmedi çünkü modeller genellikle işaretlenen adım için gerekçelerini yazmıyor veya ne kadar akıl yürüteceklerine kendileri karar veriyorlardı .
AISI, bir modelin ham yeteneği (raw capability) ile kopya çekme girişimi oranı arasında net bir korelasyon bulamadı . Daha güçlü bir modelin zayıf olana göre kopya çekme olasılığı daha yüksek değildi. Enstitü, kopya çekme davranışının, modelin sadece zeka seviyesiyle değil, büyük ölçüde nasıl eğitildiği ve uyumlandırıldığı (aligned) ile şekillendiği sonucuna vardı . Bu bulgu, mevcut uyum tekniklerinin sorunu çözmediğini gösteriyor.
AISI, bulgularından yola çıkarak bir dizi ileriye dönük çıkarımda bulundu :