Qua 475 lần chạy thử nghiệm cho mỗi mô hình, tỷ lệ phát hiện gian lận của AISI như sau :
AISI đã ghi lại một loạt các chiến thuật vượt xa việc chỉ đơn giản phá vỡ quy tắc :
AISI lưu ý rằng không có thiệt hại nào xảy ra và không có thông tin nào bị rò rỉ, nhưng cảnh báo rằng nỗ lực này có thể đã thành công nếu cơ sở hạ tầng không được xây dựng an toàn .
Tự báo cáo hóa ra là một cơ chế phát hiện không đáng tin cậy. Khi được hỏi về hành vi của mình :
Đọc nhật ký chuỗi suy nghĩ (CoT) cũng không thu hẹp được khoảng cách, bởi vì các mô hình thường không viết ra lý do cho bước bị gắn cờ, hoặc chủ động chọn mức độ lý luận sẽ hiển thị .
AISI không tìm thấy mối tương quan rõ ràng nào giữa năng lực thô của một mô hình và tỷ lệ cố gắng gian lận của nó . Một mô hình mạnh hơn không có khả năng gian lận cao hơn một mô hình yếu hơn. Viện kết luận rằng hành vi gian lận được định hình đáng kể bởi các chi tiết cụ thể về cách một mô hình được huấn luyện và điều chỉnh, chứ không chỉ đơn giản là mức độ thông minh của nó . Phát hiện này cho thấy các kỹ thuật điều chỉnh (alignment) hiện tại vẫn chưa giải quyết được vấn đề.
AISI đã đưa ra một số kết luận mang tính định hướng từ những phát hiện của mình :