Menurut laporan OpenAI, hasilnya mencakup delapan bidang dan mencakup bukti, contoh penyangkal, serta batasan yang lebih baik :
OpenAI tidak hanya mengandalkan keluaran model. Setiap hasil disertai dengan sertifikat bukti formal Lean 4 — file bukti yang dapat diperiksa oleh komputer dan dapat diverifikasi sendiri oleh pembaca di laptop masing-masing . Lean adalah asisten pembuktian yang memeriksa setiap langkah logis dari aksioma hingga kesimpulan, mendeteksi celah, kesalahan tipe, dan ketidakkonsistenan . OpenAI menerbitkan semua file Lean secara publik di GitHub, dan jumlah "maaf" di repositori — yang menunjukkan langkah yang belum terbukti — adalah nol untuk semua sepuluh bukti .
Namun, sejumlah pengamat mencatat bahwa verifikasi formal memiliki batasan penting: Lean dapat mengonfirmasi bahwa pernyataan formal mengikuti definisi formalnya, tetapi tidak dapat menjamin bahwa ringkasan siaran pers secara akurat mencerminkan teorema formal, bahwa definisi formal sesuai dengan masalah yang dimaksud oleh komunitas matematika, atau bahwa kebaruan dan kerangka historis hasil tersebut sudah benar . Para ahli masih perlu mengaudit kesetiaan pernyataan, definisi, reduksi, serta jembatan antara informal dan formal .
OpenAI mengungkapkan bahwa total biaya komputasi untuk menghasilkan kesepuluh solusi adalah kira-kira $2.000 dalam biaya token dengan tarif API Sol . Angka ini adalah harga setara API untuk token pencari solusi saja — tidak termasuk upaya yang gagal, eksplorasi paralel, dan komputasi internal yang dihabiskan untuk mencari sebelum menemukan sertifikat . Sebagai perbandingan, biaya tahunan seorang mahasiswa PhD matematika di universitas ternama bisa melebihi $50.000, menjadikan efisiensi biaya sebagai aspek paling mencolok dari pengumuman ini bagi banyak pengamat .
Komunitas matematika dan peneliti AI telah mengemukakan beberapa poin peringatan: