وفقًا لتقرير OpenAI، امتدت النتائج عبر ثمانية مجالات وشملت براهين، أمثلة مضادة، وحدودًا عليا محسّنة :
لم تعتمد OpenAI فقط على مخرجات النموذج. كل نتيجة كانت مصحوبة بـ شهادة إثبات رسمية من Lean 4 — وهي ملف إثبات يمكن لأي قارئ التحقق منه بشكل مستقل على حاسوبه الشخصي . Lean هو مساعد إثبات (proof assistant) يفحص كل خطوة منطقية من البديهيات إلى الاستنتاج، ويكشف الثغرات والأخطاء النوعية والتناقضات
. نشرت OpenAI جميع ملفات Lean بشكل علني على GitHub، وعدد "Sorry" (الأجزاء غير المُثبتة) في المستودع هو صفر لجميع البراهين العشرة
.
لكن معلّقين متعددين أشاروا إلى أن التحقق الرسمي له حدود مهمة: يمكن لـ Lean تأكيد أن عبارة رسمية تتبع تعريفاتها الرسمية، لكنه لا يمكنه أن يشهد على أن ملخص البيان الصحفي يعكس بدقة النظرية الرسمية، أو أن التعريفات الرسمية تطابق المشكلة التي يقصدها المجتمع الرياضي، أو أن صحة الإطار التاريخي والجدة هي الصحيحة . لا يزال الخبراء بحاجة لتدقيق دقة العبارات، والتعريفات، والاختزالات، والجسر بين اللغة غير الرسمية والرسمية
.
كشفت OpenAI أن إجمالي تكلفة الحوسبة لتوليد جميع الحلول العشرة بلغت حوالي 2000 دولار كتكلفة رموز (tokens) بسعر Sol API . هذا الرقم هو سعر مماثل لواجهة API لرموز إيجاد الحلول فقط — وهو يستثني المحاولات الفاشلة، وعمليات الاستكشاف المتوازية، والقدرة الحاسوبية الداخلية التي صرفت قبل الوصول إلى الشهادة
. للمقارنة، الراتب السنوي لطالب دكتوراه واحد في الرياضيات في جامعة مرموقة قد يتجاوز 50,000 دولار، مما يجعل كفاءة التكلفة الجانب الأكثر إثارة في الإعلان للعديد من المراقبين
.
أثار المجتمع الرياضي وباحثو الذكاء الاصطناعي عدة نقاط تحذيرية: