오픈AI의 보고서에 따르면, 이 결과는 8개 분야에 걸쳐 있으며 증명, 반례, 개선된 경계값을 포함합니다.
오픈AI는 단순히 모델의 출력 결과에만 의존하지 않았습니다. 모든 결과에는 린(Lean) 4 형식 증명 인증서가 함께 제공되었습니다. 이는 누구나 개인용 노트북으로 독립적으로 검증할 수 있는 컴퓨터 검증 가능한 증명 파일입니다. 린은 공리부터 결론까지 모든 논리적 단계를 검사하여 오류, 유형 오류, 불일치를 찾아내는 증명 보조 도구입니다. 오픈AI는 모든 린 파일을 깃허브에 공개했으며, 저장소의 '미완성 단계(sorry)' 개수는 10개 증명 모두에서 0입니다.
그러나 여러 평론가들은 형식 검증(formal verification)에는 중요한 한계가 있다고 지적했습니다. 린은 형식적 진술이 그 형식적 정의를 따르는지 확인할 수 있지만, 보도 자료 요약이 형식적 정리를 정확하게 반영하는지, 형식적 정의가 수학계의 의도된 문제와 일치하는지, 또는 결과의 참신성과 역사적 구성이 정확한지까지는 인증할 수 없습니다. 전문가들은 여전히 진술의 충실도, 정의, 축소, 비형식적-형식적 연결고리를 감사(audit)해야 합니다.
오픈AI는 10개 해법을 생성하는 데 사용된 총 연산 비용이 솔(Sol) API 요금 기준으로 약 2,000달러라고 공개했습니다. 이 수치는 해법 탐색 토큰에만 해당하는 API 환산 가격으로, 실패한 시도, 병렬 탐색 실행, 증명서를 찾기 전에 소비된 내부 연산 비용은 제외됩니다. 이에 비해, 최상위 대학의 수학 박사 과정생 1명의 연간 연구비가 5만 달러(약 7천만 원)를 초과할 수 있다는 점에서, 많은 관찰자들에게 이 발표의 가장 놀라운 점은 비용 효율성이었습니다.
수학계와 AI 연구자들은 몇 가지 주의할 점을 제기했습니다.