Согласно отчёту OpenAI, результаты охватили восемь областей и включали доказательства, контрпримеры и улучшенные оценки :
OpenAI не полагалась исключительно на вывод модели. Каждый результат сопровождался формальным сертификатом доказательства Lean 4 — файлом, проверяемым компьютером, который любой читатель может самостоятельно верифицировать на ноутбуке . Lean — это ассистент доказательств, который проверяет каждый логический шаг от аксиом до заключения, выявляя пробелы, ошибки типов и несоответствия
. OpenAI опубликовала все файлы Lean публично на GitHub, и количество «sorry» в репозитории — указывающее на недоказанные шаги — равно нулю для всех десяти доказательств
.
Однако многие комментаторы отметили, что формальная верификация имеет важные ограничения: Lean может подтвердить, что формальное утверждение следует из его формальных определений, но не может гарантировать, что краткое изложение в пресс-релизе точно отражает формальную теорему, что формальные определения соответствуют задумке математического сообщества или что новизна и историческая подача результата верны . Экспертам всё ещё необходимо проверить точность формулировок, определения, редукции и неформально-формальный мост
.
OpenAI раскрыла, что общая стоимость вычислений для генерации всех десяти решений составила примерно $2000 в стоимости токенов по тарифам API Sol . Эта цифра представляет собой эквивалентную цену API только для токенов, потраченных на поиск решений — она исключает неудачные попытки, параллельные исследовательские запуски и внутренние вычислительные затраты на поиск до получения сертификата
. Для сравнения, годовая стипендия одного аспиранта-математика в ведущем университете может превышать $50 000, что делает экономическую эффективность самым поразительным аспектом объявления для многих наблюдателей
.
Сообщество математиков и исследователи ИИ высказали несколько предостережений: