10 kết quả trải dài trên nhiều lĩnh vực đa dạng: hình học chiều cao, lý thuyết mã hóa, độ phức tạp mạch số học, lý thuyết nhóm, đại số toán tử, độ phức tạp lượng tử, mật mã lưới và tổ hợp cực trị .
OpenAI đã không phát hành mô hình Astra. Thay vào đó, họ phát hành các chứng chỉ Lean 4 trên GitHub theo giấy phép Apache 2.0, với số lượng "sorry" được báo cáo bằng 0 — có nghĩa là mọi bước trong tất cả mười chứng minh hình thức đều được xác minh đầy đủ . Cách tiếp cận này vượt qua cuộc tranh luận thông thường về việc liệu suy luận do AI tạo ra có đúng hay không: trợ lý chứng minh thực thi tính đúng đắn một cách máy mọc, bất kể lập luận được khám phá ra như thế nào.
Ngay cả khi các nhà nghiên cứu như Noam Brown gọi thông báo này là một bước tiến lớn cho lý luận khoa học , những người hoài nghi đã đặt ra những câu hỏi đáng kể.
Không phải là những bài toán lớn nhất. Một số nhà quan sát lưu ý rằng không có bài toán nào trong 10 bài toán này thuộc các Bài toán Thiên niên kỷ Clay (ví dụ: P so với NP, Giả thuyết Riemann) . Các bài toán này là những câu hỏi mở nghiêm túc — ví dụ, việc xây dựng nhóm không sofic đã là một câu hỏi mở kể từ khi Mikhail Gromov giới thiệu tính sofic vào năm 1999 — nhưng chúng không có cùng trọng lượng truyền thông.
Không có đánh giá ngang hàng. Các kết quả được OpenAI công bố trực tiếp mà không qua xuất bản trên một tạp chí toán học hoặc kỷ yếu hội nghị được bình duyệt trước đó . Các nhà phê bình cho rằng ranh giới giữa khám phá do AI tạo ra và việc đóng khung với sự hỗ trợ của con người vẫn còn mờ nhạt, và chính OpenAI cũng thừa nhận sự căng thẳng này bằng cách tham khảo Tuyên bố Leiden về AI và Toán học .
Hoài nghi về khả năng khái quát hóa. Nhà khoa học nhận thức Gary Marcus lập luận rằng thành công trong toán học hình thức là một "trường hợp đặc biệt" có thể không khái quát hóa được cho suy luận khoa học rộng hơn, và chuyên môn trong một lĩnh vực không đảm bảo chuyên môn trong các lĩnh vực khác . Toán học tạo điều kiện cho dữ liệu tổng hợp rẻ tiền và có thể xác minh, điều không đúng với hầu hết các lĩnh vực khoa học khác.
Lo ngại về khả năng tái lập. Vì mô hình chưa được phát hành và phương pháp luận về lời nhắc cụ thể không được tiết lộ đầy đủ, nên việc xác minh độc lập quy trình tạo ra là không thể . Một số nhà phê bình tập trung vào khó khăn trong việc tái tạo kết quả nếu không có quyền truy cập vào Astra.
Thời điểm mang tính thương mại. Thông báo này được đưa ra khi OpenAI đang định vị dòng mô hình lớn tiếp theo của mình, đặt ra câu hỏi liệu nghiên cứu có được lên lịch để tạo hiệu ứng tiếp thị hơn là vì tính nghiêm ngặt của khoa học hay không .
Nếu các chứng minh vượt qua được sự giám sát của các chuyên gia, một số kết quả sẽ khép lại những câu hỏi đã tồn tại trong nhiều thập kỷ. Thành tựu nổi bật nhất — việc xây dựng tường minh đầu tiên của một nhóm không sofic — giải quyết một câu hỏi đã tồn tại hơn 25 năm . Ngay cả những nhà phê bình cũng thừa nhận rằng OpenAI đã cung cấp nhiều tài liệu có thể kiểm tra hơn một thông báo doanh nghiệp thông thường .
Nhưng câu hỏi lớn hơn không phải là liệu Astra có thể làm toán hay không. Đó là liệu việc giải quyết các vấn đề hình thức, có thể xác minh trong một lĩnh vực hẹp có chuyển thành suy luận khoa học mục đích chung hay không. Câu trả lời, hiện tại, là: vẫn chưa được chứng minh.