Hipoteza Jacobiego, sformułowana przez Ott-Heinricha Kellera w 1939 r., jest otwartym problemem geometrii algebraicznej. Znalazła się na 16. miejscu listy problemów XXI wieku opracowanej przez zdobywcę Medalu Fieldsa Stephena Smale’a . W uproszczeniu pyta, czy wielomianowe odwzorowanie z ℂ³ do ℂ³, którego wyznacznik jakobianu jest wszędzie stałą niezerową, musi być globalnie odwracalne.
Przez 87 lat nie znaleziono ani dowodu, ani kontrprzykładu. Alpöge, pracując z modelem Claude Fable 5, wskazał odwzorowanie F = (P, Q, R): ℂ³ → ℂ³ o stałym wyznaczniku jakobianu równym −2, które wysyła trzy różne punkty wejściowe w ten sam punkt wyjściowy. To bezpośrednio obala hipotezę . Wynik sformalizowano w Lean 4, języku i systemie służącym do komputerowej weryfikacji dowodów, a matematycy — wśród nich Kevin Buzzard z Imperial College London — sprawdzili go w ciągu jednego dnia .
Zdarzenie szeroko opisywano jako najtrudniejszy problem matematyczny rozwiązany dotąd z pomocą AI . Nie oznaczało to jednak, że model działał bez udziału człowieka: kluczową rolę odgrywał matematyk, który wybrał problem, oceniał propozycje i pomógł doprowadzić wynik do postaci możliwej do sprawdzenia.
1 sierpnia 2026 r. OpenAI opublikowało materiał badawczy, w którym poinformowało, że wewnętrzna wersja Astry — określanej jako kolejny główny model firmy — uzyskała nowe wyniki dla 10 otwartych problemów z matematyki i informatyki teoretycznej. Każdy z nich pozostawał bez istotnego postępu w kluczowym wyniku przez co najmniej dekadę, a w wielu przypadkach znacznie dłużej .
OpenAI udostępniło 249-stronicowy zbiór opracowań, narracje dotyczące rozumowania modelu oraz certyfikaty dowodów w Lean 4 na GitHubie . Według firmy wygenerowanie wszystkich 10 rozwiązań kosztowało około 2000 dolarów przy stawkach API .
Lista deklarowanych wyników obejmuje:
Repozytorium OpenAI zgłaszało liczbę instrukcji „sorry” równą zero. W praktyce oznacza to, że w sformalizowanych dowodach nie pozostały nieuzupełnione kroki . Taki certyfikat nie zastępuje oceny znaczenia wyniku przez specjalistów, ale pozwala niezależnie sprawdzić, czy formalny ciąg twierdzeń jest poprawny w ramach przyjętego systemu.
W ciągu 24 godzin od ogłoszenia OpenAI Levent Alpöge poinformował w serwisie X, że użył publicznie dostępnego Claude Fable — a nie nieudostępnianej wersji modelu — do niezależnego rozwiązania pięciu z tych samych 10 problemów .
Według jego relacji:
Alpöge nie twierdził, że Fable rozwiązał wszystkie 10 problemów. Jego argument był węższy: publicznie dostępny model, przy minimalnym pokierowaniu przez człowieka, miał niezależnie odtworzyć połowę wyników przypisywanych Astrze . To podważa przedstawianie Astry jako systemu o całkowicie wyjątkowych zdolnościach, choć samo porównanie wymaga jeszcze pełnej weryfikacji metod i rezultatów .
Dokładna lista pięciu problemów, które Fable miał odtworzyć, nie została jednak publicznie przedstawiona w pełnych szczegółach . Dostępne relacje wskazują na kilka wymienionych wyżej dziedzin, ale nie potwierdzają jednoznacznego przyporządkowania wszystkich pięciu wyników .
Koszt staje się częścią rywalizacji. Kwota 2000 dolarów ma pokazywać, że generowanie nowych pomysłów matematycznych może być relatywnie tanie . Jeśli podobne systemy rzeczywiście potrafią uzyskiwać wartościowe wyniki za około 200 dolarów na problem, głównym ograniczeniem może przestać być samo odkrywanie. Więcej czasu będą wymagały weryfikacja, interpretacja i ustalenie, które rezultaty są naprawdę istotne.
Dowody możliwe do sprawdzenia maszynowego zyskują na znaczeniu. Zarówno kontrprzykład dotyczący hipotezy Jacobiego, jak i wyniki Astry zostały sformalizowane w Lean 4 . Szybka weryfikacja — liczona w godzinach lub dniach, a nie w latach — sugeruje, że certyfikaty Lean mogą stać się ważnym standardem w części badań. Nie oznacza to automatycznego końca tradycyjnych recenzji: formalny system może sprawdzić poprawność zapisanych kroków, ale nie ocenia samodzielnie oryginalności, znaczenia ani kontekstu odkrycia.
Niejasne autorstwo. Historia hipotezy Jacobiego natychmiast wywołała pytania o to, kto powinien być uznany za autora: matematyk kierujący pracą, model AI czy firma, która go stworzyła . Alpöge przypisał zasługi zarówno ludzkiemu współpracownikowi, jak i Claude Fable 5 . Czasopisma naukowe nie mają jednolitej polityki dotyczącej współautorstwa AI, a opisywane wyniki trafiły do opinii publicznej przez serwis X i GitHub, zanim przeszły pełną tradycyjną ścieżkę recenzji .
Tempo tych zmian matematycy określali jako „bardzo szybkie i dezorientujące” . Jednocześnie zarówno deklaracje OpenAI, jak i Anthropic należy traktować jako wyniki ogłoszone przez firmę lub jej badacza, które nie zakończyły jeszcze pełnego procesu recenzji naukowej . Formalne certyfikaty Lean są mocnym elementem kontroli technicznej, ale nie rozstrzygają wszystkich pytań dotyczących niezależności, autorstwa i naukowej wagi rezultatów.