Association for Human Mathematics (AHM) vyzvala matematiky, aby ukončili spolupráci s OpenAI. Reagovala tak na zveřejnění rozsáhlé sbírky matematických rukopisů, které firma představila 6. října 2026. Její výhrada nespočívá jen v tom, že některé důkazy mohou obsahovat chyby: podle AHM hromadné zveřejnění výsledků vytvořených firemním modelem nenahrazuje důkladnou kontrolu, dokumentaci ani vědeckou diskusi.
45
46
Sbírka může obsahovat zajímavé výsledky. Samotný počet rukopisů, podpůrné důkazní soubory ani ambiciózní tvrzení ale ještě nejsou potvrzením jejich správnosti. Spor se vede také o to, kdo má k modelu přístup, jak mohou ostatní výsledky prověřit a kdo odvede práci potřebnou k jejich ověření.
Co OpenAI zveřejnila
Původní oznámení mluvilo o 722 rukopisech ze 17 oblastí matematiky, seskupených do 372 rodin souvisejících výsledků. Nejde tedy o 722 samostatných a nezávislých objevů. Veřejné úložiště obsahuje rukopisy i podpůrné důkazní materiály a je dostupné pod licencí Apache-2.0.
7
15
OpenAI uvedla, že model vyzkoušel přibližně 4 000 problémů a průměrný výpočetní čas na jeden výsledek odpovídal zhruba třem hodinám režimu ChatGPT Pro Thinking. Firma zveřejnila také deset zkrácených shrnutí uvažování modelu a formalizace některých důkazů v systému Lean.
7
12
16 Podle úložiště jsou výsledky v různých fázích ověřování a ne všechny mají formalizaci v Lean. Aktuální katalog navíc uvádí 719 rukopisů, nikoli 722 z původního oznámení.
10
11
Mezi výsledky jsou tvrzení týkající se mimo jiné Mahlerových domněnek a přesného exponentu iracionality čísla π. Nelze je však považovat za definitivně potvrzená jen proto, že vyšla jako rukopisy.
5
21
Proč AHM protestuje
AHM ve svém prohlášení uvedla, že matematici „o tuto práci nežádali“, a zveřejnění stovek souborů označila za „demonstraci síly“, nikoli za vědeckou práci. Vyzvala ke skepsi a k výzkumu zaměřenému na lidi, namísto rychlého přijímání nebo hromadného zpracovávání firemních výstupů.
45
46
Praktickým problémem je rozsah materiálu. Odborníci musí rukopisy přečíst, zkontrolovat jejich argumenty a porovnat výsledky s dosavadní literaturou. Veřejně přístupné soubory dávají komunitě co zkoumat, ale tuto práci neodstraňují — do značné míry ji přesouvají na výzkumníky.
AHM svou kritiku spojila také s doporučením poradní skupiny Advisory Group on Mathematics and Artificial Intelligence. Ta vznikla, aby firmám zabývajícím se AI radila, jak přistupovat k matematickému výzkumu a jeho komunitě. Podle prohlášení AHM skupina varovala před tím, aby firmy testovaly pokročilé matematické problémy na interních modelech.
45
48
Co ověřují důkazy v Lean — a co ne
Formalizace v Lean jsou užitečným nástrojem: umožňují počítačově zkontrolovat důkazy, které byly do systému skutečně převedeny. OpenAI uvádí, že hlavní tvrzení ve 162 rukopisech formalizovala.
5 To posiluje kontrolu těchto konkrétních výsledků, automaticky to však nepotvrzuje každé tvrzení ve všech rukopisech.
Tam, kde formalizace chybí, závisí posouzení na tom, zda odborníci přečtou a prověří samotný argument. Úložiště samo upozorňuje, že výsledky jsou v různých fázích ověřování a že ne všechny mají formalizaci v Lean.
10
11 Rozumné je proto posuzovat jednotlivé výsledky zvlášť — ne označit celou sbírku za prokázanou, ani ji rovnou odmítnout jako bezcennou.
Více informací o postupu, ale ne úplná transparentnost
Údaje o přibližně 4 000 vyzkoušených problémech a výpočetním čase spolu s deseti shrnutími uvažování modelu poskytují alespoň částečný pohled na postup tvorby výsledků.
7
12
16 Neodhalují ale úplnou historii vzniku každého z nich. Samotný model navíc zůstává interní a není dostupný pro nezávislé zkoumání.
7
11
Ani celkový počet zadaných problémů sám o sobě neříká, jak často model uspěl na jasně vymezené sadě nejtěžších otevřených problémů. K posouzení jeho výkonu a reprodukovatelnosti potřebují výzkumníci podrobnější informace o metodě a o tom, jak jednotlivé výsledky vznikaly.
OpenAI oznámila, že plánuje workshopy a konference, na nichž se budou důležité výsledky zkoumat.
7 Takové akce mohou kontrolu usnadnit, nenahradí však dostatečné zveřejnění podkladů, které by ostatním umožnilo nezávisle posoudit, jak důkazy vznikly.
Co spor říká o lidském matematickém výzkumu
Jednoduchá odpověď neexistuje. Sbírka argumentů vytvořených AI může obsahovat skutečný matematický pokrok. Její přínos ale určí výsledky, které obstojí při nezávislé kontrole — nikoli počet souborů ani význam problémů, jimiž se zabývá.
7
10
Reakce AHM zároveň otevírá otázky, jak spravedlivě uznávat dřívější práci matematiků, kdo ponese náklady na posuzování nových výsledků a zda se kvůli AI nezmění priority nebo podpora lidského výzkumu. Samotné zveřejnění rukopisů na tyto otázky neodpovídá; činí je naléhavějšími.
45
46
Podstatné je rozlišovat mezi schopností vytvořit velké množství matematických tvrzení a jejich vědeckým potvrzením. Spor se týká obojího: toho, čím může AI matematice přispět, i pravidel, která zajistí, že tento přínos bude kontrolovatelný, transparentní a smysluplný pro výzkumnou komunitu.