19 Temmuz 2026’da İspanya ile Arjantin’in Dünya Kupası finalini oynadığı sırada Alpöge, X’te yalnızca “the jacobian conjecture is false” ifadesini paylaştı . Mesaja 216 karakterlik tek bir polinom dönüşümü eşlik ediyordu .
Ott-Heinrich Keller tarafından 1939’da ortaya atılan Jacobian varsayımı, cebirsel geometrideki en uzun soluklu açık problemlerden biriydi. Ayrıca Fields Madalyası sahibi Stephen Smale’ın 21. yüzyıl problemleri listesinde 16. sırada yer alıyordu . Basitleştirmek gerekirse soru şuydu: (\mathbb{C}^3)’ten (\mathbb{C}^3)’e giden bir polinom dönüşümünün Jacobian determinantı her yerde sıfırdan farklı ve sabitse, bu dönüşüm mutlaka küresel olarak tersinir midir?
Alpöge, Anthropic’in Claude Fable 5 modeliyle birlikte, Jacobian determinantı sabit olarak −2 olan bir dönüşüm buldu. Bu dönüşüm, birbirinden farklı üç girdiyi aynı çıktıya gönderiyordu. Böylece varsayımın temel beklentisi doğrudan boşa çıkıyordu . Sonuç Lean 4’te biçimselleştirildi ve aralarında Imperial College London’dan Kevin Buzzard’ın da bulunduğu matematikçiler tarafından bir gün içinde kontrol edildi . Gelişme, yapay zekânın yardımıyla çözülen en zor matematik problemi olarak nitelendirildi .
Bu olay, yapay zekânın yalnızca hesap yapan veya literatürü özetleyen bir yardımcı değil, yeni bir matematiksel fikir üretebilen bir araştırma ortağı olup olamayacağı sorusunu gündemin merkezine taşıdı.
OpenAI, 1 Ağustos 2026’da yayımladığı araştırma yazısında, “bir sonraki büyük model” olarak tanımladığı Astra’nın şirket içi bir sürümünün 10 açık problem için yeni sonuçlar ürettiğini açıkladı . Bu problemlerin tamamında en az 10 yıldır ana sonuca yönelik çok az ilerleme kaydedildiği veya hiç ilerleme olmadığı belirtildi .
Şirket, 249 sayfalık bir el yazmasıyla birlikte kanıtları GitHub’da yayımladı. Her sonuç için makine tarafından kontrol edilebilen Lean 4 sertifikaları da paylaşıldı . OpenAI’nin API fiyatlarına göre yaptığı hesaplamada, 10 çözümün üretilmesi için gereken toplam işlem maliyeti yaklaşık 2.000 dolardı .
Astra’ya atfedilen 10 sonuç şöyle sıralandı:
GitHub deposunda “sorry” sayısının sıfır olduğu bildirildi. Lean terminolojisinde bu, biçimselleştirilen 10 kanıtın hiçbir adımında doğrulanmamış bir boşluk bırakılmadığı anlamına geliyor . Bununla birlikte makine tarafından doğrulanabilir olmak, sonuçların matematik topluluğu tarafından yorumlanması ve bağımsız biçimde değerlendirilmesi gereğini ortadan kaldırmıyor.
OpenAI’nin duyurusundan sonraki 24 saat içinde Anthropic araştırmacısı Alpöge, kamuya açık Claude Fable modelini kullanarak aynı 10 problemin beşini bağımsız olarak çözdüğünü açıkladı . Burada söz konusu olan henüz yayımlanmamış özel bir model değil, kullanıcıların erişebildiği bir sistemdi.
Alpöge’nin aktardığı yönteme göre:
Alpöge, Claude Fable’ın 10 problemin tamamını çözdüğünü söylemedi. İddiası, kamuya açık bir modelin Astra’nın sonuçlarının önemli bir bölümünü çok az insan yönlendirmesiyle yeniden üretebildiği yönündeydi . Bu da Astra’nın rakipsiz veya benzersiz bir yeteneğe sahip olduğu izlenimine meydan okudu .
Ancak beş problemin hangileri olduğu kamuya açık raporlarda tam olarak eşleştirilmiş değil. Alanlar hakkında genel bilgiler bulunsa da kesin liste henüz doğrulanmış değil .
OpenAI’nin öne çıkardığı yaklaşık 2.000 dolarlık rakam, bilimsel keşifte maliyet verimliliğini de bir rekabet alanına dönüştürüyor . Eğer yapay zekâ sistemleri gerçekten yeni matematiksel sonuçları problem başına yaklaşık 200 dolarlık işlem maliyetiyle üretebiliyorsa, darboğaz yalnızca keşif olmaktan çıkıp doğrulama, açıklama ve sonuçların hangi bağlamda önemli olduğunun anlaşılmasına kayabilir.
Yine de bu rakam yalnızca token ve API maliyetine ilişkin bir hesap. Modelin geliştirilmesi, veri merkezlerinin işletilmesi, insan araştırmacıların çalışması, kanıtların düzenlenmesi ve bağımsız değerlendirme gibi toplam maliyetleri kapsamıyor olabilir. Bu nedenle “10 büyük keşif 2.000 dolara mal oldu” ifadesi, sistemin tüm araştırma maliyeti olarak okunmamalı.
Hem Jacobian sonucu hem de Astra’nın açıkladığı çalışmalar Lean 4 ile biçimselleştirildi . Lean, matematiksel bir argümandaki adımların bilgisayarın denetleyebileceği biçimde açıkça yazılmasını sağlayan bir programlama dili ve kanıt yardımcısıdır.
Bu yaklaşım, doğrulama süresini yıllardan saatlere veya günlere indirebilir. Belirli türdeki matematiksel sonuçlarda Lean sertifikaları, geleneksel hakem değerlendirmesine ek olarak hatta ondan önce başvurulan bir güven katmanı hâline gelebilir . Ancak sertifika, sonucun matematiksel önemini tek başına belirlemez; hangi sorunun çözüldüğü, yöntemin ne kadar yeni olduğu ve sonucun alan için ne ifade ettiği hâlâ uzmanların yorumunu gerektirir.
Jacobian varsayımı örneği, akademik yazarlık konusunda da yeni sorular doğurdu. Sonucun yazarı, modele doğru soruyu yönelten matematikçi mi, modeli geliştiren şirket mi, yoksa modelin kendisi mi?
Alpöge, X paylaşımında hem insan çalışma arkadaşına hem de Claude Fable 5’e teşekkür etti . Fakat akademik dergilerin yapay zekâyı ortak yazar olarak kabul etmesine ilişkin ortak bir standart bulunmuyor. Bu sonuçların sosyal medya ve GitHub üzerinden duyurulması da geleneksel yayın sürecinin nasıl değişebileceğini gösteriyor .
Matematikçilerin gelişmeleri “çok hızlı ve baş döndürücü” olarak tanımladığı aktarılıyor . Gerçekten de iki hafta içinde önce 87 yıllık bir varsayımın karşı örnekle çürütüldüğü, ardından bir yapay zekâ modelinin 10 uzun soluklu probleme ilişkin sonuç açıkladığı ve rakip bir modelin bunların beşini yeniden ürettiği bir tablo ortaya çıktı.
Buna rağmen haberlerin dili ile akademik kesinlik aynı şey değil. Astra’nın 10 sonucu ve Claude Fable’ın beş sonucu şirket ve araştırmacı açıklamalarına dayanıyor; kapsamlı bağımsız hakem değerlendirmesi henüz tamamlanmış değil. Lean ile doğrulanan kanıtlar güçlü bir teknik güvence sağlasa da sonuçların nihai kabulü, bağımsız matematikçilerin incelemesine ve zaman içinde yapılacak yayınlara bağlı.
Bu nedenle 2026’daki yarışın asıl mesajı, yapay zekânın matematikçilerin yerini aldığı değil; yeni fikir üretimi, biçimsel doğrulama ve akademik yazarlık süreçlerini aynı anda yeniden şekillendirmeye başladığı yönünde.