Dr Jin Shanmu, rezydent neurochirurgii w pekińskim szpitalu bez formalnego wykształcenia matematycznego, użył autonomicznej sesji GPT 5.6 Sol trwającej 16 godzin do udowodnienia hipotezy Crouzeixa – problemu z dziedzi... Dowód został zweryfikowany przez analityków numerycznych Alexa Townsenda i Anne Greenbaum, a tak...
Research answer

Create a landscape editorial hero image for this Studio Global article: How did Chinese neurosurgeon Jin Shanmu use OpenAI's GPT-5.6-Sol on ChatGPT Work to solve the two-decade-old Crouzeix's conjecture — a probl. Article summary: Let me search for this specificLet me gather a few more details from the best source. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
Pod koniec lipca 2026 roku 22-letni otwarty problem numerycznej algebry liniowej został rozwiązany – nie przez profesora z renomowanego uniwersytetu, ale przez rezydenta neurochirurgii w Pekinie, który ustawił prompt, wyszedł, a po 16 godzinach odkrył, że GPT-5.6-Sol samodzielnie znalazł dowód.
Dr Jin Shanmu, postdoktorant i rezydent neurochirurgii w Szpitalu Pekińskiego Związku Medycznego (Peking Union Medical College Hospital), wykorzystał model OpenAI GPT-5.6-Sol działający na platformie ChatGPT Work, aby autonomicznie wygenerować kompletny dowód hipotezy Crouzeixa . Problem ten, postawiony przez francuskiego matematyka Michela Crouzeixa w 2004 roku, przez ponad dwie dekady stanowił wyzwanie dla najlepszych analityków numerycznych na świecie.
Hipoteza Crouzeixa mówi, że dla dowolnej kwadratowej macierzy zespolonej A i wielomianu p, norma operatorowa ||p(A)|| wynosi co najwyżej dwukrotność maksimum |p| w zakresie numerycznym A. Dotychczas najlepsze oszacowanie wynosiło 1+√2 (około 2,414) i było rezultatem warsztatów w 2017 roku w Amerykańskim Instytucie Matematyki, podczas których czołowi specjaliści nie zdołali domknąć luki do ścisłej stałej 2 .
Problem ten leżał na styku teorii macierzy i analizy funkcjonalnej w numerycznej algebrze liniowej – to niszowe, ale fundamentalne pytanie, które opierało się dwóm dekadom wysiłków ekspertów, którzy poświęcili mu swoje kariery.
Jin nie zamierzał tworzyć historii matematyki. Badał przezczaszkową ultrasonografię – modelował, jak fale ultradźwiękowe przenikają przez czaszkę – co zaprowadziło go do analizy macierzy, a ostatecznie do hipotezy Crouzeixa . Całą wyższą matematykę opanował samodzielnie podczas badań nad ultrasonografią; jego licencjat był z geologii na Uniwersytecie Pekińskim, a dyplom lekarza zdobył w Pekińskim Związku Medycznym. Nie miał formalnego wykształcenia w zaawansowanej matematyce
.
Jin zaadaptował strategię promptu, której OpenAI użyło przy rozwiązywaniu hipotezy cyklu podwójnego pokrycia. Zaprojektował wieloagentowy, adwersarialny system z czterema instrukcjami :
Jin uruchomił system i odszedł. Po około 16 godzinach ciągłej pracy – podczas których GPT-5.6-Sol wykonał tysiące cykli generowania, testowania hipotez, odrzucania i odbudowywania – powstał kompletny dowód .
Zamiast ciężkich oszacowań, jakich spodziewali się eksperci, argumentacja opierała się na starannej strategii próbkowania, sprowadzającej problem do prostego warunku dodatniości . Było to, według opinii recenzentów, eleganckie i nieoczekiwane podejście.
Analityk numeryczny Alex Townsend z Cornell University przez poprzedni rok regularnie prosił ChatGPT o atakowanie hipotezy Crouzeixa, za każdym razem obserwując, jak utyka na tym samym brakującym lemacie . 30 lipca 2026 roku zapytał ponownie – ale tym razem ChatGPT zwrócił link do preprintu opublikowanego 27 lipca, zatytułowanego „The Numerical Range Is a 2-Spectral Set”
.
Townsend i Anne Greenbaum z University of Washington przejrzeli preprint ze sceptycyzmem. Po kilku godzinach uznali, że dowód jest poprawny . Sam Michel Crouzeix – matematyk, który 22 lata wcześniej postawił hipotezę – przejrzał manuskrypt i potwierdził jego poprawność
.
Jin opublikował cały swój proces badawczy jako open source, udostępniając na GitHubie końcową pracę, dokładny prompt, wszystkie kolejne iteracje manuskryptu, formalizację dowodu w języku Lean 4 oraz audyt aksjomatów .
Co niezwykłe, osiem dni po publikacji preprintu Jina, na arXiv pojawił się oddzielny, niezależny dowód autorstwa Emiela Lorista i Felixa Schwenningera – którzy również używali ChatGPT 5.6 do eksploracji strategii – niezależnie potwierdzając wynik .
Historia dowodu Jina jest godna uwagi z kilku powodów. Pokazuje, że osoba niebędąca ekspertem, bez formalnego wykształcenia w danej dziedzinie, może, projektując odpowiedni autonomiczny workflow dla zaawansowanego modelu AI, wnieść rzeczywisty wkład w rozwiązanie problemu, który przez lata stawiał opór zawodowym specjalistom. Pokazuje również moc dobrze zaprojektowanych autonomicznych systemów rozumowania: Jin nie używał AI jako narzędzia wyszukiwania czy czatu – zaprojektował system, który mógł eksplorować, sprawdzać i udoskonalać własną pracę przez wiele godzin bez ingerencji człowieka .
Problem ten nie jest zabawką ani łamigłówką; to 22-letni otwarty problem, którego dowód został zweryfikowany i zaakceptowany przez matematyka, który go postawił, oraz przez innych czołowych ekspertów w tej dziedzinie .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Dr Jin Shanmu, rezydent neurochirurgii w pekińskim szpitalu bez formalnego wykształcenia matematycznego, użył autonomicznej sesji GPT 5.6 Sol trwającej 16 godzin do udowodnienia hipotezy Crouzeixa – problemu z dziedzi...
Dr Jin Shanmu, rezydent neurochirurgii w pekińskim szpitalu bez formalnego wykształcenia matematycznego, użył autonomicznej sesji GPT 5.6 Sol trwającej 16 godzin do udowodnienia hipotezy Crouzeixa – problemu z dziedzi... Dowód został zweryfikowany przez analityków numerycznych Alexa Townsenda i Anne Greenbaum, a także przez samego Michela Crouzeixa, który postawił hipotezę w 2004 roku.
Jin opublikował cały proces badawczy jako open source, w tym prompt, manuskrypt dowodu, formalizację w Lean 4 oraz audyt aksjomatów.