Dr. Jin Shanmu, en postdoktor og nevrokirurg ved Peking Union Medical College Hospital uten formell avansert matematikkbakgrunn, brukte en autonom 16 timers kjøring av GPT 5.6 Sol for å produsere et bevis for Crouzeix...
Research answer

Create a landscape editorial hero image for this Studio Global article: How did Chinese neurosurgeon Jin Shanmu use OpenAI's GPT-5.6-Sol on ChatGPT Work to solve the two-decade-old Crouzeix's conjecture — a probl. Article summary: Let me search for this specificLet me gather a few more details from the best source. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
I slutten av juli 2026 ble et 22 år gammelt uløst problem innen numerisk lineær algebra løst – ikke av en fast ansatt professor ved et toppuniversitet, men av en nevrokirurg i Beijing som satte i gang en AI, forlot datamaskinen og kom tilbake 16 timer senere for å finne at GPT-5.6-Sol hadde funnet beviset på egen hånd.
Dr. Jin Shanmu, en postdoktor og nevrokirurg ved Peking Union Medical College Hospital, brukte OpenAIs GPT-5.6-Sol-modell på ChatGPT Work-plattformen til å autonomt generere et fullstendig bevis for Crouzeix' formodning . Problemet, som ble foreslått av den franske matematikeren Michel Crouzeix i 2004, hadde utfordret verdens fremste tallanalytikere i over to tiår.
Crouzeix' formodning sier at for enhver kvadratisk kompleks matrise A og et polynom p, er operatornormen ||p(A)|| høyst det dobbelte av maksimumsverdien til |p| over det numeriske området til A. Den beste tidligere grensen lå på 1+√2 (omtrent 2,414), et resultat av en workshop i 2017 ved American Institute of Mathematics der ledende spesialister ikke klarte å tette gapet til den skarpe konstanten 2 .
Problemet lå i skjæringspunktet mellom matriseteori og funksjonalanalyse i numerisk lineær algebra – et nisje, men grunnleggende spørsmål som hadde motstått to tiår med innsats fra eksperter som hadde viet karrierene sine til det.
Jin forsøkte ikke å skrive matematikkhistorie. Han forsket på transkraniell ultralyd – modellering av hvordan ultralydbølger trenger gjennom skallen – noe som førte ham inn i matriseanalyse og til slutt til Crouzeix' formodning . All hans videregående matematikk var selvstudert gjennom ultralydforskningen; han hadde en bachelorgrad i geologi fra Peking University og en medisinsk grad fra Peking Union Medical College. Han hadde ingen formell utdanning i avansert matematikk
.
Jin tilpasset promptstrategien som OpenAI hadde brukt da de løste Cycle Double Cover-formodningen. Han designet et multi-agent, konfronterende oppsett med fire instruksjoner :
Jin startet systemet og gikk bort. Etter omtrent 16 timer med kontinuerlig drift – hvor GPT-5.6-Sol utførte tusenvis av sykluser med generering, hypotesetesting, forkasting og gjenoppbygging – produserte den et fullstendig bevis .
I stedet for de tunge estimatene ekspertene hadde forventet, brukte argumentet en nøye utvalgsstrategi for å redusere problemet til en enkel positivitetstilstand . Det var, ifølge de som gjennomgikk det, en elegant og uventet tilnærming.
Tallanalytikeren Alex Townsend ved Cornell University hadde det foregående året rutinemessig bedt ChatGPT om å angripe Crouzeix' formodning, og sett den stoppe ved det samme manglende lemmaet hver eneste gang . Den 30. juli 2026 spurte han igjen – men denne gangen returnerte ChatGPT en lenke til et forhåndstrykk publisert 27. juli med tittelen "The Numerical Range Is a 2-Spectral Set"
.
Townsend og Anne Greenbaum ved University of Washington gjennomgikk forhåndstrykket med skepsis. Etter flere timer konkluderte de med at beviset var korrekt . Michel Crouzeix selv – matematikeren som hadde foreslått formodningen 22 år tidligere – gjennomgikk manuskriptet og bekreftet at det var korrekt
.
Jin åpnet koden for hele forskningspipelinen sin, og gjorde tilgjengelig på GitHub den endelige artikkelen, den eksakte prompten, alle påfølgende manuskriptrevisjoner, en Lean 4-formalisering av beviset og en aksiomrevisjon .
Bemerkelsesverdig nok, åtte dager etter at Jins forhåndstrykk dukket opp, ble et separat uavhengig bevis av Emiel Lorist og Felix Schwenninger – som også hadde brukt ChatGPT 5.6 for strategiutforskning – lagt ut på arXiv, noe som uavhengig støttet resultatet .
Historien om Jins bevis er bemerkelsesverdig av flere grunner. Den viser at en ikke-ekspert uten formell opplæring i et felt kan, ved å designe den riktige autonome arbeidsflyten for en grenseoverskridende AI-modell, gjøre et genuint bidrag til et problem som stoppet karrierespesialister. Den demonstrerer også kraften i veldesignede autonome resonneringssystemer: Jin brukte ikke AI som et søkeverktøy eller en chatbot – han designet et system som kunne utforske, sjekke og foredle sitt eget arbeid i mange timer uten menneskelig innblanding .
Problemet er ikke et leketøy eller et puslespill; det er et 22 år gammelt åpent problem hvis bevis er gjennomgått og akseptert av matematikeren som stilte det, sammen med andre ledende eksperter på feltet .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Dr. Jin Shanmu, en postdoktor og nevrokirurg ved Peking Union Medical College Hospital uten formell avansert matematikkbakgrunn, brukte en autonom 16 timers kjøring av GPT 5.6 Sol for å produsere et bevis for Crouzeix...
Dr. Jin Shanmu, en postdoktor og nevrokirurg ved Peking Union Medical College Hospital uten formell avansert matematikkbakgrunn, brukte en autonom 16 timers kjøring av GPT 5.6 Sol for å produsere et bevis for Crouzeix... Beviset ble verifisert av tallanalytikerne Alex Townsend, Anne Greenbaum og av Michel Crouzeix selv, som foreslo formodningen.
Jin åpnet koden for prompten, beviset, en Lean 4 formalisering og en revisjonsrapport.