Dr. Jin Shanmu, en neurokirurgisk assistent på Peking Union Medical College Hospital, brugte en autonom 16 timers kørsel af GPT 5.6 Sol til at bevise Crouzeix's formodning – et uløst problem inden for numerisk lineær...
Research answer

Create a landscape editorial hero image for this Studio Global article: How did Chinese neurosurgeon Jin Shanmu use OpenAI's GPT-5.6-Sol on ChatGPT Work to solve the two-decade-old Crouzeix's conjecture — a probl. Article summary: Let me search for this specificLet me gather a few more details from the best source. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
I slutningen af juli 2026 faldt et 22 år gammelt åbent problem inden for numerisk lineær algebra – ikke for en fastansat professor på et topuniversitet, men for en neurokirurgisk assistent i Beijing, der indstillede en prompt, forlod sin computer og 16 timer senere vendte tilbage og fandt, at GPT-5.6-Sol på egen hånd havde fundet beviset.
Dr. Jin Shanmu, en postdoc og neurokirurgisk assistent på Peking Union Medical College Hospital, brugte OpenAIs GPT-5.6-Sol-model på ChatGPT Work-platformen til autonomt at generere et komplet bevis for Crouzeix's formodning . Problemet, som blev stillet af den franske matematiker Michel Crouzeix i 2004, havde udfordret verdens bedste numeriske analytikere i over to årtier.
Crouzeix's formodning siger, at for enhver kvadratisk kompleks matrix A og et polynomium p, er operatornormen ||p(A)|| højst det dobbelte af maksimum af |p| over det numeriske værdiområde for A. Den bedste tidligere grænse lå på 1+√2 (cirka 2,414), et resultat af en workshop i 2017 på American Institute of Mathematics, hvor førende specialister ikke kunne lukke hullet til den skarpe konstant 2 .
Problemet lå i skæringspunktet mellem matriateori og funktionel analyse inden for numerisk lineær algebra – et nichespørgsmål, der havde modstået to årtiers indsats fra eksperter, som havde viet deres karrierer til det.
Jin forsøgte ikke at skrive matematisk historie. Han forskede i transkraniel ultralyd – modellering af, hvordan ultralydsbølger trænger gennem kraniet – hvilket førte ham ind i matrixanalyse og til sidst til Crouzeix's formodning . Al hans højere matematik var selvstuderet gennem hans ultralydsforskning; hans bachelorgrad var i geologi fra Peking University, og hans medicinske grad kom fra Peking Union Medical College. Han havde ingen formel uddannelse i avanceret matematik
.
Jin tilpassede den promptstrategi, som OpenAI havde brugt, da de løste Cycle Double Cover-formodningen. Han designede en multi-agent, adversariel opsætning med fire instruktioner :
Jin startede systemet og gik væk. Efter cirka 16 timers kontinuerlig drift – hvor GPT-5.6-Sol udførte tusindvis af cyklusser med generering, hypotesetestning, afvisning og genopbygning – producerede det et komplet bevis .
I stedet for de tunge estimater, som eksperterne havde forventet, brugte argumentet en omhyggelig samplingstrategi til at reducere problemet til en simpel positivitetstilstand . Det var, ifølge dem, der gennemgik det, en elegant og uventet tilgang.
Numerisk analytiker Alex Townsend fra Cornell University havde det foregående år rutinemæssigt bedt ChatGPT om at angribe Crouzeix's formodning og set det gå i stå ved det samme manglende lemma hver gang . Den 30. juli 2026 spurgte han igen – men denne gang returnerede ChatGPT et link til et preprint postet den 27. juli med titlen "The Numerical Range Is a 2-Spectral Set"
.
Townsend og Anne Greenbaum fra University of Washington gennemgik preprintet med skepsis. Efter flere timer konkluderede de, at beviset var korrekt . Michel Crouzeix selv – matematikeren, der havde stillet formodningen 22 år tidligere – gennemgik manuskriptet og bekræftede dets korrekthed
.
Jin offentliggjorde hele sin forskningspipeline som open source og gjorde på GitHub det endelige papir, den præcise prompt, alle successiv manuskriptiterationer, en Lean 4-formalisering af beviset og en aksiomrevision tilgængelig .
Bemærkelsesværdigt nok, otte dage efter Jins preprint dukkede op, blev et separat uafhængigt bevis af Emiel Lorist og Felix Schwenninger – som også havde brugt ChatGPT 5.6 til strategiudforskning – postet på arXiv, hvilket uafhængigt bekræftede resultatet .
Historien om Jins bevis er bemærkelsesværdig af flere grunde. Den viser, at en ikke-ekspert uden formel uddannelse i et felt, ved at designe den rigtige autonome arbejdsgang for en frontlinje AI-model, kan yde et ægte bidrag til et problem, der stoppede karrierespecialister. Den demonstrerer også kraften i veldesignede autonome ræsonneringssystemer: Jin brugte ikke AI som et søgeværktøj eller en chatbot – han designede et system, der kunne udforske, kontrollere og forfine sit eget arbejde over mange timer uden menneskelig indgriben .
Problemet er ikke et legetøj eller et puslespil; det er et 22 år gammelt åbent problem, hvis bevis er blevet gennemgået og accepteret af matematikeren, der stillede det, sammen med andre førende eksperter på området .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Dr. Jin Shanmu, en neurokirurgisk assistent på Peking Union Medical College Hospital, brugte en autonom 16 timers kørsel af GPT 5.6 Sol til at bevise Crouzeix's formodning – et uløst problem inden for numerisk lineær...
Dr. Jin Shanmu, en neurokirurgisk assistent på Peking Union Medical College Hospital, brugte en autonom 16 timers kørsel af GPT 5.6 Sol til at bevise Crouzeix's formodning – et uløst problem inden for numerisk lineær... Beviset blev verificeret af de numeriske analytikere Alex Townsend (Cornell) og Anne Greenbaum (University of Washington) samt af Michel Crouzeix selv, som fremsatte formodningen i 2004.
Jin har offentliggjort hele sin forskningspipeline som open source, inklusive prompten, bevis manuskriptet, en Lean 4 formalisering og en aksiomrevisionsrapport.