北京協和醫院神經外科博士後研究員兼住院醫師金山木,沒有正規高等數學背景,透過讓 GPT 5.6 Sol 自主運算16小時,成功證明 Crouzeix 猜想——一個困擾數學界22年的開放性難題。 該證明經過康乃爾大學數值分析師 Alex Townsend、華盛頓大學 Anne Greenbaum,以及命題者本人 Michel Crouzeix 的審查與確認。
研究答案

Create a landscape editorial hero image for this Studio Global article: How did Chinese neurosurgeon Jin Shanmu use OpenAI's GPT-5.6-Sol on ChatGPT Work to solve the two-decade-old Crouzeix's conjecture — a probl. Article summary: Let me search for this specificLet me gather a few more details from the best source. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
2026年7月下旬,一個困擾數值線性代數學界長達22年的開放性問題被破解了——但破解者並非頂尖大學的終身教授,而是北京協和醫院的一位神經外科住院醫師。他設定好提示詞後便離開電腦,16小時後回來,發現GPT-5.6-Sol已經自主完成了證明。
北京協和醫學院的博士後研究員暨神經外科住院醫師金山木,利用 OpenAI 的 GPT-5.6-Sol 模型在 ChatGPT Work 平台上自主運作,成功產出了 Crouzeix 猜想的完整證明 。這個由法國數學家 Michel Crouzeix 在 2004 年提出的難題,在過去二十多年間,始終是全世界頂尖數值分析學家們的挑戰目標。
Crouzeix 猜想的核心論述是:對於任何方形的複數矩陣 A 與多項式 p,算子範數 ||p(A)|| 最多不超過 p 在 A 的數值範圍上的最大值之兩倍。在此之前,最好的逼近值是 1+√2(約 2.414),這個成果來自 2017 年美國數學研究所的一場研討會,當時即便聚集了最頂尖的專家,也未能將差距縮小到常數 2 。
這個問題橫跨矩陣理論與泛函分析,屬於數值線性代數中一個看似狹隘、卻極具基礎性的領域。二十年來,無數專家為此投入心血,卻始終無法突破。
金山木原本的目標並非創造數學史。當時他正在研究經顱超音波——模擬超音波如何穿透頭骨——這個研究引導他進入矩陣分析,進而遇到了 Crouzeix 猜想 。他的高等數學知識全部來自超音波研究過程中的自學;他的大學本科是北京大學地質學,醫學博士則來自北京協和醫學院,從未接受過正規的進階數學訓練
。
金山木借鑒了 OpenAI 先前攻克 Cycle Double Cover 猜想時使用的提示詞策略。他設計了一套多智能體、對抗性的工作流程,包含四項關鍵指令 :
金山木啟動系統後便離開。在大約16小時不間斷的運作中——GPT-5.6-Sol 經歷了數千次生成、假設檢定、推翻與重建的循環——最終產出了一份完整的證明 。
出乎專家們意料的是,這份證明並未採用預期中繁重的數學估算,而是運用一種巧妙的取樣策略,將問題簡化為一個簡單的正定性條件 。根據審閱者的說法,這是一個既優雅又出人意料的解題路徑。
康乃爾大學的數值分析師 Alex Townsend 在過去一年裡,經常嘗試請 ChatGPT 攻擊 Crouzeix 猜想,但每次都看著它在同一個遺漏的引理上卡住 。2026年7月30日,他再次提問——但這次,ChatGPT 給了他一個 7月27日發布的預印本連結,主題為「The Numerical Range Is a 2-Spectral Set」
。
Townsend 與華盛頓大學的 Anne Greenbaum 以懷疑的態度審視這份稿件。幾個小時後,他們得出結論:證明是正確的 。提出這個猜想長達22年之久的數學家 Michel Crouzeix 本人,也審閱了稿件並確認其正確性
。
金山木將整個研究流程完全開源,在 GitHub 上公開了最終論文、確切的提示詞、所有迭代稿件、Lean 4 形式化證明代碼以及公理審計報告 。
更值得注意的是,在金山的預印本發布八天後,另一組由 Emiel Lorist 和 Felix Schwenninger 進行的獨立證明也出現在 arXiv 上——他們同樣使用了 ChatGPT 5.6 進行策略探索——這項獨立成果相互印證了同一個結論 。
金山木證明故事之所以引人注目,原因有幾點。它證明了,一個在特定領域缺乏正規訓練的非專家,只要為前沿 AI 模型設計出正確的自主工作流程,就有機會對那些連職業專家都束手無策的難題做出真正的貢獻。這同時也展現了設計良好的自主推理系統的威力:金山木並非將 AI 當作搜尋工具或聊天機器人——他設計的是一套能夠獨立探索、檢查、並在數小時內持續完善自身研究成果的系統,完全不需要人類介入 。
這不是一個玩具問題或益智謎題。這是一個長達22年的開放性難題,其證明已經過命題者本人以及領域內其他頂尖專家的審查與認可 。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
北京協和醫院神經外科博士後研究員兼住院醫師金山木,沒有正規高等數學背景,透過讓 GPT 5.6 Sol 自主運算16小時,成功證明 Crouzeix 猜想——一個困擾數學界22年的開放性難題。
北京協和醫院神經外科博士後研究員兼住院醫師金山木,沒有正規高等數學背景,透過讓 GPT 5.6 Sol 自主運算16小時,成功證明 Crouzeix 猜想——一個困擾數學界22年的開放性難題。 該證明經過康乃爾大學數值分析師 Alex Townsend、華盛頓大學 Anne Greenbaum,以及命題者本人 Michel Crouzeix 的審查與確認。
金山木將研究流程完全開源,包括提示詞、論文稿件、Lean 4 形式化證明與公理審計報告。