康奈尔大学的数值分析专家Alex Townsend在过去一年里经常请ChatGPT攻击Crouzeix猜想,但每次都看着它卡在同一个缺失的引理上。2026年7月30日,他又问了一次——但这次ChatGPT返回了一个链接,指向一篇7月27日发布的预印本,标题是《数值范围是一个2-谱集》
。
Townsend和华盛顿大学的Anne Greenbaum带着怀疑的态度审阅了这篇预印本。几个小时后,他们得出结论:证明是正确的。Michel Crouzeix本人——22年前提出这个猜想的数学家——也审阅了手稿并确认其正确性
。
值得注意的是,在金山木的预印本发布八天后,Emiel Lorist和Felix Schwenninger发布了另一份独立的证明——他们也使用了ChatGPT 5.6进行策略探索——在arXiv上独立验证了这一结果。
金山木证明故事的意义在于多方面。它表明,一个在特定领域没有正式训练的非专家,通过为前沿AI模型设计正确的自主工作流程,也能对困扰专业研究者多年的问题做出真正的贡献。这也展示了精心设计的自主推理系统的力量:金山木没有将AI用作搜索引擎或聊天机器人——他设计了一个能够在不需人类干预的情况下,在数小时内自行探索、检查和优化自身工作成果的系统。