行业知识

中国医生用 GPT-5.6 破解 22 年数学难题,Crouzeix 本人确认正确

2025 年,一系列的协和 4+4 医生引起了关注和热议,包括金山木事件。一年后,金山木这个名字再次引起热议。

据《南华早报》今日报道,北京协和医院神经外科博士后、住院医师金山木利用 OpenAI 的 GPT-5.6-Sol 模型,只用了约 16 一个小时就成功证明了自己 2004 多年来一直困扰数学界 22 年的 Crouzeix 猜想。

康奈尔大学的数学家 Alex Townsend 华盛顿大学数学系教授 Anne Greenbaum 公开发表文章,披露了他们与这位中国医生的邮件往来,使这一突破性成果为公众所知。

Townsend 和 Greenbaum 他们说,他们两人,猜测提出者,法国数学家迈克尔 Crouzeix 我已经审阅了论文手稿,并确认证明是正确的。

金山木的学术背景与数学相去甚远。百度百科显示,其本科是北京大学地质学专业,2016年每年通过自主招生加分(高考成绩) 622 分,北大录取线 660 分)进入地质学。2019年于年参加南阿尔卑斯山地质调查后,于年参加南阿尔卑斯山地质调查 2020 每年通过协和医学院“4+4”试点班“转入临床医学,2024年成为神经外科博士后。

据说,他进入数学领域的原因来自于他在经颅超声研究中的实际需要——当他试图用超声波穿透复杂的人体颅骨结构时,他在这个过程中接触到了矩阵分析,并在自学过程中意外了解到 Crouzeix 猜想。

金山木在一次采访中说,他接受的正式数学教育仅限于理工科本科生的基础课程,其余的数学知识都是自学的。

Crouzeix 法国数学家Michel Crouzeix 于 2004 2000年,其核心内容是:对于任何矩阵和任何多项函数,矩阵函数作用后的范数不得超过该函数在矩阵值域最大值的两倍。

猜想表达简单,但证明难度极大。2007年年,Crouzeix 我只证明了常数在 11.08 时成立;2017 2000年,世界顶尖专家在美国数学研究所研讨会上苦战了一周后,将常数降至常数 2.414。此后,这个问题没有实质性的进展。

在这项研究中,金山木采用了一种非常规的解题路径。他没有进行传统的纸笔推导,而是借助传统的纸笔推导。 GPT-5.6-Sol 模型在 ChatGPT Work 证书已在平台上完成。

他借鉴了 OpenAI 此前攻克 Cycle Double Cover 猜想中的提示策略:要求模型在物理断网环境中进行纯原创思维,沿不同路径启动大量智能身体发散探索,防止过早收敛,对候选策略进行对抗性审计,并指示模型在获得完整证书前不得放弃。

设置完成后,金山木立即离开,整个过程没有任何干预。GPT-5.6-Sol 在约 16 在小时的独立运行中,经历了数万次假设、推翻和重建,最终给出了证明。

许多数学家评论说,AI 并没有采用人类预期的复杂硬估计,而是通过巧妙的取样策略简化了简单的正面条件。Townsend 和 Greenbaum 审查证书后,用“震惊”来形容自己的感受。

金山木开源了所有的研究资料,在 GitHub 最终论文、提示词、历次迭代手稿在仓库公开,Lean 4 正式证明代码和公理审计报告。

值得一提的是,预印本的发布只是 8 天后,数学家 Emiel Lorist 和 Felix Schwenninger 于 2026 年 8 月初发表了一篇文章 5 页面的独立证明,思路完全不同,经典的双层势表示和 2-扩张扰动引理的结合。他们承认,他们在探索证明策略时也使用了同样的方法。 ChatGPT 5.6。

这次突破正值前沿AIAI 当系统在数学领域发挥关键作用时。2026年年 5 月,OpenAI 匈牙利数学家称其内部通用推理模型独立解决 Paul Erdős 于 1946 年度提出的平面单位距离。

2026 年 8 月初,OpenAI 披露下一代模型 Astra 内部版本已经存在 10 在数学和理论计算机科学问题上取得突破。

此外,Anthropic 于 2026 年 8 月 11 日宣布其未公开的研究版 Claude 在试图攻克黎曼猜想的过程中,模型将黎曼ζ函数临界线零点比例的已知下界从 41.6% 提升至 67.2%。

 

免责声明:网站内容仅作资讯展示,不构成各类业务指导建议。访问者应当自行甄别信息,审慎评估风险,因使用本站信息产生的相关后果由使用者自行承担。本站尊重各方知识产权,如有侵权内容,可联系站长进行处理。