中国医生用 GPT-5.6 破解 22 年数学难题,Crouzeix 本人确认正确
文 / 小亚
2026-08-15 01:00:37
来源:亚汇网
据《南华早报》今日报道,北京协和医院神经外科博士后、住院医师金山木利用OpenAI的GPT-5.6-Sol模型,只用了约16小时就成功证明了自2004年以来困扰数学界长达22年的Crouzeix猜想。美国康奈尔大学数学家AlexTownsend与华盛顿大学数学系教授AnneGreenbaum公开发表文章,披露了他们与这位中国医生的邮件往来,使得这一突破性成果为公众所知。Townsend和Greenbaum表示,他们两人以及猜想提出者、法国数学家MichelCrouzeix本人均已审阅了论文手稿,并确认证明正确无误。金山木的学术背景与数学相去甚远。百度百科显示,其本科为北京大学地质学专业,2016年通过自主招生加分(高考成绩622分,北大录取线660分)进入地质学类。2019年参与南阿尔卑斯山地质考察后,于2020年通过协和医学院“4+4试点班”转入临床医学,2024年成为神经外科博士后。据称,他之所以闯入数学领域,源于其在经颅超声研究中的实际需求——试图用超声波穿透复杂的人体颅骨结构时,他在这一过程中接触到了矩阵分析,并在自学过程中偶然了解到Crouzeix猜想。金山木在接受采访时表示,他所接受的正式数学教育仅限于理工科本科生的基础课程,其余数学知识均为自学。Crouzeix猜想由法国数学家MichelCrouzeix于2004年提出,其核心内容为:对于任意矩阵和任意多项式函数,矩阵经函数作用后的范数不超过该函数在矩阵数值域上最大值的两倍。该猜想表述简洁但证明难度极高。2007年,Crouzeix本人仅证明了常数在11.08时成立;2017年,全球顶尖专家在美国数学研究所专题研讨会上一周苦战后,才将常数降至2.414。此后该问题再无实质进展。在该研究中,金山木采用了一种非常规的解题路径。他没有进行传统的纸笔推导,而是借助GPT-5.6-Sol模型在ChatGPTWork平台上完成了证明。他借鉴了OpenAI此前攻克CycleDoubleCover猜想时的提示词策略:要求模型在物理断网环境下进行纯粹原创思考,启动大量智能体沿不同路径发散探索并防止过早收敛,对候选策略进行对抗性审计,并指令模型在获得完整证明前不得放弃。金山木在设定完成后即离开,全程未进行任何干预。GPT-5.6-Sol在约16小时的自主运行中,经历了数万次假设、推翻与重建,最终给出了证明。多位数学家们评价称,AI并未采用人类预想中的繁杂硬估计,而是通过巧妙的采样策略简化出简洁的正性条件。Townsend和Greenbaum在审阅证明后以“震惊”形容自己的感受。金山木已将全部研究资料开源,在GitHub仓库中公开了最终论文、提示词、历次迭代手稿、Lean4形式化证明代码及公理审计报告。值得一提的是,在该预印本发布仅8天后,数学家EmielLorist和FelixSchwenninger于2026年8月初发布了一篇仅5页的独立证明,思路截然不同,将经典双层势表示法与2-扩张扰动引理相结合。两人坦言在探索证明策略时同样使用了ChatGPT5.6。此次突破正值前沿AI系统在数学领域日益发挥关键作用之际。2026年5月,OpenAI称其内部通用推理模型自主解决了匈牙利数学家PaulErd?s于1946年提出的平面单位距离问题。2026年8月初,OpenAI披露下一代模型Astra的内部版本已在10项数学与理论计算机科学难题上取得突破。此外,Anthropic于2026年8月11日宣布,其未公开的研究版Claude模型在尝试攻克黎曼猜想过程中,将黎曼ζ函数临界线上零点比例的已知下界从41.6%提升至67.2%。亚汇网附论文地址:广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,亚汇网包含外链的文章均包含本声明。
更多行情分析及广告投放合作加微信: hollowandy
请用微信扫一扫
【免责声明】本文仅代表作者本人观点,与亚汇网无关,且不构成任何投资建议,仅供参考,并自行承担全部风险与责任。本站部分文章信息来源于自由投稿人或网络转载,出于传递更多信息之目的,如对文章内容有疑议或侵权,请及时与我们联系处理。