新闻
首发
中国医生用GPT-5.6破解22年数学难题,Crouzeix本人确认正确
配图:中国医生用GPT-5.6破解22年数学难题,Crouzeix本人确认正确
新闻导读
中国医生用GPT-5.6破解22年数学难题,Crouzeix本人确认正确平板横屏读长文很舒服,手机竖屏扫短篇也顺手。健康类注意证据和个体差异,很少一刀切下结论,也不推销神方。愿意把内容传给家人的产品,已经过了信任门槛。广告若有也相对克制,注意力还能留给内容本身。后面会继续追专题,尤其是那些可迁移的硬核基础。信息获取负担低,却不轻飘。
IT之家 8 月 14 日消息,2025 年,一连串的协和 4+4 博士引发关注和热议,其中就包括金山木事件。时隔一年之后,金山木这个名字再次引发热议。
据《南华早报》今日报道,北京协和医院神经外科博士后、住院医师金山木利用 OpenAI 的 GPT-5.6-Sol 模型,只用了约 16 小时就成功证明了自 2004 年以来困扰数学界长达 22 年的 Crouzeix 猜想。
美国康奈尔大学数学家 Alex Townsend 与华盛顿大学数学系教授 Anne Greenbaum 公开发表文章,披露了他们与这位中国医生的邮件往来,使得这一突破性成果为公众所知。
金山木的学术背景与数学相去甚远。百度百科显示,其本科为北京大学地质学专业,2016 年通过自主招生加分(高考成绩 622 分,北大录取线 660 分)进入地质学类。2019 年参与南阿尔卑斯山地质考察后,于 2020 年通过协和医学院“4+4 试点班”转入临床医学,2024 年成为神经外科博士后。
据称,他之所以闯入数学领域,源于其在经颅超声研究中的实际需求 —— 试图用超声波穿透复杂的人体颅骨结构时,他在这一过程中接触到了矩阵分析,并在自学过程中偶然了解到 Crouzeix 猜想。
Crouzeix 猜想由法国数学家 Michel Crouzeix 于 2004 年提出,其核心内容为:对于任意矩阵和任意多项式函数,矩阵经函数作用后的范数不超过该函数在矩阵数值域上最大值的两倍。
该猜想表述简洁但证明难度极高。2007 年,Crouzeix 本人仅证明了常数在 11.08 时成立;2017 年,全球顶尖专家在美国数学研究所专题研讨会上一周苦战后,才将常数降至 2.414。此后该问题再无实质进展。
他借鉴了 OpenAI 此前攻克 Cycle Double Cover 猜想时的提示词策略:要求模型在物理断网环境下进行纯粹原创思考,启动大量智能体沿不同路径发散探索并防止过早收敛,对候选策略进行对抗性审计,并指令模型在获得完整证明前不得放弃。
金山木在设定完成后即离开,全程未进行任何干预。GPT-5.6-Sol 在约 16 小时的自主运行中,经历了数万次假设、推翻与重建,最终给出了证明。
多位数学家们评价称,AI 并未采用人类预想中的繁杂硬估计,而是通过巧妙的采样策略简化出简洁的正性条件。Townsend 和 Greenbaum 在审阅证明后以“震惊”形容自己的感受。
值得一提的是,在该预印本发布仅 8 天后,数学家 Emiel Lorist 和 Felix Schwenninger 于 2026 年 8 月初发布了一篇仅 5 页的独立证明,思路截然不同,将经典双层势表示法与 2-扩张扰动引理相结合。两人坦言在探索证明策略时同样使用了 ChatGPT 5.6。
此次突破正值前沿 AI 系统在数学领域日益发挥关键作用之际。2026 年 5 月,OpenAI 称其内部通用推理模型自主解决了匈牙利数学家 Paul Erdős 于 1946 年提出的平面单位距离问题。
此外,Anthropic 于 2026 年 8 月 11 日宣布,其未公开的研究版 Claude 模型在尝试攻克黎曼猜想过程中,将黎曼 ζ 函数临界线上零点比例的已知下界从 41.6% 提升至 67.2%。
网友观点
有些条目会区分科普简化模型和更专业的表述,这种提醒很重要。健康类注意证据和个体差异,很少一刀切下结论,也不推销神方。成熟的产品气质比花哨运营更让人心甘情愿留下。概念关系图帮助把术语放到网络里,不再孤立背词。看到靠谱内容还是想支持一下,不只是白嫖。
免责声明:本文内容来自公开报道与编辑整理,仅供参考。转载请注明出处;版权争议请联系本站核实处理。页面地址:http://fshaofeng.com.cn/?keji/20260806-7809.shtml



评论区
热门讨论 · 占位展示期待你的精彩发言。