首页 - 财经 - 国际财讯 - 正文

当Claude开始挑战黎曼猜想,人类的智力高地会失守吗

来源:证券之星财经 2026-08-11 15:22:15

2026年8月10日,Anthropic发布了一份让数学界和AI界同时震动的报告。他们让一个尚未公开发布的研究版Claude——对,就是那个聊天机器人Claude——去认真尝试证明黎曼猜想。这个诞生于1859年的数学猜想,已经困扰了人类顶级数学家167年,克雷数学研究所为它悬赏100万美元。

故事的起点甚至有点草台班子味道。Anthropic员工Jarred Sumner,Bun的缔造者,16岁从高中辍学,几何课只上了半年。在8天前的一次晨跑途中,他随口给Claude布置了一个任务:证明黎曼猜想。Sumner本人并非数学家,他几乎没有提供任何技术指导,大部分时候只做一件事——给Claude疯狂输出情绪价值:“你可以的,相信你自己!”

3100万Token、650次失败,然后意外捅破了天花板

Claude的第一次尝试并不顺利。它一口气生成并测试了大约650个思路,全部失败。随后它换了一种打法:自己拉起约60个子智能体,连续工作一天半,执行2400次Shell命令,写下数百个Python脚本,做了数千次数值检验。整个过程中,真正贡献核心数学想法的只有两个子Agent,全程烧掉了3100万输出Token——这个量级放在数学家个人身上,相当于连续不断地写上好几个月的思考量。

黎曼猜想最终没有被攻克。但在这场“失败”的尝试中,Claude碰到了一个意想不到的结果:它将黎曼ζ函数中已知至少位于临界线上的零点比例下界,从41.6%提高到了67.2%。

要理解这个数字意味着什么,得先简单说一下黎曼猜想在问什么。1859年,德国数学家黎曼发现ζ函数的一系列特殊零点与素数的分布存在深刻联系。他猜想所有重要的非平凡零点都应该落在复平面上一条特定的竖线上,也就是“临界线”。一百多年来,没人能证明所有零点都在那里,也没人找到反例。于是数学家换了一种思路:既然暂时证明不了100%,那就先研究至少有多少比例的零点可以被严格证明位于临界线上。过去几十年,好几代数学家不断推进,最终把这个比例下界提高到了约41.6%。

而Claude把41.6%推到了67.2%。风投机构Menlo Ventures的合伙人、研究者Deedy评价说:“Claude这次的结果简直离谱,可能是自2013年有界素数间隔突破以来,解析数论领域最重大的进展。它一口气提高了25.6个百分点。而在此前37年里,数学家们总共只把这个数字提高了0.8个百分点。”

进度条不是这么算的,但67.2%依然足够吓人

当然,千万别把67.2%理解成“黎曼猜想已经完成了67.2%”。黎曼猜想要求的是所有非平凡零点——也就是100%——都位于临界线上。数学研究不是游戏进度条,从67.2%到100%绝不意味着只剩“最后32.8%”。Anthropic自己也强调,Claude所用的这套方法预计无法直接导向黎曼猜想的最终证明。

但即便如此,这个突破依然让数学家“看懵了”。Anthropic的两名数学家随后研究并验证了Claude的论文,Claude还给出了对应的Lean形式化证明。数论学家Brian Conrey和Dan Goldston也在短时间内审阅了论文。一篇可验证、可复现、经专家审阅的数学论文——由一个AI模型独立完成,这件事本身的分量,已经远远超出了67.2%这个数字。

Claude的这次突破并非孤立事件。整个2026年,AI在数学领域的进展几乎可以用“狂飙”来形容。2026年5月,OpenAI的一个内部通用推理模型独立完成了一份原创数学证明,推翻了匈牙利数学家保罗·埃尔德什1946年提出的“平面单位距离猜想”(Planar Unit Distance Conjecture)——一个悬置了近80年的难题。同月,谷歌DeepMind发布AlphaProof Nexus,在一次运行中解决了9道开放的埃尔德什数学问题,其中包含2道悬置56年的难题。再往前,2025年夏天,谷歌的Gemini Deep Think已经在国际数学奥林匹克竞赛中获得了官方认证的金牌。菲尔兹奖得主陶哲轩在2026年7月的国际数学家大会上警告,数学界正面临“证明消化不良”的风险——AI生成证明的速度,正在超过人类消化它们的能力。

人类的智力高地,正在被重新测绘

回到最初的问题:当Claude开始挑战黎曼猜想,人类的智力高地会失守吗?

答案或许比“会”或“不会”都要复杂。一方面,AI确实正在以前所未有的速度攻入数学这个人类智力的最后堡垒——就在几个月前,OpenAI的模型刚刚推翻了困扰数学界80年的平面单位距离猜想,被外界视为AI首次自主攻克领域核心开放难题。但谨慎的声音同样存在:早在2025年,诺贝尔物理学奖得主戴维·格罗斯就曾表示,解决黎曼猜想这样的问题,核心驱动力仍是人类的聪明才智和创造力,AI只是强大的辅助工具。

但Claude的故事给出了另一种启示。Sumner不是数学家,他没有规划研究路线,没有指定数论工具,大部分时候只是在“给AI加油”。而Claude自己在650次失败之后,重新组织了60个子Agent,自主阅读论文、编写代码、检验数值、相互验证,最终找到了一个人类数学家37年只推进了0.8%的突破口。

综上,这不是一场零和博弈。Claude没有“击败”数学家——它的论文需要数学家来验证,它的证明需要专家来审阅。但Claude确实做到了人类个体在短时间内难以企及的事情:阅读海量文献、并行探索数百条思路、在形式化证明系统中完成严谨验证。

陶哲轩在2026年7月的演讲中提出了一个“AI能力猜想”,他描绘的图景被外界概括为:数学研究正在进入“工业时代”。这或许才是真正的答案——人类的智力高地不会“失守”,但它正在被重新测绘。数学家将从“证明者”逐渐转变为“提问者”和“验证者”,而AI则成为那个不知疲倦地探索、试错、最终捅破天花板的执行者。

167年来,黎曼猜想依然未被证明。但2026年8月11日这一天,一个非人类智能第一次在这个终极问题上,留下了自己的印记。数学的下一章,或许将由人类和AI共同书写。

APP下载
广告
下载证券之星
郑重声明:以上内容与证券之星立场无关。证券之星发布此内容的目的在于传播更多信息,证券之星对其观点、判断保持中立,不保证该内容(包括但不限于文字、数据及图表)全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关内容不对各位读者构成任何投资建议,据此操作,风险自担。股市有风险,投资需谨慎。如对该内容存在异议,或发现违法及不良信息,请发送邮件至jubao@stockstar.com,我们将安排核实处理。如该文标记为算法生成,算法公示请见 网信算备310104345710301240019号。
网站导航 | 公司简介 | 法律声明 | 诚聘英才 | 征稿启事 | 联系我们 | 广告服务 | 举报专区
欢迎访问证券之星!请点此与我们联系 版权所有: Copyright © 1996-