数学界如何看待Claude在黎曼猜想上的突破?
Anthropic未公开研究版Claude在尝试证明黎曼猜想时虽未成功,但意外将黎曼ζ函数非平凡零点位于临界线的比例下界从41.6%大幅提升至67.2%,数学界对此反应复杂——既承认这是“计算范式”的重大胜利,也冷静指出这远未触及猜想的本质证明。
一、事件核心:Claude做了什么?
突破内容:Claude将黎曼ζ函数非平凡零点落在临界线上的严格比例下界,从人类维持多年的41.6%提升至67.2%,单步跨越近26个百分点。
推进对比:从1974年Levinson证明至少1/3,到2020年Pratt等推进至约41.7%,人类花了近50年仅提升约8个百分点;而Claude用一天半完成了这一跨越。
工作方式:由Anthropic非数学背景员工Jarred Sumner发起,Claude先尝试650个方案全部失败,随后自主调度约60个子智能体,执行2400余条命令、写数百个Python脚本,消耗3100万输出token,最终由2个子智能体发展出关键数学思想。
二、数学界如何看待这一突破?
承认突破的实质性:多位数论专家(如Brian Conrey、Dan Goldston)审阅了论文,证明已被写成Lean形式化验证版本,通过了机器验证。澎湃新闻等媒体认为这是“实质性数学新成果”。
明确界定突破边界:数学界反复强调,即便比例推到100%,也不等于证明黎曼猜想——因为可能存在无限多个零点但占比为0%的反例。Anthropic自身也指出,Claude所用技术不导向最终证明。
评价为“计算范式胜利”:多方观点认为,Claude并未创造新公理,而是高维空间中的系统化穷举,将人类已有的数学工具重新拼装组合,属于“暴力优雅”的体现。

三、深层意义与争议焦点
科研范式的转变:AI不再只是“算答案的工具”,而是具备了自主探索、试错、分工协作的研究能力——可以同时提假设、写代码、查文献、找反例,把“失败成本”压到极低。
理解与否的争论:核心分歧在于,AI拼出证明却未必“理解” 它为何成立,这算数学进步还是搜索能力的胜利?有观点认为,这不过是用算力填平了人类因认知惯性忽略的“捷径”。
人类直觉的不可替代性:当650次失败被算力兜底后,人类直觉和创造性在科研中的定位被重新审视——AI可替代大量试错,但定义问题、质疑公理体系的能力仍需人类。