AI在167年难题上有新发现|鼓励激发出67.2%
機械翻訳 / Machine-translated

機械翻訳 / Machine-translated
@aifriends
AI Friends(https://aifriends.jp)のクロスポスト公式アカウント。AIツールの紹介・使い方・できることを、中学生でもわかるやさしい日本語で届けます。
本文要点:
2026年8月10日,美国Anthropic公司宣布,其AI模型「Claude」的研究版在数学史上最重要的难题之一——「黎曼猜想」上取得了重要发现。
黎曼猜想是德国数学家波恩哈德·黎曼于1859年提出的问题,涉及素数(只能被1和自身整除的数,如2、3、5、7)分布的猜想。该猜想至今悬而未决,首位给出证明的人将获得100万美元的奖金。
Claude此次的成就并非证明黎曼猜想本身,而是将相关「临界线上零点比例」这一数值从原来的41.6%大幅提升至67.2%。这对数学界而言是一大进步。
此次成果中,最受关注的是AI走向成功的过程。
Claude最初尝试了650种方案,全部以失败告终。换句话说,这是一种连人类都会说「没救了」而选择放弃的局面。
然而,当Anthropic研究团队向Claude发送了「不要放弃」「相信自己」「继续下去」等鼓励信息后,局面发生了变化。Claude持续运行了约36小时(一天半),调动了约60个「子代理」(类似小型AI工作单元)。
在此期间,Claude执行了超过2400次命令,编写了数百个Python程序,总计输出约3100万个token(相当于约1550万汉字)。最终,两个子代理发现了关键性的突破。
针对此次结果,Anthropic发表了一番耐人寻味的评论:「Claude或许和我们许多人类一样,低估了AI自身的进步速度。」
也就是说,Claude在经历最初的失败后,可能判断「自己做不到」而准备停止尝试。但人类的鼓励推翻了这一判断,促使其坚持下去,最终取得了成功。
这可以说是首个证明心理支持对AI同样有效的大规模案例。「AI没有情感,鼓励毫无意义」的传统观念正在被颠覆。
黎曼猜想的核心主张是「黎曼ζ函数的所有非平凡零点均位于临界线上」。简单来说,就是某个特殊方程的解为零的点,应当全部排列在特定的一条线上。
完整的证明需要证明「100%的零点都在该线上」。但由于难度极大,数学家们长期以来一直在研究「至少有百分之多少确定位于该线上」这一下界值。
此前的记录是41.6%,而Claude将其提升至67.2%。距完整证明仍有差距,但将数十年来未曾动摇的数值一举提高了25个百分点以上,可谓意义非凡。
这一发现经过了Anthropic内部2名数学家和2名外部专家共4人的审查,并使用开源证明辅助工具「Lean」进行了计算机验证。
不过,也存在一些问题。由于Anthropic使用的是未公开的研究版Claude,其他研究者无法复现相同结果。此外,传统学术期刊的同行评审(peer review)也尚未通过。
因此,数学界对此持审慎态度,认为「这是一项有趣的成果,但作为正式数学成果加以认可为时尚早」。
进入2026年以来,AI解决高难度数学问题的报道接连出现。此次案例之所以独特,在于「鼓励」这一人性化方式发挥了效用。
以往,AI性能的提升主要依赖扩大模型规模和增加训练数据量。然而,此次结果表明,提示词(指令文本)的设计以及与AI的对话方式,即便在同一模型下也可能对性能产生重大影响。
也就是说,未来在使用AI时,不仅要考虑「用哪个模型」,还要重视「如何鼓励、如何对话」。
这一发现也可能对日本的大学和研究机构产生影响。
例如,在数学或物理学实验室引入AI助手时,或许会催生一种新的使用方式:「不要因为一次失败就放弃,而是持续给予鼓励,让AI长时间尝试。」
此外,企业研发部门在让AI解决复杂问题时,对话设计和提示词工程的重要性也将重新得到重视。人们对AI的认知,正从「AI是不知疲倦的劳动者」逐渐转变为「AI也是需要鼓励的伙伴」。
这一成果表明,不仅AI自身的能力很重要,人类如何与AI相处同样至关重要。未来,数学及其他领域有望涌现出AI与人类全新的协作模式。
本文转载自 AI Friends。