点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:AI成为数学家得力助手还要多久
首页> 科技频道> 综合新闻 > 正文

AI成为数学家得力助手还要多久

来源:科技日报2025-06-17 09:53

  图片来源:物理学家组织网

  【今日视点】

  从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。

  几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。

  为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。

  几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。

  解决重大难题仍力不从心

  大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。

  今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。

  同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。

  美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。

  为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。

  这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。

  需攻克“超长推理链”

  仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。

  美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。

  这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。

  据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。

  该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。

  牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”

  古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。

  真正的创新和突破仍属人类

  跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。

  这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。

  澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”

  这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。

  不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。(记者 张佳欣)

[ 责编:焦子原 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 1月28日,国网宝鸡供电公司输电运检中心秦岭输电运维班成员赵鹤在变电站张贴新春对联。陕西省宝鸡市凤县的秦岭深处坐落着一座特殊的“融冰”电站——110千伏秦岭融冰变电站。由于当地处在冷暖气流交汇带,雨雪天气极易导致输电线路覆冰。

  • 1月30日,山东省泰安市高新区北集坡街道组织的“品书香 赏非遗逛大集”活动热闹开集,丰富多彩的文艺节目和便民服务项目吸引周边村镇居民前来逛大集办年货。

独家策划

推荐阅读
为揭示东亚古人类的技术智慧与演化脉络提供了关键证据。
2026-01-30 09:37
中国气象局29日发布《2025年中国风能太阳能资源年景公报》。公报显示:2025年,全国风能资源为正常年景,全国太阳能资源总体为偏小年景。
2026-01-30 03:30
想象一下手电筒的光:柔和而四散,照亮着前方。激光,就像一束训练有素的光——所有光粒子步调一致,朝着同一个方向前进,能量高度集中。这种特性让激光能完成普通光做不到的“精细活”,从超市扫码器到医院手术刀,从光纤通信到舞台灯光秀,背后都有它的身影。
2026-01-30 03:30
激光技术被誉为20世纪“四大科技发明”之一。聚焦真空紫外非线性光学晶体材料领域基础研究和关键核心技术,中国科学院新疆理化技术研究所(以下简称“新疆理化所”)潘世烈团队成功研制出氟化硼酸铵(ABF)晶体,首次实现直接倍频真空紫外激光158.9纳米输出,创造了该领域世界最短输出波长纪录。相关成果于29日在国际学术期刊《自然》发表。
2026-01-30 03:30
开慧镇党委书记杨骏介绍,依托科技小院,全镇形成科技养殖示范点5处、示范户24户,带动村民增收1800余万元,并发展起梅花鹿、鹌鹑等特色养殖产业。在博乐市区西南方向四五公里处的荒漠化草原上,科技小院还开辟了200多亩的试验场,将这里作为科研攻关的第一线。
2026-01-30 09:17
科研人员将种子放入冷库储存。例如,千年种子库与中国西南野生生物种质资源库就通过人员交流、技术培训、资源备份、联合研究等,共同推进生物多样性保护。
2026-01-30 09:16
寒冬时节,云南省元江哈尼族彝族傣族自治县龙潭社区番荔枝种植基地里却热火朝天,一颗颗“冬日限定”的番荔枝被采摘、装箱,销往全国各地。
2026-01-30 09:14
“相对拥有百年历史的《科学》,《工程》才走过第一个十年。未来十年,我们要争取与世界顶级刊群比肩。”周济表示,这条路需要时间,以及学术评价观念、出版生态与国际化运营能力的协同推进。
2026-01-29 02:45
工业和信息化部28日公布,2025年,我国通信业实现平稳增长,产业结构持续优化,用户规模实现量质双升,5G、千兆等新型信息基础设施建设加快部署。
2026-01-29 02:55
中国科学院物理研究所近日发布《2025年度REBCO高温超导带材战略研究报告》(以下简称“报告”),这是国际上首份针对高温超导带材发展的系统性战略报告。
2026-01-29 02:55
2025年,山东省实现地区生产总值10.3万亿元,比上年增长5.5%。亮眼的成绩单,离不开创新动能持续发力。齐鲁大地上,科技创新和产业创新融合发展成果正在厚积薄发,新质生产力加速崛起,转型动能持续增强,高水平创新型省份建设的目标正在逐步实现,向着“十五五”征程稳步进发。
2026-01-29 02:45
近期,多家外国科技公司宣布计划将人工智能及数据中心送往太空,引发了科技界的热烈讨论。这一看似在科幻电影中才会发生的场景,已逐步从设想转变为现实。
2026-01-29 02:55
手机厂商将投入更多精力,通过形态变革、差异化外观设计、联名合作等,更好地满足用户的情绪价值需求,激发消费者购买欲望。
2026-01-29 09:02
截至2025年底,全国累计发电装机容量38.9亿千瓦,同比增长16.1%。2025年,风电光伏累计装机历史性超过火电,截至12月底已超出约3亿千瓦。
2026-01-29 09:01
1月27日上午,中国科学院大学星际航行学院揭牌仪式在中国科学院与“两弹一星”纪念馆举行,标志着该学院正式成立。从“东方红一号”划破天际到“祝融号”漫步火星,中国人的航天梦从未停止。
2026-01-28 02:45
2025年,我国区域科技创新布局更加优化,三大国际科技创新中心建设进入新阶段,区域科技创新中心建设取得新成效。
2026-01-28 02:45
打破产业间的壁垒,鼓励跨领域、跨行业的融合探索,推动资源要素的自由流动与高效配置,不仅能盘活存量资源、激发增量活力,更能催生具有引领性的新产业、新模式、新动能。
2026-01-28 02:45
合肥是儿童文学作家许诺晨的家乡。合肥科学岛,是她所拥有的一座得天独厚的科学和科幻题材的“硬核基地”,由她来写量子少年这个题材,可谓“近水楼台”。《量子女孩》(中国少年儿童新闻出版总社2025年12月出版)是她献给“量子新城”合肥的一部“家乡书”。
2026-01-28 02:55
北京火箭大街展示与运控中心作为商业航天测运控中心、商业航天公共服务平台的空间载体,将为企业提供卫星运控服务和交流推介平台。
2026-01-28 09:15
水稻耐不耐旱,和叶子的厚实程度相关,这是由什么因素决定的?日前,中国农业科学院作物科学研究所水稻分子设计技术与应用创新团队发现,水稻基因组中的三个耐旱基因可以“团队作战”,
2026-01-27 02:50
加载更多