点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:AI成为数学家得力助手还要多久
首页> 科技频道> 综合新闻 > 正文

AI成为数学家得力助手还要多久

来源:科技日报2025-06-17 09:53

  图片来源:物理学家组织网

  【今日视点】

  从计算机科学到医学再到国家安全,数学是众多关键应用的基石,但数学领域的进步可能需要数年时间才能实现。

  几百年来,数学家使用的工具依然简朴:一张纸、一支笔。他们凭借逻辑与灵感,在符号的迷宫中寻找通往真理的路径。

  为了打破这一局面,美国国防高级研究计划局今年4月启动了“指数性数学”计划,旨在开发一种能极大提升数学研究效率的人工智能(AI)“合著者”系统。

  几十年来,数学家借助计算机进行辅助计算或验证命题,如今的AI或许能更上层楼,挑战那些人类长年未解的难题。不过,从能解高中题的AI,到能协助攻克前沿数学难关的AI,中间仍隔着一道鸿沟。

  解决重大难题仍力不从心

  大型语言模型(LLM)并不擅长数学。它们常常出现“幻觉”,甚至可能被误导相信2+2=5。但新一代大型推理模型,如OpenAI的o3、Anthropic的Claude 4 Thinking等,展现出的进步令数学家眼前一亮。

  今年,这些模型在美国数学邀请赛中的表现接近优秀高中生水平。不同于过去“一锤定音”式的输出,这些模型开始尝试模拟数学家逐步推理的思考过程。

  同时,一些将LLM与某种事实核查系统相结合的新型混合模型也取得了突破。例如,谷歌“深度思维”的AlphaProof系统将语言模型与棋类AI——AlphaZero结合,成为首个取得与国际数学奥林匹克竞赛银牌得主成绩相当的系统。今年5月,谷歌的AlphaEvolve模型更进一步,在多个长期未解的数学与计算难题上找到优于人类现有方案的解法。

  美国《麻省理工科技评论》指出,尽管这些AI成绩亮眼,但专家们普遍认为,它们仍不具备真正的协助科研的能力。竞赛题虽难,却更像是智力游戏,有一定“套路”。真正的数学研究则更开放、更复杂。面对“P vs NP”“黎曼猜想”等重大难题时,AI仍力不从心。

  为了更准确地评估AI的能力,初创公司Epoch AI去年推出了FrontierMath测试,联合60多位数学家设计出全新高难度题目,避开模型已见过的训练数据,结果LLM几乎集体“交白卷”。

  这些测试表明,AI在数学道路上虽已迈步,但离“合著者”角色仍有很长一段路要走。

  需攻克“超长推理链”

  仔细观察数学问题会发现,它们在某些方面类似:解决问题需完成一系列连续步骤,关键在于找到这些步骤。

  美国加州理工学院谢尔盖·古科夫指出,困难的差异往往体现在路径的长度上。高中数学可能只需10到40步,而像黎曼猜想这样的难题,路径可能长达百万步。

  这类“超长路径”极难处理。就像下围棋时寻找一条制胜序列,AI必须在指数级增长的可能路径中找到正确解法。而在数学中,这个复杂度要远超棋类游戏。

  据物理学家组织网今年2月报道,为应对这一挑战,古科夫团队开发了一种方法,将多个步骤打包成“超级步骤”,相当于穿上“巨人靴”跨越大段路程。他们设计了一个系统,其中强化学习模型负责提出超级步骤,另一个模型负责验证其合理性。

  该策略在经典未解难题——安德鲁斯-柯蒂斯猜想上取得了突破。虽然尚未证明或推翻该猜想,但借助AI,科学家推翻了一个40年来被广泛引用的“反例”。这曾被视为证明该猜想错误的关键依据。

  牛津大学数学家马丁·布里森对此表示肯定:“排除错误路径,是科研中非常有价值的一步。”

  古科夫相信,这种“压缩路径”的思路适用于所有需要推理链条的领域。他希望,这种方法不仅能推动AI跳出固有模式,也为数学研究带来新突破。

  真正的创新和突破仍属人类

  跳出思维定式,正是数学家攻克难题的关键。数学常被看作机械推理,而高等数学则更像是一场实验,充满一波三折的试错与灵光乍现的顿悟。

  这正是AlphaEvolve等AI工具的优势所在。它通过LLM不断生成并改进解题代码,配合第二个模型评估每一轮结果,最终提出比人类更优的解法。这种方法不仅能独立探索,也支持人类随时介入,提供灵感和指令。

  澳大利亚悉尼大学数学家乔迪·威廉姆森强调,探索性思维是数学的核心。据英国《新科学家》网站报道,他与Meta合作开发了PatternBoost AI系统,可根据一个数学想法生成相似概念,帮助激发灵感。他说:“这就像是这里有一堆有趣的东西,我不知道是怎么回事,但你能再生成一些类似的东西吗?”

  这种头脑风暴在数学中至关重要,它是新想法产生的源泉。以二十面体为例——古希腊人通过纯粹推理发现了它,其形状并不存在于自然界中,却深刻影响了数学的发展。威廉姆森希望,AI未来也能协助发现类似的“新数学对象”。

  不过,目前AI仍缺乏真正的创造力。让AI赢棋是一回事,让它发明围棋游戏则是另一回事。像AlphaEvolve和PatternBoost这样的工具或许能作为人类直觉的“侦察兵”,帮助人们发现路径、避开死路,但专家普遍认为,真正的创新与突破,仍然属于人类。(记者 张佳欣)

[ 责编:焦子原 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 第十五届新疆喀什·中亚南亚商品交易会开幕

  • 滇西抗战纪念馆8月15日起恢复对公众开放

独家策划

推荐阅读
脂肪肝、血压偏高、空腹血糖异常……一些以往更多与中老年相关的健康问题,正悄然在不少年轻人身上显现。在糖尿病视网膜病变筛查方面,我们开发了DeepDR系统,利用人工智能助力基层医生解读眼底片子。
2025-08-15 09:54
现有的抗病毒药物只对特定病毒有效,因此,拥有一种作用广泛的治疗方法将极具价值。对于耐药性问题,Bogunovic认为,只要这种抗病毒药物包含一系列针对病毒不同生命周期的干扰素触发蛋白,病毒就不太可能对其产生耐药性。
2025-08-15 09:53
经过多年持续攻坚,数字领域突破了一批关键核心技术。据测算,2024年,上市数据企业平均研发投入较“十三五”末增长79%,产业链创新活力持续增强。
2025-08-15 09:45
我国又一个超千亿立方米的大型深层整装页岩气田诞生。
2025-08-15 09:42
随着电动交通、低空经济、消费电子、人形机器人等新兴领域迅速发展,人们对高能量、长续航可充放电池的需求日益迫切。
2025-08-15 09:40
截至目前,我国累计批准发布国家标准物质19007项,其中1—7月新批准发布国家标准物质549项,同比增长56%。
2025-08-14 10:29
一项发表于《自然-神经科学》的研究,首次成功建立了线粒体功能障碍与神经退行性疾病的因果关系。
2025-08-14 10:28
中国的黄牛育种终于有了自主、低成本的检测芯片!”
2025-08-14 10:27
提到全球变暖,人们往往首先想到二氧化碳、甲烷乃至氟利昂等能够加剧大气温室效应的温室气体。很多人不知道,大气中还存在一类可以抑制气候变暖的物质。而人类扩张农田等行为,可能在客观上导致大气中“降温物质”减少,进而加剧全球气候变暖。
2025-08-14 10:24
党的二十届三中全会明确提出,建立人工智能安全监管制度,完善生成式人工智能发展和管理机制。这就要求我们坚持统筹高质量发展和高水平安全,把创新作为第一动力、把安全作为底线要求、把普惠作为价值追求,积极融入“人工智能+”行动,鼓励和促进人工智能气象应用服务创新发展,前瞻应对人工智能技术应用带来的风险挑战。
2025-08-14 03:50
广东珠海以南海域,一座银灰色的三角形装置随波起伏。这里是我国自主研发的全球首台兆瓦级漂浮式波浪能发电装置“南鲲号”,日均发电量可达1万千瓦时,能满足约1500户家庭一天的用电需求。
2025-08-13 10:02
研究发现,在1950年至2020年间,极端高温的加剧导致热带地区陆栖鸟类的丰度下降了25%至38%。研究人员以地球生命力数据库中的全球陆栖鸟类种群数据作为研究起点,未包括水鸟和海鸟。
2025-08-13 10:01
中性原子体系因优异的扩展性、高保真度量子门、高并行性和任意的连接性,成为极具潜力的量子计算和量子模拟平台。审稿人高度评价这项研究工作,认为这一工作是原子相关量子物理领域在计算效率和实验可行性方面的一次重大飞跃。
2025-08-13 10:01
“植物如何整合复杂环境信号是深入理解植物生存智慧的关键,也是创制兼具养分高效利用与逆境抗性的未来作物新品种的理论基础。储成才团队相信,随着研究的深入,未来会有更多基于植物“生存智慧”的作物新品种出现,让农业更高效、更环保。
2025-08-13 10:01
8月12日是世界大象日。记者从国家林业和草原局亚洲象研究中心了解到,从最新一线监测数据看,我国野生亚洲象象群交流频繁、种群结构稳定、生育率稳步提升、
2025-08-13 03:45
团队需要从头开始,设计一款“更适合日本”的机器人:体形小巧,穿行灵活,语音系统换成日语,屏幕上的动画表情还能变换。擎朗智能目前在日本已经设立200多个技术支持点,确保常规故障能在2小时内响应,24小时内修复。
2025-08-12 10:06
夏季天气炎热,很多人喜欢去游泳馆游泳。“游泳可以提高心肺耐力和身体柔韧性,改善体脂率,因此受到越来越多人的喜爱。”潘力军说,游泳如果不注意卫生,可能感染红眼病、中耳炎和胃肠道疾病,建议做好如下防护措施:  游泳前,注意自身的健康状况。
2025-08-12 10:03
近日,随着最后一笔数据在青藏高原上录入系统,三江源国家公园正式完成自然资源确权登记。2019年,《关于统筹推进自然资源资产产权制度改革的指导意见》与《关于建立以国家公园为主体的自然保护地体系的指导意见》相继出台,“依法确权”成为基石。
2025-08-12 10:02
一般认为,宇宙中的每个星系中心都有一个超大质量黑洞,而更大的星系则拥有更大的黑洞,即超巨型黑洞。Collett表示,恒星运动学被视为黑洞质量测量的“金标准”,引力透镜效应则可以帮助团队“探测到更遥远的宇宙”。
2025-08-12 10:01
中国科学院大连化学物理研究所研究员杨维慎、彭媛团队开发了一种便捷的触发式界面反应策略,实现了二维金属-有机框架膜(MOF膜)的快速制备及高效气体分离。该研究为面向应用的MOF纳米片和超薄二维MOF膜的定制化制备提供了新思路,可满足不同应用场景下的高性能分离需求。
2025-08-12 10:00
加载更多