点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:人工智能“迎战”奥数难题
首页> 科技频道> 综合新闻 > 正文

人工智能“迎战”奥数难题

来源:科技日报2024-08-05 10:11

  IMO中的问题涵盖了多个数学领域。但大多数IMO问题都是用英语编写的,需要翻译成AI能理解和验证的编程语言,才能让AI进行机器学习。

  图片来源:《自然》网站

  【今日视点】

  继击败人类围棋大师和战略棋盘游戏顶尖高手之后,谷歌“深度思维”公司人工智能(AI)系统在英国巴斯举行的2024年国际数学奥林匹克竞赛(IMO)上,仅以1分之差与金牌失之交臂,获得了银牌。这是AI选手首次登上IMO领奖台。

  英国《自然》杂志网站在7月27日的报道中指出,“深度思维”正与其他公司竞相解决数学领域的疑难问题。近年来,IMO被广泛认为是对机器学习的一个挑战,也是衡量AI系统高级数学推理能力的理想基准。AI系统在今年IMO中的精彩表现,标志着其即将再下一城:在解决数学难题方面击败世界顶尖学生。

  首登领奖台

  “深度思维”公司训练了一个专门用于解答数学奥赛考题的AI系统,成功解答了6道竞赛题中的4道,获得28分(满分42分),达到本次比赛银牌获得者的水平。

  该系统包括解答数学推理问题的模型AlphaProof和解答几何问题的模型AlphaGeometry的升级版AlphaGeometry 2。其中,AlphaGeometry 2解决了一个几何问题,而AlphaProof则解答了两个代数问题和一个数论问题。

  今年1月份,AlphaGeometry在解决欧几里得几何问题上,就已表现出奖牌级选手的水平。在今年的IMO比赛前,AlphaGeometry 2已经能够解决过去25年里83%的IMO几何问题,而其“前身”仅能解决53%。

  “深度思维”公司AI科学副总裁普什米特·科利指出,这是AI系统首次达到获IMO奖牌级别的性能。IMO主席格雷戈尔·多利纳尔也表示,AI最终将能比人类更好地解决大多数数学问题,其进步速度令人惊叹。

  几乎同一时间,软件公司Numina的科学家使用语言模型,赢得了AI数学奥林匹克奖(AIMO)的首个“进步奖”。

  但Numina团队在获奖后表示,要解决更难的数学问题,仅靠语言模型可能还不够。

  与自己对抗

  AlphaProof是一个自学习系统,其核心创新在于结合预训练语言模型与AlphaZero强化学习算法的策略。强化学习是机器学习领域一种重要的学习范式,系统可通过多次尝试找到自己的解题方法。

  这种方法需要用AI能理解和验证的语言编写大量问题,而大多数IMO问题都是用英语编写的。为解决这个问题,“深度思维”团队托马斯·赫伯特及其同事使用谷歌的大语言模型Gemini,将这些问题翻译成一种名为Lean的编程语言,以供AI进行学习。

  AlphaProof使用经过微调的Gemini模型,自动将数学问题转换为Lean语言,从而创建了一个涵盖不同难度级别的大型问题库。在强化学习阶段,系统每验证一个证明,就用它来强化AlphaProof的语言模型,提高其解决后续更具挑战性问题的能力。

  赫伯特表示,在挑战围棋游戏时,他们也采用了类似的方法:AI通过与自己对抗,来学习如何更好地玩游戏。结果显示,在某些情况下,AlphaProof能够在无限多的可能性中迈出正确的一步,展现出“灵光一闪”的能力。

  仍有改进空间

  尽管AlphaProof的表现令人印象深刻,但其速度相对较慢,解决3个问题耗费了3天时间,而人类参赛者仅需4个半小时。此外,它也未能回答两个与组合数学有关的问题。

  英国数学家约瑟夫·迈尔斯审查了AI在本次IMO比赛中给出的答案。他指出,AlphaProof采取的这些技术能否予以完善还有待观察。

  英国伦敦数学科学研究所何杨辉称,AlphaProof这样的系统对于帮助数学家证明问题很有用,但它无法帮助研究人员确定需要解决和研究的问题。

  “深度思维”团队表示,他们正继续探索多种用于推进数学推理的AI方法。未来,数学研究者将与AI合作验证假说,尝试新方法来解决长期未解决的数学难题。他们也希望AlphaProof能够通过减少错误响应,帮助改进谷歌的大型语言模型。(记者 刘 霞)

[ 责编:焦子原 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • “消防奥运会”在哈尔滨市举行

  • 白露时节秋收忙

独家策划

推荐阅读
通过三代核电自主化,中国正实现对国际最高水平的赶超,助力“双碳”目标实现。
2024-09-06 08:50
中国人民银行信贷市场司司长彭立峰给出一组亮眼数据:过去5年,我国科技型企业贷款的年均增速是20%,是贷款平均增速的近2倍。
2024-09-06 08:48
作为离地球较近且环境最相似的星球,火星一直是人类走出地月系统开展深空探测的首选目标。
2024-09-06 08:46
基于此成果,华大目前已联合香港理工大学,成立香港理工大学—华大·全球深海资源基因组学和合成生物学联合研究中心,实施进一步研发和产业化。
2024-09-06 08:45
5日,在国家林草局举办的国家公园和国家植物园体系建设成效新闻发布会上,国家林草局自然保护地管理司司长张利明介绍,我国已基本构建国家公园制度体系的“四梁八柱”。
2024-09-06 07:20
回音壁印章设计者、中国建筑材料科学研究总院有限公司北京分公司研发工程师焦朋告诉记者,回音壁存在特殊声学现象,可以让声音形成回声。
2024-09-06 08:47
有两组数据最能直观展现云南的丰饶:以仅占全国4%的国土面积,保育了48.01%的国家重点保护野生植物和56.27%的重点保护陆生野生动物;在南北间距不过900公里的土地上,拥有7种气候类型,囊括了地球上除海洋和沙漠以外所有的生态系统类型。
2024-09-06 07:20
近几年,人工智能在许多行业都有应用,成为人类的“好帮手”。但在这一过程中,也出现了各种各样的问题。
2024-09-05 05:30
经过近3千米的行驶,我们来到了这座小山的山顶,这里距离海面约750米,地貌以岩石为主,可以看到海星、海胆、珊瑚和海葵等。
2024-09-05 08:29
冰箱在使用过程中的减碳,不仅来自冰箱自身运转过程中的节能,还来自冰箱保冷、保鲜技术提升而减少的食物浪费。
2024-09-05 08:26
禾本科植物适应性强,易于推广种植。如:小麦抗旱、耐冷,水稻耐涝、耐热、耐移栽,玉米耐热、耐瘠薄、抗旱、光能利用率高,谷子、高粱和燕麦耐盐碱、耐瘠薄、抗旱、光合作用能力强。
2024-09-05 08:25
近期,中国地震局与国家成都超算中心、清华大学等多家单位联合发布全球第一个亿级参数的地震波大模型。
2024-09-05 08:23
打造了多种高科技气象服务产品。
2024-09-05 05:20
随着“山河号”盾构机刀盘缓缓启动,济南市黄岗路穿黄隧道开始盾构掘进,我国最大直径水下盾构隧道开启穿越黄河之旅。
2024-09-05 08:23
科学研究,不仅是对未知的探索,更要体现对现实的关怀,其落脚点应当是促进经济社会发展。
2024-09-05 08:28
高耸入云的南迦巴瓦峰,奔腾不息的雅鲁藏布江,见证了对口援藏30年来雪域高原的沧桑巨变。
2024-09-04 10:02
围绕“规模应用 生态赋能”,大会发布了北斗规模应用操作系统、大众北斗1米精准定位服务等系列成果,央地携手推动北斗规模应用先行先试。
2024-09-04 09:16
身高1.68米、全身自由度超过50个、搭载robotGPT云端大脑的达闼人形机器人XR4,已经在7月初世界人工智能大会上开启了预售,一台价格39.9万元起。
2024-09-04 09:15
我国在西昌卫星发射中心使用长征四号乙运载火箭,成功将遥感四十三号02组卫星发射升空,卫星顺利进入预定轨道,发射任务获得圆满成功。
2024-09-04 09:13
中国石油3日发布的信息显示,我国最大油气田——中国石油长庆油田累计生产油气当量历史性突破10亿吨。这是长庆油田继2020年建成6000万吨级特大油气田之后取得的又一里程碑式成就。
2024-09-04 04:15
加载更多