点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:人工智能“迎战”奥数难题
首页> 科技频道> 综合新闻 > 正文

人工智能“迎战”奥数难题

来源:科技日报2024-08-05 10:11

  IMO中的问题涵盖了多个数学领域。但大多数IMO问题都是用英语编写的,需要翻译成AI能理解和验证的编程语言,才能让AI进行机器学习。

  图片来源:《自然》网站

  【今日视点】

  继击败人类围棋大师和战略棋盘游戏顶尖高手之后,谷歌“深度思维”公司人工智能(AI)系统在英国巴斯举行的2024年国际数学奥林匹克竞赛(IMO)上,仅以1分之差与金牌失之交臂,获得了银牌。这是AI选手首次登上IMO领奖台。

  英国《自然》杂志网站在7月27日的报道中指出,“深度思维”正与其他公司竞相解决数学领域的疑难问题。近年来,IMO被广泛认为是对机器学习的一个挑战,也是衡量AI系统高级数学推理能力的理想基准。AI系统在今年IMO中的精彩表现,标志着其即将再下一城:在解决数学难题方面击败世界顶尖学生。

  首登领奖台

  “深度思维”公司训练了一个专门用于解答数学奥赛考题的AI系统,成功解答了6道竞赛题中的4道,获得28分(满分42分),达到本次比赛银牌获得者的水平。

  该系统包括解答数学推理问题的模型AlphaProof和解答几何问题的模型AlphaGeometry的升级版AlphaGeometry 2。其中,AlphaGeometry 2解决了一个几何问题,而AlphaProof则解答了两个代数问题和一个数论问题。

  今年1月份,AlphaGeometry在解决欧几里得几何问题上,就已表现出奖牌级选手的水平。在今年的IMO比赛前,AlphaGeometry 2已经能够解决过去25年里83%的IMO几何问题,而其“前身”仅能解决53%。

  “深度思维”公司AI科学副总裁普什米特·科利指出,这是AI系统首次达到获IMO奖牌级别的性能。IMO主席格雷戈尔·多利纳尔也表示,AI最终将能比人类更好地解决大多数数学问题,其进步速度令人惊叹。

  几乎同一时间,软件公司Numina的科学家使用语言模型,赢得了AI数学奥林匹克奖(AIMO)的首个“进步奖”。

  但Numina团队在获奖后表示,要解决更难的数学问题,仅靠语言模型可能还不够。

  与自己对抗

  AlphaProof是一个自学习系统,其核心创新在于结合预训练语言模型与AlphaZero强化学习算法的策略。强化学习是机器学习领域一种重要的学习范式,系统可通过多次尝试找到自己的解题方法。

  这种方法需要用AI能理解和验证的语言编写大量问题,而大多数IMO问题都是用英语编写的。为解决这个问题,“深度思维”团队托马斯·赫伯特及其同事使用谷歌的大语言模型Gemini,将这些问题翻译成一种名为Lean的编程语言,以供AI进行学习。

  AlphaProof使用经过微调的Gemini模型,自动将数学问题转换为Lean语言,从而创建了一个涵盖不同难度级别的大型问题库。在强化学习阶段,系统每验证一个证明,就用它来强化AlphaProof的语言模型,提高其解决后续更具挑战性问题的能力。

  赫伯特表示,在挑战围棋游戏时,他们也采用了类似的方法:AI通过与自己对抗,来学习如何更好地玩游戏。结果显示,在某些情况下,AlphaProof能够在无限多的可能性中迈出正确的一步,展现出“灵光一闪”的能力。

  仍有改进空间

  尽管AlphaProof的表现令人印象深刻,但其速度相对较慢,解决3个问题耗费了3天时间,而人类参赛者仅需4个半小时。此外,它也未能回答两个与组合数学有关的问题。

  英国数学家约瑟夫·迈尔斯审查了AI在本次IMO比赛中给出的答案。他指出,AlphaProof采取的这些技术能否予以完善还有待观察。

  英国伦敦数学科学研究所何杨辉称,AlphaProof这样的系统对于帮助数学家证明问题很有用,但它无法帮助研究人员确定需要解决和研究的问题。

  “深度思维”团队表示,他们正继续探索多种用于推进数学推理的AI方法。未来,数学研究者将与AI合作验证假说,尝试新方法来解决长期未解决的数学难题。他们也希望AlphaProof能够通过减少错误响应,帮助改进谷歌的大型语言模型。(记者 刘 霞)

[ 责编:焦子原 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 历时14年我国为海外中国青铜器“建档”

  • 第139届广交会第一期到会境外采购商数量创历届新高

独家策划

推荐阅读
正值春耕关键期,河南滑县的万亩麦田里,种粮大户不再需要徒步巡查耕地,只需轻点手机,卫星遥感图便将田块边界、墒情分布与作物长势清晰呈现。
2026-04-20 09:51
在苏州大学江苏省先进负碳技术重点实验室,纳米科学技术学院博士生郁操正操作X射线光电子能谱仪,分析一块特殊的测试样品。张晓宏表示,学校将继续深化“学术大师+创新团队”模式,完善交叉课程体系,培养出更多能服务地方产业、对接国家战略、为新质生产力助力的拔尖创新人才。
2026-04-20 09:47
绿色设计不仅是实现碳达峰、碳中和目标的关键工具,更是推动产业转型升级、培育新质生产力的源头性驱动力。“十五五”规划纲要明确提出:“鼓励企业提高绿色设计和制造水平,降低产品全生命周期能源资源消耗和生态环境影响。
2026-04-20 09:44
当前,全球具身智能产业进入从实验室研发到产业化落地的关键跃升期,成为大国科技博弈的重点领域。具身智能产业横跨人工智能、高端制造、新材料、电子信息等多元领域,唯有系统集成、协同创新才能释放最大效能。
2026-04-20 09:43
飞机即将着陆,一位怀抱婴儿的年轻妈妈突然求助——她头晕、想吐。这本书是谭先杰沉淀十多年的健康传播实践心得,也是他投身医学科普以来,对“如何做好健康科普”进行的系统性梳理。
2026-04-20 09:54
4月10日,国家网信办、国家发展改革委、工业和信息化部、公安部、市场监管总局联合公布《人工智能拟人化互动服务管理暂行办法》,自2026年7月15日起施行。”  郑庆华表示,同济大学正在推进人工智能伦理、算法治理与安全测评研究,重点攻坚用户极端情境识别、情感边界引导、未成年人身份识别等关键技术。
2026-04-20 09:47
4月19日7时30分,2026北京亦庄半程马拉松暨人形机器人半程马拉松鸣枪开跑,人形机器人与人类跑者同时从起点出发。也有专家提醒,人形机器人正步入以场景落地为核心的攻坚期,大规模量产与普及仍面临诸多挑战。
2026-04-20 09:45
记者16日从中国科学院国家空间科学中心获悉,来自该中心等单位的科研人员,通过三维数值模拟首次揭示,月球内部的金属月核在“感受”到太空磁场突变时,会像电磁感应一样产生感应电流和感应磁场,这股力量会挤压月球周围的太阳风,在月球两侧边缘形成一道特殊的“压缩带”。这项研究不仅揭示了月球导电内核在太阳风与月球相互作用中的重要作用,也为未来探测月球内部结构提供了新依据。
2026-04-17 10:30
据中国载人航天工程办公室消息,北京时间2026年4月17日01时36分,经过约5.5小时的出舱活动,神舟二十一号乘组航天员张陆、武飞、张洪章密切协同,在空间站机械臂和地面科研人员的配合支持下,圆满完成空间碎片防护装置安装、舱外设备设施巡检等任务。
2026-04-17 10:30
今年4月17日是第三十八个世界血友病日,主题为“诊断是关怀工作的第一步”。我国血友病患者诊疗现状如何?如何早识别、早干预?患者在日常生活中如何做好管理和防护?
2026-04-17 10:21
截至2026年3月31日,29个省(自治区、直辖市)和新疆生产建设兵团共154个统筹地区完成上年度医保基金清算,覆盖率达全国统筹区总数的39%,超额完成试点任务。其中,吉林白山、浙江宁波等43个非试点地区主动对标试点标准同步完成清算任务。山东、宁夏、北京、河北、海南、天津、河南等7地完成全省(自治区、直辖市)清算。
2026-04-17 10:20
商务部新闻发言人何亚东在16日举行的新闻发布会上表示,外资研发中心是我国创新体系的重要组成部分。2月,财政部、商务部等部门共同印发了有关通知,继续对外资研发中心进口有关科研用品免征进口关税和进口环节增值税、消费税。
2026-04-17 10:13
中国科学院微小卫星创新研究院15日发布轻舟试验飞船首批科学成果:关键技术验证方面,飞船测试了密封结构、推进、惯性测量、热控环控等核心系统。
2026-04-16 09:24
此次飞行对多项关键技术进行在轨考核,同时搭载27项科学试验载荷,还携带近300件青少年科普作品和一件《马踏雄风》瓷马进入太空。
2026-04-16 09:22
15日9时50分,由中国航空工业集团自主研制的HH-200航空商用无人运输系统,在航空工业民机试飞中心渭南运营基地平稳降落,圆满完成首飞。
2026-04-16 09:21
记者15日从国家林草局获悉,在法国巴黎召开的联合国教科文组织执行局第224届会议上,我国浙江常山和四川四姑娘山顺利通过会议审议,正式成为世界地质公园。
2026-04-16 09:20
党的十八大以来,我国统筹推进扩绿、兴绿、护绿并举,城市绿化实现从“有没有”到“好不好”的跨越式发展。为精准破解部分地区绿化分布不均、群众亲近自然不便的难题,各地因地制宜、见缝插绿,把生态福祉送到群众家门口。
2026-04-16 09:18
首次增设智能穿戴、显示技术、消费级无人机、集成房屋及庭院设施等9个专区。更多新企业、新产品、新技术走向世界,服务全球消费者。
2026-04-15 11:12
根据药品流通的不同渠道,《意见》明确发挥医疗机构专业作用、引导药店合理制定药品零售价格、用好网上药店价格发现功能等措施,鼓励各类主体参与价格形成。根据药品的不同领域,《意见》强调促进创新药多元支付与价格合理形成、强化短缺药保供稳价、加强麻醉药品和精神药品价格管理、规范药品原辅料价格行为,引导关键领域药品价格保持合理水平。
2026-04-15 09:26
而泵房内的水肥一体化配料系统,则扮演着“神经网”中智能中枢的角色。“从‘两脚泥’的传统漫灌,到指尖上的智能操控,再到云端管控的智慧灌溉,这场变革只用了短短几年。
2026-04-15 09:25
加载更多