点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:全球科研团队竞逐低成本AI模型研发新范式
首页> 科技频道> 综合新闻 > 正文

全球科研团队竞逐低成本AI模型研发新范式

来源:光明网-《光明日报》2025-02-24 09:20

  美国斯坦福大学等机构研究团队近日宣布,在基座大模型基础上,仅耗费数十美元就开发出相对成熟的推理模型。尽管其整体性能尚无法比肩美国开放人工智能研究中心(OpenAI)开发的o1、中国深度求索公司的DeepSeek-R1等,但此类尝试意味着企业可以较低成本研发出适合自身的AI应用,AI普惠性有望增强。同时,其所应用的“测试时扩展”技术或代表一条更可持续的AI研发路径。

  低成本玩转高级推理

  美国斯坦福大学和华盛顿大学研究团队近日宣布研发出名为s1的模型,在衡量数学和编码能力的测试中,可媲美o1和DeepSeek-R1等。研究团队称,训练租用所需的计算资源等成本只需几十美元。

  s1的核心创新在于采用了“知识蒸馏”技术和“预算强制”方法。“知识蒸馏”好比把别人酿好的酒进一步提纯。该模型训练数据是基于谷歌Gemini Thinking Experimental模型“蒸馏”出的仅有1000个样本的小型数据集。

  “预算强制”则使用了AI模型训练新方法——“测试时扩展”的实现方式。“测试时扩展”又称“深度思考”,核心是在模型测试阶段,通过调整计算资源分配,使模型更深入思考问题,提高推理能力和准确性。

  “预算强制”通过强制提前结束或延长模型的思考过程,来影响模型的推理深度和最终答案。s1对阿里云的通义千问开源模型进行微调,通过“预算强制”控制训练后的模型计算量,使用16个英伟达H100 GPU仅进行26分钟训练便达成目标。

  美国加利福尼亚大学伯克利分校研究团队最近也开发出一款名为TinyZero的精简AI模型,称复刻了DeepSeek-R1 Zero在倒计时和乘法任务中的表现。该模型通过强化学习,实现了部分相当于30亿模型参数的大语言模型的自我思维验证和搜索能力。团队称项目训练成本不到30美元。

  “二次创造”增强AI普惠性

  清华大学计算机系长聘副教授刘知远接受记者采访时说,部分海外研究团队使用DeepSeek-R1、o1等高性能推理大模型来构建、筛选高质量长思维链数据集,再用这些数据集微调模型,可低成本快速获得高阶推理能力。

  相关专家认为,这是AI研发的有益尝试,以“二次创造”方式构建模型增强了AI普惠性。但有三点值得注意:

  首先,所谓“几十美元的低成本”,并未纳入开发基座大模型的高昂成本。这就好比盖房子,只算了最后装修的钱,却没算买地、打地基的钱。AI智库“快思慢想研究院”院长田丰告诉记者,几十美元成本只是最后一个环节的算力成本,并未计算基座模型的预训练成本、数据采集加工成本。

  其次,“二次创造”构建的模型,整体性能尚无法比肩成熟大模型。TinyZero仅在简单数学任务、编程及数学益智游戏等特定任务中有良好表现,但无法适用于更复杂、多样化的任务场景。而s1模型也只能通过精心挑选的训练数据,在特定测试集上超过早期版本o1 preview,而远未超过o1正式版或DeepSeek-R1。

  最后,开发性能更优越的大模型,仍需强化学习技术。刘知远说,就推动大模型能力边界而言,“知识蒸馏”技术意义不大,未来仍需探索大规模强化学习技术,以持续激发大模型在思考、反思、探索等方面的能力。

  AI模型未来如何进化

  在2025年美国消费电子展上,美国英伟达公司高管为AI的进化勾画了一条路线图:以智能水平为纵轴、以计算量为横轴,衡量AI模型的“规模定律”呈现从“预训练扩展”到“训练后扩展”,再到“测试时扩展”的演进。

  “预训练扩展”堪称“大力出奇迹”——训练数据越多、模型规模越大、投入算力越多,最终得到AI模型的能力就越强。目标是构建一个通用语言模型,以GPT早期模型为代表。而“训练后扩展”涉及强化学习和人类反馈等技术,是预训练模型的“进化”,优化其在特定领域的任务表现。

  随着“预训练扩展”和“训练后扩展”边际收益逐渐递减,“测试时扩展”技术兴起。田丰说,“测试时扩展”的核心在于将焦点从训练阶段转移到推理阶段,通过动态控制推理过程中的计算量(如思考步长、迭代次数)来优化结果。这一方法不仅降低了对预训练数据的依赖,还显著提升了模型潜力。

  三者在资源分配和应用场景上各有千秋。预训练像是让AI模型去学校学习基础知识,而后训练则是让模型掌握特定工作技能,如医疗、法律等专业领域。“测试时扩展”则赋予了模型更强推理能力。

  AI模型的迭代还存在类似摩尔定律的现象,即能力密度随时间呈指数级增强。刘知远说,2023年以来,大模型能力密度大约每100天翻一番,即每过100天,只需要一半算力和参数就能实现相同能力。未来应继续推进计算系统智能化,不断追求更高能力密度,以更低成本,实现大模型高效发展。

  (新华社北京2月23日电 记者彭茜)

  《光明日报》(2025年02月24日 12版)

[ 责编:田新宇 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 亚太峰会开幕倒计时1天

  • 北方多地出现大风降温天气

独家策划

推荐阅读
经监测,截至2024年年底,青海湖裸鲤资源蕴藏量达12.75万吨,较2023年增加0.72万吨,增长5.98%,较2002年保护初期增长49倍;
2025-04-11 03:45
中央气象台预计,4月11日至12日,随着新一股较强冷空气东移南下,我国中东部地区将出现强风、降温、沙尘天气,华北将出现历史同期罕见持续性大风,内蒙古东部和东北地区东部将出现暴雪,南方将出现今年以来最强风雹天气。
2025-04-11 10:23
我国科学家利用嫦娥六号采回的月球背面样品,首次获得月球背面月幔的水含量小于2微克/克,为认识月幔水的时空演化提供了关键约束。
2025-04-11 03:45
自然资源部10日发布公告:经国务院批准,高纯石英矿成为我国第174号新矿种。据悉,这一矿种于2020年至2021年被发现,
2025-04-11 03:45
为实现长期心电智能监测,研究团队开发了一种无运动束缚的动态12导联心电系统(以下简称“MU-DCG系统”),实现了无感化佩戴、抗运动伪影以及低功耗原位实时信号处理的优势集成。
2025-04-11 03:45
一根细细的纱线,一头连着福建首个规模超万亿元的纺织鞋服产业;另一头牵动5位院士的心,带动多项高性能纺织面料技术取得突破,为国内一家锦纶龙头企业及上下游企业新增产值逾10亿元……
2025-04-10 10:13
人工智能快速发展,在赋能千行百业、助推经济社会发展的同时,利用AI进行违法犯罪、AI数据权属争议等新问题也随之出现。透过几个具有代表性的司法案例,看司法机关如何通过积极稳妥审理相关案件,运用法治方式厘清法律边界、做好规制监管、强化司法指引,护航人工智能向上向善。
2025-04-10 10:11
医生身处临床服务、保障人民健康第一线,能切实了解病患需要、诊疗现状、技术进展,也是最容易做创新、出成果的。
2025-04-10 10:07
近日,该所成功研发出全球首套面源污染智能监测系统,首次实现对流动水体中高风险抗生素、农药残留等新发污染物的实时、在线、动态监测。
2025-04-10 03:55
免疫细胞是免疫系统的重要部分。其中,小胶质细胞在中枢神经发育、免疫监视及退行性病变等过程中扮演重要角色,但自1919年被发现以来,小胶质细胞一直被认为仅存在于中枢神经系统内部。
2025-04-10 03:55
业内有这么一句话:“世界棉花看中国,中国棉花看新疆。 之所以发生如此巨变,离不开一批批农业技术人员的辛勤努力,其中有个闪亮的名字,人们不会忘记——“中国长绒棉之父”陈顺理。
2025-04-09 09:54
在现代化工中,90%以上的生产过程需要催化剂的参与。 团队研制了世界首套双光束原位透射红外光谱,在催化反应中发现了新机制。
2025-04-09 09:54
北京大学未来技术学院席鹏教授团队联合河北大学高保祥教授课题组,成功研发出一种新型近红外荧光探针HBimmCue,实现了对线粒体内膜环境的高分辨率、高亮度动态观测。
2025-04-09 09:53
千松坝林场位于河北承德市丰宁满族自治县,成立20多年来,林场建设者们通过推广林草间作、林牧结合等多种模式,完成造林工程逾百万亩。2013年开始,千松坝林场在大滩镇小北沟村荒山上植树造林,生态环境的改善,带动了旅游、餐饮、民宿等发展。
2025-04-09 09:53
润滑材料在飞机的诸多部件中发挥着关键作用,如发动机、起落架、舱门、尾翼,以及液压系统等部位都离不开高性能润滑材料的支持。为我国一款重要飞行器研制高性能润滑剂是乔旦接到的第一个重要任务,而她也因此面临前所未有的挑战。
2025-04-09 09:50
啃下硬骨头的不是蛮力,而是创新力,思维创新、技术创新是突破极限的关键驱动力 如今,在无垠大海,在广袤荒漠,能源装备今非昔比,能源技术突飞猛进,把能源的饭碗牢牢端在自己手里,我们这一代人责无旁贷,更有底气。
2025-04-09 09:47
打开手机刷短视频、通勤路上听播客、睡觉前追微短剧……网络视听已如空气一般,渗透进人们生活的每一刻。加强对低俗、恶俗、违法内容的监管,严厉打击版权侵权行为,为创作者提供更加安全的创作环境。
2025-04-09 09:46
促进农业农村现代化、加快建设农业强国,需要发挥农业科技创新的关键支撑作用。推动跨学科、跨地区、产学研协同攻关,凝聚农业科技创新合力,关键在于加快建立协同化农业科技创新组织机制。
2025-04-09 09:44
清明时节,浙江杭州、福建武夷山等地的春茶采摘进入旺季。 在不断拓展下沉寄递服务网络的同时,快递企业还持续提升科技发展水平,加大对无人机、无人车等智能装备的应用,助力全社会物流成本的有效降低。
2025-04-08 10:03
俗话说:“绿肥种三年,瘦田变肥田。近日,农业农村部南京农业机械化研究所西南丘陵山区农机与电动装备创新团队成功研发出高效机器采收装备,解决了这一难题。
2025-04-08 10:03
加载更多