点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:全球科研团队竞逐低成本AI模型研发新范式
首页> 科技频道> 综合新闻 > 正文

全球科研团队竞逐低成本AI模型研发新范式

来源:光明网-《光明日报》2025-02-24 09:20

  美国斯坦福大学等机构研究团队近日宣布,在基座大模型基础上,仅耗费数十美元就开发出相对成熟的推理模型。尽管其整体性能尚无法比肩美国开放人工智能研究中心(OpenAI)开发的o1、中国深度求索公司的DeepSeek-R1等,但此类尝试意味着企业可以较低成本研发出适合自身的AI应用,AI普惠性有望增强。同时,其所应用的“测试时扩展”技术或代表一条更可持续的AI研发路径。

  低成本玩转高级推理

  美国斯坦福大学和华盛顿大学研究团队近日宣布研发出名为s1的模型,在衡量数学和编码能力的测试中,可媲美o1和DeepSeek-R1等。研究团队称,训练租用所需的计算资源等成本只需几十美元。

  s1的核心创新在于采用了“知识蒸馏”技术和“预算强制”方法。“知识蒸馏”好比把别人酿好的酒进一步提纯。该模型训练数据是基于谷歌Gemini Thinking Experimental模型“蒸馏”出的仅有1000个样本的小型数据集。

  “预算强制”则使用了AI模型训练新方法——“测试时扩展”的实现方式。“测试时扩展”又称“深度思考”,核心是在模型测试阶段,通过调整计算资源分配,使模型更深入思考问题,提高推理能力和准确性。

  “预算强制”通过强制提前结束或延长模型的思考过程,来影响模型的推理深度和最终答案。s1对阿里云的通义千问开源模型进行微调,通过“预算强制”控制训练后的模型计算量,使用16个英伟达H100 GPU仅进行26分钟训练便达成目标。

  美国加利福尼亚大学伯克利分校研究团队最近也开发出一款名为TinyZero的精简AI模型,称复刻了DeepSeek-R1 Zero在倒计时和乘法任务中的表现。该模型通过强化学习,实现了部分相当于30亿模型参数的大语言模型的自我思维验证和搜索能力。团队称项目训练成本不到30美元。

  “二次创造”增强AI普惠性

  清华大学计算机系长聘副教授刘知远接受记者采访时说,部分海外研究团队使用DeepSeek-R1、o1等高性能推理大模型来构建、筛选高质量长思维链数据集,再用这些数据集微调模型,可低成本快速获得高阶推理能力。

  相关专家认为,这是AI研发的有益尝试,以“二次创造”方式构建模型增强了AI普惠性。但有三点值得注意:

  首先,所谓“几十美元的低成本”,并未纳入开发基座大模型的高昂成本。这就好比盖房子,只算了最后装修的钱,却没算买地、打地基的钱。AI智库“快思慢想研究院”院长田丰告诉记者,几十美元成本只是最后一个环节的算力成本,并未计算基座模型的预训练成本、数据采集加工成本。

  其次,“二次创造”构建的模型,整体性能尚无法比肩成熟大模型。TinyZero仅在简单数学任务、编程及数学益智游戏等特定任务中有良好表现,但无法适用于更复杂、多样化的任务场景。而s1模型也只能通过精心挑选的训练数据,在特定测试集上超过早期版本o1 preview,而远未超过o1正式版或DeepSeek-R1。

  最后,开发性能更优越的大模型,仍需强化学习技术。刘知远说,就推动大模型能力边界而言,“知识蒸馏”技术意义不大,未来仍需探索大规模强化学习技术,以持续激发大模型在思考、反思、探索等方面的能力。

  AI模型未来如何进化

  在2025年美国消费电子展上,美国英伟达公司高管为AI的进化勾画了一条路线图:以智能水平为纵轴、以计算量为横轴,衡量AI模型的“规模定律”呈现从“预训练扩展”到“训练后扩展”,再到“测试时扩展”的演进。

  “预训练扩展”堪称“大力出奇迹”——训练数据越多、模型规模越大、投入算力越多,最终得到AI模型的能力就越强。目标是构建一个通用语言模型,以GPT早期模型为代表。而“训练后扩展”涉及强化学习和人类反馈等技术,是预训练模型的“进化”,优化其在特定领域的任务表现。

  随着“预训练扩展”和“训练后扩展”边际收益逐渐递减,“测试时扩展”技术兴起。田丰说,“测试时扩展”的核心在于将焦点从训练阶段转移到推理阶段,通过动态控制推理过程中的计算量(如思考步长、迭代次数)来优化结果。这一方法不仅降低了对预训练数据的依赖,还显著提升了模型潜力。

  三者在资源分配和应用场景上各有千秋。预训练像是让AI模型去学校学习基础知识,而后训练则是让模型掌握特定工作技能,如医疗、法律等专业领域。“测试时扩展”则赋予了模型更强推理能力。

  AI模型的迭代还存在类似摩尔定律的现象,即能力密度随时间呈指数级增强。刘知远说,2023年以来,大模型能力密度大约每100天翻一番,即每过100天,只需要一半算力和参数就能实现相同能力。未来应继续推进计算系统智能化,不断追求更高能力密度,以更低成本,实现大模型高效发展。

  (新华社北京2月23日电 记者彭茜)

  《光明日报》(2025年02月24日 12版)

[ 责编:田新宇 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 甘肃漳县:震后群众安置及排险工作有序进行

  • 银铜器加工“老手艺”成为乡村振兴“金钥匙”

独家策划

推荐阅读
建设海洋强国,离不开海洋文化等软实力的支撑。
2025-09-29 09:22
2025年世界新能源汽车大会27日在海南海口开幕。大会以“产业变革与可持续发展”为主题,策划了18场会议、2场闭门会议、技术展览、科技评选和系列科普活动。
2025-09-29 05:25
国家“十四五”规划重点工程——青藏直流二期扩建工程28日正式投运,可将青海与西藏之间的输电能力提高一倍,达到120万千瓦,对于提高西藏电力供应保障能力,促进清洁能源大范围优化配置,服务建设新型电力系统具有重要意义。
2025-09-29 05:25
日前,第五届世界生物圈保护区大会在浙江杭州落下帷幕。这场十年一届的盛会首次在亚洲举行,各方代表齐聚一堂,汇聚共识,共同探讨进一步促进人与自然和谐共生、实现可持续发展的思路与举措。
2025-09-29 05:25
科普是国家创新体系的重要组成部分,是实现创新发展的基础性工作。
2025-09-29 03:15
“我们要做轻量化,就是要做轻量化生态,要建设轻量化生态系统。”在2025(第十八届)汽车轻量化大会(以下简称“大会”)上,北汽福田欧曼事业部研发中心底盘系统高级主任工程师兼公司轻量化负责人李军代表公司获得“汽车轻量化创新成果大赛卓越成果奖”,展现了中国商用车轻量化技术的最新突破。
2025-09-29 07:19
目前,我国专业技术人才超过8000万人,技能劳动者总量超过2.2亿人,其中高技能人才超过7200万人,为推动高水平科技自立自强、建设现代化产业体系提供了坚实人才支撑。
2025-09-28 09:45
9月27日20时40分,我国在太原卫星发射中心使用长征六号改运载火箭,成功将卫星互联网低轨11组卫星发射升空,卫星顺利进入预定轨道,发射任务获得圆满成功。
2025-09-28 09:39
今天,横跨贵州省贞丰县与关岭县的世界第一高桥——六安高速花江峡谷大桥正式建成通车。大桥通车后,原来需要绕行2小时的花江峡谷两岸贞丰县至关岭县,如今仅需2分钟即可直达,真正实现了“天堑变通途”。
2025-09-28 09:39
近日,2025亚太机器人世界杯青岛国际邀请赛在青岛西海岸新区举行,来自12个国家和地区的84支代表队同台竞技。在各类比赛中,人形机器人足球赛吸引了最多观众“观战”。
2025-09-28 04:15
9月27日03时28分,我国在酒泉卫星发射中心使用长征四号丙运载火箭,成功将风云三号08星发射升空,卫星顺利进入预定轨道,发射任务获得圆满成功。
2025-09-28 04:15
为改善数字消费“硬设施”和“软环境”,近日,商务部联合国家发展改革委、工业和信息化部等7部门研究出台《关于大力发展数字消费共创数字时代美好生活的指导意见》。
2025-09-28 04:15
各地情况不同,建设“无废城市”也需因地制宜,但认准了,就要坚定不移干下去,直到干出成效、达到既定目标。
2025-09-26 09:39
黄芪五仁月饼、茯苓陈皮豆沙月饼、“五行月饼”……中秋将至,主打“药食同源”的药膳月饼受到许多人青睐,成为节日消费新亮点。药膳月饼选用的食材,如茯苓健脾宁心、莲子益肾固涩、薏仁利水渗湿,都是常见食疗材料,适量食用有一定调理效果。
2025-09-26 09:38
国家疾控局近日举行新闻发布会。该局新闻发言人、综合司一级巡视员熊煌介绍,目前,病媒生物传染病、自然疫源性传染病风险处于较高水平,手足口病、诺如病毒感染等肠道传染病聚集性疫情风险增加,流感等其他急性呼吸道传染病处于低水平。
2025-09-26 09:37
广西壮族自治区博物馆藏品管理和展览部副主任黄海荣介绍,广西素有“铜鼓之乡”的美誉,2006年,壮族铜鼓习俗入选第一批国家级非物质文化遗产名录。在全国科普月期间,重庆邮电大学空间通信研究院科普基地展台前,一场趣味十足的“芯片探秘”正在上演。
2025-09-26 09:35
中共中央政治局常委、国务院副总理丁薛祥23日在湖南调研。他强调,要深入学习贯彻习近平总书记在湖南考察时的重要讲话精神,以科技创新引领产业创新,加快培育和发展新质生产力,打造国家重要先进制造业高地。
2025-09-26 04:30
“十四五”以来,我国能源科技在全产业链取得新成效,能源科技创新取得更大突破。数智技术不断助力能源创新升级,绿色低碳能源技术开发能力不断增强。
2025-09-26 04:30
随着人工智能技术的迅猛发展和广泛应用,人工智能已成为各国经济社会发展的重要推动力,也是当前国际竞争的新焦点。以习近平同志为核心的党中央高度重视人工智能发展,不断完善顶层设计、加强工作部署,推动我国人工智能综合实力整体性、系统性跃升。
2025-09-26 04:30
眼下正值全国科普月,25日,科学家精神百场讲坛走进成都炭材公司,中国工程院院士、高功率脉冲技术及应用专家邱爱慈作题为《马兰精神与强脉冲辐射环境模拟技术》的主题报告。
2025-09-26 04:30
加载更多