点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:文心大模型最新版有哪些技术创新?百度吴甜详解
首页> 科技频道> 人工智能 > 正文

文心大模型最新版有哪些技术创新?百度吴甜详解

来源:光明网2025-05-21 13:54

  5月20日,百度AI Day活动在北京举办,百度集团副总裁吴甜、中国信息通信研究院人工智能研究所平台与工程化部主任曹峰及文心一言用户代表陈君航现场分享了文心大模型最新技术、全球大模型发展及大模型能力测评、文心一言使用体验等。

  现场,中国信通院发布大模型推理能力评估结果。结果显示,百度文心X1 Turbo在24项能力评估中,16项达5分、7项达4分、1项达3分,综合评级获当前最高级“4+级”,成为国内首款通过该测评的大模型。文心X1 Turbo逻辑推理、代码推理、推理效果优化等技术能力及工具支持度、安全可靠度等应用能力均获得满分。

  文心大模型新版本技术详解

  吴甜对文心大模型最新版本的技术创新进行了系统性的讲解。她介绍,文心大模型4.5是多模态基础大模型,文心4.5 Turbo源自文心4.5,效果更好、成本更低;基于文心4.5 Turbo,文心X1升级到X1 Turbo,性能提升的同时,具备更先进的思维链,问答、创作、逻辑推理、工具调用和多模态能力进一步增强。

文心大模型最新版有哪些技术创新?百度吴甜详解

  百度集团副总裁吴甜

  文心4.5和4.5 Turbo实现了文本、图像和视频的混合训练。针对不同模态数据在结构、规模、知识密度上的差异,通过多模态异构专家建模、自适应分辨率视觉编码、时空重排列的三维旋转位置编码、自适应模态感知损失计算等技术,大幅提升跨模态学习效率和多模态融合效果,学习效率提高近2倍,多模态理解效果提升超过30%。

  后训练方面,百度研制了自反馈增强的技术框架,基于大模型自身的生成和评估反馈能力,实现了“训练-生成-反馈-增强”的模型迭代闭环,让大模型拥有了自我迭代的“最强大脑”,不仅解决了大模型对齐过程中,数据生产难度大、成本高、速度慢等问题,而且显著降低了模型幻觉,模型理解和处理复杂任务的能力大幅提升。

  在训练阶段,通过融合偏好学习的强化学习技术,实现多元统一奖励机制,提升了对结果质量判别的准确率。通过离线偏好学习和在线强化学习统一优化,进一步提升了数据利用效率和训练稳定性,并增强了模型对高质量结果的感知。此外,通过偏好信号与奖励信号的融合运用,模型的理解、生成、逻辑和记忆等能力全面提升。

  深度思考方面,突破了仅基于思维链优化的范式,在思考路径中结合工具调用,构建了融合思考和行动的复合思维链,模型解决问题能力得到显著提升,模型输出结果思路清晰、逻辑严密,表达自然。同时,结合多元统一的奖励机制,实现了思考和行动链的端到端优化,大幅提升了跨领域的问题解决能力。

  数据方面,打造了“数据挖掘与合成 - 数据分析与评估 - 模型能力反馈”的数据建设闭环,为模型训练源源不断地生产知识密度高、类型多样、领域覆盖广的大规模数据。同时,数据建设流程具备良好的可扩展性,能够轻松迁移到全新的数据类型,实现快速、高效的数据生产。

  吴甜也指出,大模型的能力进一步拓展、效率进一步提升之后,可以探索更前瞻、更有想象力的创新应用。

  以数字人为例,超拟真数字人需要具备出色的表现力、吸引人的内容、数字人与场景、物品的互动等,需要综合运用多模态AI技术。百度研制了“剧本”驱动多模协同的超拟真数字人技术,实现了语言、声音、形象的协调一致。目前这套技术已经支持超过10万数字人主播,直播转化率达31%,降低80%直播开播成本。在代码场景上,基于文心大模型的语言和代码能力,百度研制了代码智能体和智能代码助手——文心快码。百度每天新增的代码中,文心快码生成的代码占比已超过40%。截至目前,文心快码向全社会开放,累计服务760万开发者。

  文心大模型的能力拓展和效率提升,得益于飞桨文心的联合优化,包括框架模型的联合优化,也包括框架算力的联合优化。通过训练和推理的技术创新,文心4.5 Turbo训练吞吐达到文心4.5的5.4倍,推理吞吐达到8倍。公开数据显示,飞桨文心开发者数量已超过2185万,服务超过67万家企业,创建的模型达到110万。基于飞桨深度学习平台和文心大模型,百度在上海、广州、南京、武汉、厦门、宁波、南昌、无锡等多地落地产业赋能中心、数据生态中心和教育创新中心,以科技+人才+创新的模式打造区域人工智能公共技术服务平台,汇聚行业高价值数据集、培养新型复合型人才、赋能本地AI产品研发,构建围绕人工智能核心能力的“政产学研用”协同发展机制,加快区域产业智能化升级。

  国内首个!文心X1 Turbo获信通院“4+级”最高评级

  中国信息通信研究院人工智能研究所平台与工程化部主任曹峰从全球大模型发展、从测评看大模型能力演进以及文心大模型推理能力评测解读等行业视角在现场进行了趋势解读。他指出,2024年人工智能能力持续进化,在多任务语言理解、竞赛级数学、博士级科学问题等之前具有挑战性的基准测试中超越了人类的表现。

文心大模型最新版有哪些技术创新?百度吴甜详解

  中国信息通信研究院人工智能研究所平台与工程化部主任曹峰现场分享

  现场,曹峰公布了信通院大模型推理能力评估结果。百度文心X1 Turbo在24项能力评估中,16项达5分、7项达4分、1项达3分,综合评级获当前最高级“4+级”,成为国内首款通过该测评的大模型。

  他进一步表示,评估结果表明,文心X1 Turbo擅长结构化的逻辑思考,并具备平衡模型能力与效率的优化技术,其有效的数据机制保障了模型的可信及可用程度,其推理服务能广泛支持各类应用。文心X1 Turbo强化推理泛化能力,拓宽工具链应用生态,加强安全机制建设,构筑可信应用保障壁垒。

  16岁高中生:打开文心一言,就像打开新华字典一样

  活动现场,一位16岁高中学生陈君航分享了他使用文心一言的经历。他从2023年开始接触文心一言,自那以后,文心一言几乎陪伴了他整个中考备考过程。

  君航回忆,初次接触文心一言时,他正为语文作文的修改发愁,于是就把作文和老师点评发给文心一言,让它逐句分析给出修改建议。他坦言,“我打开文心一言,就像打开新华字典一样频繁。在它的陪伴下,我的写作能力得到很大提升。”

  君航表示,文心一言不仅帮他量身定制过阶段性的学习规划,还能解析搜题软件无法解析的原创题目。“在学习方面,文心一言就像我 24 小时在线的全能老师。”

文心大模型最新版有哪些技术创新?百度吴甜详解

  陈君航现场分享与文心一言的故事

  这位高一学生不仅自己爱用文心一言,还把他带给了母亲、同学、老师们。也让大家对AI有了新的认知。

  “我从小学时就开始对编程产生兴趣,但家人一直认为学编程只够作为一项兴趣爱好,反对我投入过多的时间在编程研究上。因此,到了晚上规定的时间,爸妈都会准时关闭电脑,要求我去学习或者休息。”

  但后来发生的事,让君航妈妈对他在编程上花时间的态度发生了转变。君航的妈妈是一位小学老师,平时在繁重的教学任务中,还要抽时间做很多案头工作。“我经常看到她一边批卷子一边熬夜写点评,五十几份,一句句手打。”所以君航想:“我能不能做点什么?”于是他开始尝试用文心一言,为妈妈设计了一个“智能文案生成器”,原本三天的工作仅需几小时就可以完成。这让君航的妈妈对编程有了新的认知,也激发了她自己对大模型的使用兴趣。

  当大模型学会像人类一样感知世界,像人类一样思考和行动并自我进化,技术进步便真正转化为普惠的社会红利。正如陈君航同学所说:“技术真正的魅力不是惊艳谁,而是真正解决一个又一个真实的问题”。(鸣耒)

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 2025年空军航空开放活动和长春航空展举行预演

  • 百舸争流迎开渔

独家策划

推荐阅读
“科创游”是一种将科技与旅游相结合的新型旅游形式,不仅展示科技企业的生产过程和产品,还注重科技教育的普及和科技创新的体验
2025-09-17 10:23
此次大会将讨论通过“人与生物圈计划”及其世界生物圈保护区网络杭州战略行动计划,明确未来十年的发展方向、目标和行动方案
2025-09-17 10:21
人造地球卫星、载人飞船、空间站、空间探测器要“上天”进入预定轨道,运载火箭少不了。在“火箭家族”展台,长征一号至五号运载火箭模型笔直而立。
2025-09-17 10:20
在化学生物学研究中,有一种强大的“分子地图绘制技术”——邻近标记技术。在癌症免疫治疗中,免疫细胞需要足够强和足够多的“信号”才能发起攻击,但癌细胞表面的天然信号往往非常稀疏。
2025-09-17 10:18
当前,秋粮陆续进入成熟期。各地抓住最后的窗口期,落实落细各项增产措施,全力以赴抓好秋粮生产,确保秋粮丰产丰收。
2025-09-17 09:32
人工智能的浪潮正在席卷从科技到教育,乃至全社会的各个角落,中国教育界正在积极推动学习和应用人工智能,以便乘势站在时代前列。今年6月,中国工程院院士、华中科技大学校长尤政提出,人工智能和批判性思维结合形成DNA式的“双螺旋结构”,将有力推动创新。
2025-09-16 09:14
15日,在2025年国家网络安全宣传周主论坛上,《人工智能安全治理框架》2.0版正式发布。落实《全球人工智能治理倡议》,《人工智能安全治理框架》1.0版于2024年9月发布,受到国内外广泛关注。
2025-09-16 09:13
光明日报北京9月15日电 记者陈晨从农业农村部获悉,2025畜禽种业发展论坛14日在北京市平谷区举行。论坛发布了第三次全国畜禽遗传资源普查、濒危畜禽遗传资源保护成效、主要畜种分子身份证构建和遗传评估优秀种公畜等重大成果,举办了畜禽种业振兴成果展,26家单位现场推介新技术、新设备、新成果,72家单位进行专场展示。
2025-09-16 09:13
数智技术以及数智互联技术将推进青年间社会化协同与知识共享,可精准连接青年学习者,并形成跨地域的学习社群与项目协作组。总而言之,数智技术能够为青年群体参与终身学习创造良好条件,能够充分激发青年群体参与终身学习的动力,能够更好地帮助青年群体全面发展。
2025-09-16 09:12
作者:王 珩、程松泉,分别系浙江师范大学教师教育学院教授;浙江师范大学教师教育学院博士生  当前,全球教育正经历一场由人工智能技术驱动的深刻变革。唯有坚守育人初心,在伦理框架内审慎推进技术应用,才能让人工智能真正成为引领教育发展的引擎,而非解构教育本质的飓风。
2025-09-16 09:11
在合成生物学和气候变化应对领域有巨大潜力。
2025-09-16 09:11
走进展区,多款新潮文创让人爱不释手;戴上设备,苏轼笔下的诗词世界任人遨游;指尖轻点,三千年前的青铜器“触手可及”……一系列新产品、新服务、新场景在2025年中国国际服务贸易交易会文旅服务专题亮相,漫步其中,处处感受到科技与创意奔涌、文化和旅游融合的无限活力。
2025-09-15 09:54
在2025年中国国际服务贸易交易会上,一批品类丰富、兼具趣味与文化内涵的文创精品成为展会现场的“人气王”,引爆观展热潮。
2025-09-15 09:54
最大网络基础设施的建成有助于我国突破关键技术的“卡脖子”困境,形成自主可控的核心技术优势,建立起数字经济产业的第二创新生态。 (作者:戎 珂,系清华大学社会科学学院经济学研究所所长、长聘教授;田晓轩,系清华大学社会科学学院经济学研究所博士研究生)
2025-09-15 09:53
今年暑期,工厂游火爆出圈。参观名额秒空、门票收入可观、社交平台相关笔记有10多万条,工厂游俨然成了文旅界新宠。 工厂游等新型旅游业态,实现了工业与文旅的跨界融合,也为文旅经济的发展提供了新增长点。
2025-09-15 09:52
深夜,河南焦作多氟多新材料股份有限公司的实验室依旧灯火通明,总工程师闫春生还在带着团队忙碌。 2006年,多氟多打响了由传统氟化工向精细氟化工、新能源材料转型的战役,闫春生临危受命加入六氟磷酸锂研发团队。
2025-09-15 09:51
2025年中国国际服务贸易交易会9月10日至9月14日在北京举办,众多科技产品亮相展区,吸引观众驻足参观。2025年中国国际服务贸易交易会9月10日至9月14日在北京举办,众多科技产品亮相展区,吸引观众驻足参观。
2025-09-12 10:08
汽车排放被认为是气候变化的“元凶”之一,但学术界一直缺乏对城市道路碳排放进行精准刻画的工具。”借助全景AI模型,可实现二氧化碳排放源的精准提取,模型的平均精度超过93%、平均误差低于1.3ppm(ppm为百万分比浓度)。
2025-09-12 10:01
习近平总书记指出:“要把握人工智能发展趋势和规律,加紧制定完善相关法律法规、政策制度、应用规范、伦理准则,构建技术监测、风险预警、应急响应体系,确保人工智能安全、可靠、可控。人工智能系统的可靠性不能停留在统计意义上的“高概率正确”,而应追求在复杂、开放、动态环境下的“高置信可靠”。
2025-09-12 10:01
10日,2025世界顶尖科学家协会奖(以下简称“顶科协奖”)获奖者名单在上海公布。顶科协奖是2021年在上海发起创设、由红杉中国独家提供永久资金支持的面向全球科学家评选的科学大奖。
2025-09-12 09:59
加载更多