点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:中国软件评测中心发布大模型报告:文心大模型在智能体、多模型创新具备先发优势
首页> 科技频道> 人工智能 > 正文

中国软件评测中心发布大模型报告:文心大模型在智能体、多模型创新具备先发优势

来源:光明网2024-07-10 11:32

  近日,中国软件评测中心发布《人工智能大语言模型技术发展研究报告(2024年)》,总结梳理大语言模型技术能力进展和应用情况,肯定国产大模型的发展成果,为产业界选用大模型提供了权威参考。报告显示,文心大模型技术、产品、应用全面领先,在智能体、多模型创新具备先发优势。

  报告认为,百度文心大模型在芯片、框架、模型和应用领域进行全栈布局,在理解、生成、逻辑、记忆等基础能力以及安全能力方面全面领先,在智能体、多模型等模式引领技术创新、生态丰富,在大模型应用开发平台方面功能完备、应用领域广泛。目前,文心大模型4.0 Turbo已正式发布,速度更快,效果更好,网页版、APP、API已陆续面向用户开放。

  算力、数据、算法是大模型三大基石,深度学习框架至关重要

  报告指出,软硬协同的算力底座,高丰富度、高质量的数据,持续优化与创新的算法是大模型的技术基石。尤其是 AI 芯片、深度学习框架、大规模算力集群等构成的算力底座是实现大模型高效稳定训练的基础。深度学习框架扮演了至关重要的角色,百度飞桨(PaddlePaddle)是其中的代表。

  飞桨集核心框架、基础模型库、端到端开发套件、丰富的工具组件于一体,实现了动静统一的框架设计,兼顾科研和产业需求,在开发便捷的深度学习框架、大规模分布式训练、高性能推理引擎、产业级模型库等技术上具备优势。目前,专为大模型设计的飞桨新一代框架3.0已经发布,具有动静统一自动并行、编译器自动优化、大模型训推一体、大模型多硬件适配四大能力。最新数据显示,截至目前,飞桨已拥有1465万开发者,服务37万家企事业单位,基于飞桨创建了95万个模型,稳居中国深度学习平台市场综合份额第一。

  飞桨深度学习平台提供了高效的分布式训练架构,在万卡集群上,飞桨能够支持超大规模的模型训练任务,实现大量计算节点之间的高效协同,更好地完成大模型的训练任务,这不仅提高了训练效率,而且降低了训练成本。目前,文心大模型的周均训练有效率已达到98.8%,相比2023年文心一言发布时,训练效率提升到当时的5.1倍,推理性能提升到105倍。

  在算法优化方面,国内大模型厂商通过多阶段对齐、知识增强等加速提升大模型性能。百度采用有监督精调、偏好学习和强化学习等技术进行多阶段对齐,逐步校准模型的行为,更准确地反映人类的意图和偏好。报告强调,百度文心大模型4.0还在输入、输出两个阶段都运用知识点增强,提升大模型的准确性,做出更准确的预测和决策。

  文心大模型综合能力、效率优势明显,智能体成重要发展方向

  报告显示,百度文心大模型在中文内容的生成和推理方面的能力十分优秀。在生成方面,文心大模型能根据给定的上下文或主题生成自然、流畅、富有创意的文本内容;在推理方面,能在应对复杂问题时进行深入分析和逻辑推理,给出更加准确和全面的答案。这使得文心大模型在中文语言处理领域具有独特的优势和价值。

  智能体是开发最简单的AI应用,是大模型最看好的AI应用方向。以文心大模型为例,百度基于基础模型,进一步进行思考增强训练得到思考模型。智能体可以通过思考模型的理解、规划、反思能力,调用多个工具,完成复杂的任务。对 AI 开发者来说,在搭建智能体时,百度这样的大模型服务商只要给出可调用的工具,以及相应的“说明书”即可。

  报告中提到智能体的另一大应用是“代码智能体”。近日,百度智能代码助手Comate发布中文名“文心快码”,并升级至2.5版本。目前百度80%的工程师已经在深度使用文心快码,代码采纳率已达到46%,新增代码生成占比29%。

  百度首提多模型应用理念,大模型落地持续领先

  报告认为,未来大模型的发展趋势包括多模态数据融合、提升自适应和迁移学习能力、可解释性算法提高模型透明度、提升产品研发针对性和定制化水平,以及从垂直领域入手开发专用大模型产品等。面对未来趋势,报告认为以文心大模型为代表的国产大模型在技术和产品上已具备显著特点,形成了一定的优势。

  目前,文心大模型的模型研发平台化效率已实现快速提升,背后是百度在芯片、框架、模型和应用领域的全栈布局和端到端优化。从应用角度看,除基础模型的本身外,文心大模型已经发展出智能体、多模态等多种创新应用模式,出现代码生成、文生图、视频生成、数字人、自动驾驶等丰富多样的应用生态。针对大模型的落地,百度在2024年AI开发者大会上首提多模型应用理念。研发侧通过大小模型协同训练机制,高效、低成本地进行模型生产;应用侧构建智能路由模型,发挥不同模型处理不同任务的能力,达到效果、效率和成本的动态平衡。

  2023年以来,人工智能大模型开启新一轮人工智能发展浪潮,成为科技产业发展强劲动能。2024年则有望成为大模型商业落地元年。百度文心大模型等国产模型在底层技术、核心能力和创新应用上展现出可贵的发展态势,具有广阔的应用前景和巨大的潜力。(科文)

[ 责编:李欣哲 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 乌蒙山大桥进行静态荷载试验

  • 稳外贸 福建莆田鲍鱼“出海”忙

独家策划

推荐阅读
去年3月,他和团队在人类历史上第一次为引力子“画像”,那篇发表在国际权威学术期刊《自然》上的论文,就在这里诞生。
2025-05-16 10:55
星星“眨眼睛”,并不是“真身”在动,而是光线的折射率出现了波动,导致肉眼观察下的星星,与其“真身”所在位置的偏移距离在短时间内发生了变化。通常,白天发生的大气湍流更加强烈,导致折射率波动更大,星星“眨眼睛”也更频繁,只是我们观察不到。
2025-05-16 09:52
气象监测显示,5月12日以来,我国华北南部、黄淮地区等出现35摄氏度以上高温天气。中央气象台预计,16日起,我国黄淮中西部、华北南部等地部分地区将出现高温天气,19日至21日,高温天气强度增强、范围扩大,陕西关中盆地、河南中西部等地部分地区日最高气温可达37—39摄氏度,局地40摄氏度。
2025-05-16 09:51
科学家发现,将一段人类特有的基因片段插入小鼠体内,可以让它们的大脑长得更大。为了找出人类HARE5与黑猩猩的差异,Silver和同事确定了其中4个遗传突变,每个突变都能同时增强黑猩猩和人类细胞的增殖能力。
2025-05-16 09:50
中国科学技术大学教授孙林峰、副教授刘欣团队与教授谭树堂团队合作,在植物激素运输领域取得重要研究进展。研究团队进一步解析了AUX1蛋白在CHPAA结合状态下的结构,为其抑制机理提供了见解,并提出AUX1蛋白依赖于质子浓度梯度介导生长素内向运输的转运模型。
2025-05-16 09:47
在这项研究中,胡晗带领的研究团队利用高精度CT扫描和三维重建技术,对保存完好的芝加哥始祖鸟标本进行了详细研究。
2025-05-16 09:42
研究显示,鸟类、哺乳类甚至龟类的大脑在过去3.2亿年里,经历了一场精彩的大脑神经元演化历程,走出了截然不同但又殊途同归的智慧发展之路。
2025-05-15 10:04
南京航空航天大学科研团队联手中外学者创新研发出储能密度较高的新型纳米复合薄膜储能器件,其储能密度可达215.8焦/立方厘米,刷新介电储能密度国际最高纪录。
2025-05-15 10:03
宇宙的命运与其天体命运息息相关,而其中恒星的最终“寿命”一直是人类探索的重要命题。
2025-05-15 10:02
周天军表示,这项研究不仅揭示了全球变暖下区域季风的演变规律,更凸显了古气候研究在气候变化预测中的独特价值。通过开展古今对比研究,丰富的古记录数据所揭示的历史变化事实,将会成为我们有效应对未来的重要参照物。
2025-05-15 10:01
种业振兴行动实施以来,我国农作物长期战略保存种质资源已超过58万份,其中蕴含着极为丰富的作物遗传基因密码,犹如“天书”亟待破解。近日,由中国农业科学院作物科学研究所发起、腾讯参与支持的作物种质资源“天书计划”正式启动。
2025-05-15 04:10
党的二十届三中全会提出“构建同科技创新相适应的科技金融体制”,为做好科技金融大文章提出了更高要求。
2025-05-14 17:50
中国科学院金属研究所研究员刘岗团队发展了“漂浮策略”和“维度定制”相结合的新策略,如同给二氧化钛穿上了“水上行走鞋”,赋予了材料可漂浮于中性水溶液表面的特性,为塑料转化提供了极具竞争力的替代方案。
2025-05-14 09:44
通过将筛选出的诗词逐一标注,提取时间、地点、诗人身份、情境语义等信息,研究团队逐步建立起一个横跨1400年的“长江江豚诗词数据库”,并确定724首提及长江江豚的作品。
2025-05-14 09:43
在全球变暖的气候背景下,未来全球雪旱发生频率将成倍增加,其中暖雪旱将成为主导类型。
2025-05-14 09:41
近日,中国科学院微生物所和西南大学的科学家找到了柑橘黄龙病的抗性基因,“柑橘癌症”有了破解方法。
2025-05-14 09:39
除了嫦娥六号带回的月球样品,其拍摄的着陆区高清图像可以帮助科学家了解着陆点的地质细节和土壤来源。在这项研究中,科研人员利用嫦娥六号降落相机序列图像、全景相机近景立体图像等数据,构建了一套高精度的着陆区地形数据集。
2025-05-14 09:36
近日,多奈单抗注射液在首都医科大学宣武医院开出全国首方,引发广泛关注。
2025-05-13 09:55
这场堪称检验船舶前期设计建造工程的“期中考”,将进一步验证大型邮轮在设计、工艺、生产准备、总装建造等阶段所取得的一系列重大科研成果。
2025-05-13 09:28
农业农村部的数据显示,我国农作物秸秆产生量逐年递增,目前全国农作物秸秆产生量为8.67亿吨,可收集量为7.33亿吨,秸秆综合利用率达88.3%。
2025-05-13 09:26
加载更多