点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:AI推理进入“10毫秒、1块钱”时代!浪潮信息发布面向智能体优化AI计算系统
首页> 科技频道> 综合新闻 > 正文

AI推理进入“10毫秒、1块钱”时代!浪潮信息发布面向智能体优化AI计算系统

来源:光明网2025-09-26 21:39

  光明网讯 9月26日,在2025人工智能计算大会上,浪潮信息宣布,基于元脑SD200超节点AI服务器,DeepSeek R1大模型token生成速度仅需8.9毫秒,创造国内大模型最快token生成速度。最新发布的元脑HC1000超扩展AI服务器,实现每百万token成本首次击破1元。

AI推理进入“10毫秒、1块钱”时代!浪潮信息发布面向智能体优化AI计算系统

  随着Scaling Law持续推动模型能力跃升,以DeepSeek为代表的开源模型极大降低了创新门槛,加速智能体产业化的到来。智能体产业化的核心三要素是能力、速度和成本。其中,模型能力决定了智能体的应用上限,交互速度决定了智能体的商业价值,token成本决定了智能体的盈利能力。

  浪潮信息对AI计算架构的持续创新,旨在解决智能体产业化面临的交互速度和token成本两大瓶颈,为多智能体协同与复杂任务推理的规模化落地,提供高速度、低成本的算力基础设施。

  仅需8.9毫秒!元脑SD200引领token生成速度率先进入“10毫秒时代”

  浪潮信息最新公布,基于元脑SD200超节点AI服务器运行DeepSeek R1大模型,单token生成速度低至8.9毫秒,带动国内AI服务器token生成速度率先进入“10毫秒时代”。

  元脑SD200基于创新研发的多主机低延迟内存语义通信架构,在单机内实现了64路本土AI芯片的高速统一互连,单机可承载4万亿参数单体模型,或部署多个万亿参数模型组成的智能体应用,实现多模型协同执行复杂任务。

  为实现极低的通信延迟,元脑SD200采用精简高效的三层协议栈,原生支持多种内存语义操作,避免冗余数据拷贝,将基础通信延迟降至百纳秒级,硬件化链路层重传与分布式预防式流控进一步适配高吞吐、低延迟的 AI 推理场景。

  元脑HC1000,推理成本首次击破1元/每百万token

  浪潮信息发布元脑HC1000超扩展AI服务器,基于全新开发的全对称DirectCom极速架构,无损超扩展设计聚合海量本土AI芯片、支持极大推理吞吐量,推理成本首次击破1元/每百万token,为智能体突破token成本瓶颈提供极致性能的创新算力系统。

  元脑HC1000通过全面优化降本和软硬协同增效,创新16卡计算模组设计、单卡“计算-显存-互连”均衡设计,大幅降低单卡成本和每卡系统分摊成本。同时,全对称的系统拓扑设计支持超大规模无损扩展。据测算,元脑HC1000通过算网深度协同、全域无损技术,实现推理性能相比传统RoCE提升1.75倍,单卡模型算力利用率最高提升5.7倍。

  未来,智能体带来的推理算力需求将呈现出指数级的爆发式增长。浪潮信息方面透露,将通过软硬件协同设计与深度优化,持续推动AI计算架构的创新与突破,不断实现token生成“提速降本”,积极促进大模型、智能体等人工智能技术与实体经济的深度融合,让人工智能成为千行百业的生产力和创新力。(记者 战钊)

[ 责编:焦子原 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 习近平为美国总统特朗普举行欢迎宴会

  • 习近平同美国总统特朗普举行会谈

独家策划

推荐阅读
“九章四号”被应用于高效求解高斯玻色采样任务,其计算速度相比当前全球最快的超级计算机快1054倍(即量子优势比为1054),成功建立了国际上最强的量子计算优越性。
2026-05-15 03:15
夏粮收购是全年粮食收购的首战,对于保护种粮农民利益、维护粮食市场平稳运行、保障粮食稳定安全供给具有重要意义。
2026-05-15 03:25
5月14日,我国首座海上移动式多功能措施平台“海洋石油283”(又称“增产一号”)从青岛西海岸新区启运
2026-05-15 03:25
5月14日11时,朱雀二号改进型遥五运载火箭在东风商业航天创新试验区发射升空,运载火箭全程飞行正常,二子级进入预定轨道,飞行试验任务取得圆满成功。
2026-05-15 03:15
自然资源部13日发布的最新找矿成果显示,西藏罗布莎矿区新增铬铁矿资源量73.83万吨,实现矿山深边部找矿突破。找矿团队还在西藏东巧地区首次评价沉积型铬铁矿,新增伴生铬铁矿矿石量114.63万吨,拓展了我国铬铁矿找矿空间。
2026-05-15 02:55
中国科学技术大学潘建伟、陆朝阳、张强、刘乃乐等组成的研究团队联合国内多家科研单位,成功研制出1024个量子压缩态输入、8176模式的可编程量子计算原型机“九章四号”。
2026-05-14 09:49
当前,全球科技创新格局深度调整,科技成果转化已成为衡量国家创新体系效能的关键标尺。
2026-05-14 03:05
中国人对天宇的想象,自古便深沉而浪漫。在东华大学,科研人员将来自38万公里外的月球土壤化为一缕缕兼具柔性与强度的星际之丝。
2026-05-14 02:40
近日,中国科学院化学研究所研究员乔燕、王树团队联合国内外科学家,首次实现人工细胞的形态与功能不对称分裂,为理解类生命功能涌现和原始细胞形成提供了新路径。
2026-05-14 02:40
近日,国家网信办、国家发展改革委、工业和信息化部联合印发《智能体规范应用与创新发展实施意见》(以下简称《实施意见》),明确支持探索智能体在城市规划、建设与治理环节的规范应用,同时将智能体安全、可靠、可信作为产业发展的底线要求。
2026-05-14 02:25
“请帮我检索南京附近适合亲子旅游的路线”“我想买个电热水器,请帮我推荐几款实用的”……如今,越来越多的消费者开始将AI(人工智能)当作“随身消费参谋”。从规划旅游路线到挑选酒店民宿,再到日常购物选择,很多消费者习惯先问一问AI工具,再做消费决策。
2026-05-13 09:30
在这一过程中,颠覆性技术正由潜在变量转变为关键变量,成为重塑产业结构、重构竞争格局的重要力量。颠覆性技术具有“路径替代”特征,能够深刻改变产业格局。综上所述,未来产业发展呈现出“技术跃迁—场景转化—工程化扩张”的基本路径。
2026-05-13 09:22
搭载单核180个计算比特自主超导量子芯片的“本源悟空-180”量子计算机已上线运行,开始接收全球量子计算任务。
2026-05-13 02:30
2018年,厦大教师吴彩胜带着一群厦大青年来到这里。他们发现,当地的农副产品虽然产量不小,却因缺乏检测条件,面临“好产品难认证”的困境。
2026-05-13 02:20
浦江潮涌,惠风和畅。5月12日,第十二届亚太经合组织(APEC)食品安全合作论坛(FSCF)会议在上海举行。
2026-05-13 02:25
今年5月12日是第18个全国防灾减灾日,主题是“人人讲安全、个个会应急——提高防灾减灾救灾能力”。
2026-05-12 02:40
习近平总书记在加强基础研究座谈会上强调,基础研究是整个科学体系的源头,是所有技术问题的总机关。
2026-05-12 02:40
当前,我国正处于加快建设教育强国的关键时期。教育作为强国建设、民族复兴之基,战略地位更加凸显,迎来了前所未有的发展机遇
2026-05-12 02:40
十年来,北京大学考古文博学院坚守初心、守正创新,聚焦学科、学术、话语、育人四大体系一体化建设,并以实践创新贯穿始终,让四者协同赋能
2026-05-12 02:40
回顾人类社会发展史可以发现,任何一个国家的崛起都伴随着思想文化的兴盛和知识体系的自主建构。
2026-05-12 02:40
加载更多