点击右上角
微信好友
朋友圈

请使用浏览器分享功能进行分享

近日,国产算力芯片企业中诚华隆在京发布全新HL200推理芯片及超节点智算集群方案,实现国产AI推理算力从单点芯片突破到万卡级集群体系化协同的跨越式升级。工业和信息化部电子信息科技委执行副主任兼秘书长毕开春、中国科技咨询协会理事长刘志光出席,百余位来自主管部门、科研院所及产业链的代表参会见证。
当前,AI产业加速从训练驱动转向推理驱动,AIAgent规模化落地、长上下文交互场景普及带动行业Token消耗快速攀升,高效低时延的推理能力已成为算力赛道核心竞争壁垒。面向万亿参数大模型商业化落地刚需,中诚华隆延续“一年一芯”迭代节奏,推出第二代HL200推理芯片,精准适配生成式AI与高并发推理场景。

据介绍,HL200原生支持FP4、FP8超低精度推理,兼容主流FP16精度,单卡FP16/BF16算力0.5P、FP8算力2P、FP4算力4P,能效比达5.12TFLOPS/W,稳居国内第一梯队,有效破解行业推理能效偏低、部署成本偏高的痛点。
生态层面,该芯片全面兼容PyTorch、ONNX、vLLM等主流技术栈,配套OpenAI兼容接口与轻量化迁移方案,大幅降低企业模型切换成本。在DeepSeekV4系列、GLM5.2等主流大模型适配测试中,HL200的Prefill全流程性能相较国际同级芯片全面领先,解码延迟优势显著,可稳定支撑大模型规模化商业推理部署。
针对大模型指数级的算力增长需求,中诚华隆同步发布HL200超节点智算集群方案,突破单卡算力边界,实现大规模集群高效协同。该方案单机柜支持64张GPU高速互联,单节点最高可堆叠1024卡,横向扩展最高可达10240卡,覆盖8卡至万卡全场景算力部署需求。
通过算、存、网全链路SLO协同优化,集群在算力密度、互联带宽、部署时延、能效表现等指标达到业界先进水平,兼具灵活扩容性与高性价比,可适配各级智算中心与不同规模政企算力场景,推动大模型从技术演示走向规模化商业交付。
毕开春在致辞中表示,国产人工智能基础芯片已从行业可选上升为国家战略必需。中诚华隆作为国产算力芯片领域骨干企业,深耕自主芯片研发多年,在攻坚“卡脖子”关键核心技术与全栈算力布局上取得重要突破,全国产芯片的成功流片充分展现了企业的技术实力与创新能力。
刘志光表示,国家“十五五”规划持续强化企业科技创新主体地位,鼓励企业牵头开展关键核心技术攻关、组建产业创新联合体。中诚华隆坚持市场导向与技术创新双轮驱动,走出了一条自主可控、稳扎稳打的国产算力发展道路。
发布会上,中诚华隆与十余家行业龙头企业达成战略合作,携手共建自主可控的国产AI算力产业生态。公司董事长王嘉诚博士表示,行业算力竞争已告别单纯参数比拼,进入推理效率、落地体验、产业价值的综合比拼阶段。中诚华隆将坚持“不做参数的追随者,只做推理效率的定义者”,推动国产算力从“可用”向“好用、易用、普惠、可盈利”全面升级。
据了解,中诚华隆是国内少数具备“芯片+整机+解决方案”全栈自主可控能力的科技企业,核心产品已服务国内头部运营商及政务、金融、能源等关键信息基础设施领域。(战钊)
