点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:源2.0-M32大模型发布4bit/8bit量化版
首页> 科技频道> 互联网 > 正文

源2.0-M32大模型发布4bit/8bit量化版

来源:光明网2024-08-24 10:52

  近日,浪潮信息发布源2.0-M32大模型4bit和8bit量化版,性能比肩700亿参数的LLaMA3开源大模型。4bit量化版推理运行显存仅需23.27GB,处理每token所需算力约为1.9 GFLOPs,算力消耗仅为同等当量大模型LLaMA3-70B的1/80。而LLaMA3-70B运行显存为160GB,所需算力为140GFLOPs。

  源2.0-M32量化版是“源”大模型团队为进一步提高模算效率,降低大模型部署运行的计算资源要求而推出的版本,通过采用领先的量化技术,将原模型精度量化至int4和int8级别,并保持模型性能基本不变。源2.0-M32量化版提高了模型部署加载速度和多线程推理效率,在不同硬件和软件环境中均能高效运行,降低了模型移植和部署门槛,让用户使用更少的计算资源,就能获取源2.0-M32大模型的强大能力。

源2.0-M32大模型发布4bit/8bit量化版

  源2.0-M32大模型是浪潮信息“源2.0”系列大模型的最新版本,其创新性地提出和采用了“基于注意力机制的门控网络”技术,构建包含32个专家(Expert)的混合专家模型(MoE),模型运行时激活参数为37亿,在业界主流基准评测中性能全面对标700亿参数的LLaMA3开源大模型,大幅提升了模型算力效率。

  模型量化(Model Quantization)是优化大模型推理的一种主流技术,它显著减少了模型的内存占用和计算资源消耗,从而加速推理过程。然而,模型量化可能会影响模型的性能。如何在压缩模型的同时维持其精度,是量化技术面临的核心挑战。

  源2.0-M32大模型研发团队深入分析当前主流的量化方案,综合评估模型压缩效果和精度损失表现,最终采用了GPTQ量化方法,并采用AutoGPTQ作为量化框架。为了确保模型精度最大化,一方面定制化适配了适合源2.0-M32结构的算子,提高了模型的部署加载速度和多线程推理效率,实现高并发推理;另一方面对需要量化的中间层(inter_layers)进行了严格评估和筛选,确定了最佳的量化层。从而成功将模型精度量化至int4和int8级别,在模型精度几乎无损的前提下,提升模型压缩效果、增加推理吞吐量和降低计算成本,使其更易于部署到移动设备和边缘设备上。

  评测结果显示,源2.0-M32量化版在多个业界主流的评测任务中性能表现突出,特别是在MATH(数学竞赛)、ARC-C(科学推理)任务中,比肩拥有700亿参数的LLaMA3大模型。

  源2.0-M32大模型量化版在保持推理性能的前提下,显著降低了计算资源消耗和内存占用,其采用的GPTQ量化方法通过精细调整,成功将模型适配至int4和int8精度级别。通过定制化算子优化,源2.0-M32量化版实现了模型结构的深度适配和性能的显著提升,确保在不同硬件和软件环境中均能高效运行。未来,随着量化技术的进一步优化和应用场景的拓展,源2.0-M32量化版有望在移动设备和边缘计算等领域发挥更广泛的作用,为用户提供更高效的智能服务。(科文)

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • “肇兴中国:秦·大一统之路文物考古特展”在上海博物馆东馆启幕

  • 河南小麦大规模机收基本结束

独家策划

推荐阅读
“在洞窟里,把冷光灯打开,面对着千年壁画的那一刻,所有的烦恼都会瞬间远离,觉得能近距离接触如此杰出的艺术品,是很震撼、很幸运又很幸福的事。遵循这一“笨规矩”,于宗仁组织完成了莫高窟与甘肃省内外多处壁画彩塑保护方案与实施工作,例如莫高窟千像塔彩塑保护修复、莫高窟第196窟壁画彩塑保护修复,以及麦积山石窟部分洞窟的塑像壁画保护修缮等。
2026-06-11 10:23
国际科技出版机构施普林格·自然10日发布的自然指数2026科研领导者榜单显示,中国继续保持全球第一,2024年至2025年科研产出增长22.4%,是全球十强中唯一实现两位数增长的国家。机构表现方面,自然指数显示,中国科学院整体排名位列榜首,在除健康科学和社会科学以外的5个学科领域位居第一。
2026-06-11 10:23
量子传感是一种利用量子效应进行高精度测量的新技术。量子传感可通过增加粒子数量来提高传感性能,然而这面临一个重要挑战——量子热化。“这不仅深化了人们对量子热化这一基础科学问题的认识,也为发展新一代高灵敏度量子传感器提供了新的思路。
2026-06-11 10:23
扎根智能制造一线,很多像马遵农一样的年轻人用技术创新护航制造业转型升级。如今,基于模型的系统工程等方法已应用于飞机制造的各个环节,新工艺的研发更高效、更精准、更节约。
2026-06-11 10:23
阶段扩建,计划新增一个综合舱段,让空间站整体构型从“T”字变为“十”字。从初具规模的三舱组合,到不断扩容升级,中国空间站的成长,是中国载人航天稳步发展的缩影。
2026-06-11 10:23
6月9日16时23分,朱雀二号改进型遥六运载火箭在东风商业航天创新试验区发射升空。
2026-06-10 09:57
6月8日,火烈鸟在盐湖湿地嬉戏,成为一道亮丽风景线。
2026-06-10 09:57
日前,长江干线首个“复式航道”在安徽土桥水道和大通水道试运行,预计每日分流200余艘上行浅吃水船舶。
2026-06-10 09:52
近年,智能除锈凝胶与高相容性的新型加固材料的研发与成功应用,分别为脆弱青铜器无损清除锈蚀病害与矿化层加固提供了创新方法。
2026-06-10 09:51
为了让更多患者在关键时刻“用得上、用得起”,一群年轻的航天人坚定踏上了国产ECMO攻关之路。
2026-06-10 09:48
作为长江、黄河、澜沧江发源地,青海多年来持续推进三江源水生生物资源保护修复,持续巩固青海省高原河湖生态屏障。据悉,此次大批量土著鱼苗放流,进一步充实了黄河上游鱼类资源储备,对修复河道生物群落、改善水域生态环境具有积极作用。
2026-06-09 09:57
记者从自然资源部中国地质调查局获悉,“海洋地质六号”船近日完成深海地质调查第16航次科考任务,在深海地质环境调查、海洋探测关键技术装备研发应用等方面取得多项成果。
2026-06-09 09:56
培育新质生产力、建设现代化产业体系,是推动经济高质量发展、夯实中国式现代化产业根基的重要任务。未来产业依托前沿技术与颠覆性创新引领发展方向,赋能传统产业与新兴产业,拓展发展边界、培育全新增长点。
2026-06-09 09:52
人工智能与数智技术的发展,无疑是当下人们最为关切的议题之一。
2026-06-09 09:50
耕地是保障粮食安全的根本。当前,我国耕地质量总体呈现稳中有升良好态势,东北黑土地保护性耕作面积持续扩大,南方酸化耕地治理和北方盐碱地改造利用均取得积极进展。
2026-06-09 09:36
6月5日,记者从哈尔滨医科大学获悉,该校周钦、崔飞云教授科研团队融合人工智能、表面增强拉曼光谱检测与血液代谢分析技术,打造出一款全新的血液代谢分子解析检测平台。阿尔茨海默病是高发老年神经退行性疾病,依靠血液样本进行早期微创筛查,即液体活检,是当下临床医学的热点话题。
2026-06-08 09:56
近日,在山东胜利油田油区护卫中心,飞手贾承斌坐到电脑前,轻点鼠标,操纵室外无人机群升空。
2026-06-08 09:57
生态环境部日前发布的《中国履行〈生物多样性公约〉第七次国家报告》显示,截至2025年底,与生物多样性有关的27个国家目标中,我国有21个目标取得显著进展。
2026-06-08 09:57
大国工匠是我们中华民族大厦的基石、栋梁。大国工匠作为各领域的技艺集大成者,是工匠精神的生动代言人和时代典范,他们身上闪耀着执着专注、精益求精、一丝不苟、追求卓越的光彩。
2026-06-08 09:57
“甘肃是我国著名的‘有色金属之乡’,镍、钴、铂族金属等矿产资源储量全国领先,在国家战略资源安全保障中具有不可替代的地位。项目组将充分吸纳专家意见,力争提出务实管用、可落地、能实施的咨询建议,为保障国家资源安全贡献“甘肃方案”。
2026-06-08 09:57
加载更多