点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:深度解析:安全GPT检测大模型是怎样炼成的?
首页> 科技频道> 互联网 > 正文

深度解析:安全GPT检测大模型是怎样炼成的?

来源:光明网2023-12-28 11:33

  流量威胁检测的重要性无需多言。回顾发展历程,流量威胁检测技术经历了从正则匹配到语法语义匹配,再到结合统计分析、行为分析的机器学习小模型等技术路线。

  我们可以窥探其反映出攻击手段的升级迭代:从最开始带有明显特征,逐渐变成弱特征,甚至是组合利用的体系化攻击手法,再到最新的智能化手段运用。

  《世界互联网发展报告2023》中提到,网络攻防进入智能化对抗时代,低成本自动化的新形式网络攻击层出不穷。

  攻击者已经在利用AI大模型批量快速构建攻击工具、生成混淆攻击代码,并结合全方位立体攻击手法(如:0day 漏洞攻击、定向钓鱼、C2加密通信等)。很多人依然执着于通过持续叠加规则,包括结合云端情报等手段,让传统检测引擎应对新威胁,但这无异于以卵击石。

  深信服不沿袭老路,以Game Changer的思路独辟蹊径——利用大模型赋能流量检测。

  完爆传统检测引擎

  六项能力超越通用大模型

  深信服安全GPT可以作为检测引擎,赋能态势感知等传统安全设备,具备对未知攻击的意图理解、异常判定、混淆还原能力,当前已完成检测大模型的标准化落地。

  基于积累的千万条语料、千亿级Token的高质量训练数据,早在今年4月,安全GPT检测大模型的效果已显著超越了业界多家基于规则和小模型的流量检测引擎。经内部5000万样本数据测试,相比传统流量检测设备,安全GPT检出率由平均57.4%提升至92.4%,误报率由42.6%降低至仅4.3%。

  从实践中来到实践中去,安全GPT检测大模型一次次证明了自身实力:

  1.多方持续验证检测效果

  8月,在2023年大型实战攻防演练中,安全GPT检测大模型在没有任何先验知识的前提下,发现50+在野0day漏洞利用攻击。

  9-11月,深信服蓝军基于检测大模型的研判结果,捕获到了32个在野利用的0day漏洞,并将漏洞详情报送监管机构。

  10-11月,经多家用户验证安全GPT大模型,结果显示:针对25个高混淆数据包(可绕过传统引擎及通用大模型GPT-4),安全GPT检出率100%,其中针对三层混淆样本,传统引擎和通用大模型GPT-4均未检出;在实际网络环境中,与业界传统SOC、NDR产品进行对测,传统产品检出率平均12.5%,安全GPT检出率高达97.4%。

  2.六项能力均超越通用大模型

  结合安全专家经验,深信服从六个维度评估安全GPT检测大模型效果,分别是代码理解能力、攻防对抗理解能力、模型推理能力、安全基础知识能力、任务编排能力、模型幻觉对抗能力。

  结果显示,安全GPT检测大模型六项能力均超越通用大模型。

  我们知道,检测效果高度取决于对攻击代码的理解能力。通用大模型的参数至少十亿级别,其具有的理解、泛化、表达能力远超传统机器学习小模型,更非传统规则引擎可比拟。

  如今通用大模型已经可以对一段复杂的攻击代码进行高水平、准确地解读,不亚于人类高级专家。但深信服真正做到了把大模型能力运用到流量实时检测与研判中,并取得了更优异的效果。

  安全GPT检测大模型就像一个懂攻防、懂代码、懂协议的流量研判专家,对流量进行持续检测分析,从而发现传统检测引擎发现不了的高对抗、高绕过流量攻击。

  安全GPT检测大模型为何能降维打击?

  深信服通过知识蒸馏、模型量化、模型剪枝、Attention机制优化等,将安全GPT推理性能提升50倍,实现了在实际网络环境中,针对实时流量的实时检测。

  因而在实战考验面前,安全GPT取得了碾压式的优胜,从以下三个方面,几乎是对传统检测引擎的降维打击。

  1.少量样本/无样本前提下检出新型威胁

  传统语义分析技术开发成本高昂,且无法应对新型语言,导致传统检测引擎无法防御0day漏洞、高对抗攻击。

  安全GPT检测大模型通过学习大量开源的代码,先天性地对代码语义有深入理解,从传统代码片段Payload特征检测,进化到全报文综合分析的维度,能够挖掘弱特征攻击中的真实攻击目的,从而实现精准检测并减少误报。

  安全GPT 检测大模型还能触类旁通,实现更强的泛化能力,甚至能在少量样本/无样本的情况下,基于Zero/Few-Shot技术检测出新型威胁,因此大幅提升对0day漏洞攻击的检出率。

  2.破解攻击结果研判的业界难题

  众所周知,判定一个攻击是否成功是业界难题,也是安全运营工作中消耗大量人力精力的重头戏。传统的攻击成功检测引擎主要面临三大问题:攻击成功无回显、成功特征不固定、Payload混淆难理解的问题。

  安全GPT检测大模型不仅能还原攻击中的混淆Payload,还能从响应报文中动态识别其中是否存在攻击成功的特征。如下图中,通过将混淆的Payload还原成最简模式whoami,安全GPT能够准确识别攻击意图,进一步会关联分析响应的内容,从而判定攻击结果为成功。

  同时,针对攻击成功场景,不同的命令有不同的回显,有的命令回显无法提规则(比如whoami回显zhangsan)。安全GPT检测大模型在经过大量垂直领域数据训练后,能够找出潜在的攻击成功回显特征。

  3.自然语言辅助有效告警研判

  传统检测引擎在对威胁事件举证时,仅能通过高亮的方式展示恶意点。然而安全运营人员能力参差不齐,这种方式无法直接有效辅助其告警研判,时常导致高危事件的漏判误判。

  安全GPT检测大模型能够用自然语言对报文进行多维度剖析,辅助运营人员高效研判告警,突破人员能力和精力的瓶颈,真正实现“1个普通工程师+安全GPT检测大模型=N个安全专家”。

  安全GPT检测大模型是怎样炼成的?

  作为国内最早应用AI的网络安全厂商之一,早在2015年,深信服投入决策式AI技术的研究和应用。2016年,深信服不断加码AI技术并确立了AI First研发战略,在网络安全和云计算领域都有可落地、有效果的AI技术突破。

  由此,深信服积累了炼成安全GPT的必备要素:

  1.面向AI模型训练的高质量数据和算力

  持续累计的千亿级Token安全语料。

  自动化的训练数据生成和质量管理平台。

  55w+安全设备和组件接入云端。

  每日更新数千万训练样本。

  基于托管云的分布式算力平台。

  2.云网端智能产品架构

  数据采集/模型训练/部署落地全流程的安全产品。

  国内率先推出SASE、MSS等云化产品和服务。

  Genius AI研发平台模型训练速度提升3.5倍。

  全国100+节点托管云,支撑安全GPT贴近用户部署。

  3.四位一体的专家队伍

  快速组建既懂安全、又懂AI的专业团队。

  深信服相信,由“大模型+数据+安全和算法专家”形成的飞轮效应,将为安全GPT在威胁检测效果的提升持续带来巨大潜力。

  “世界上本没有路”,深信服将走出一条独特的安全GPT检测大模型之路,持续引领先锋体验,致力于每一位用户“安全领先一步”。(科文)

注:此文属于光明网登载的商业信息,文章内容不代表本网观点,仅供参考。
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 海南自由贸易港正式启动全岛封关

  • 在杭州,路过“树”的浪漫

独家策划

推荐阅读
中国科学技术大学教授潘建伟、张强等组成的研究团队与济南量子技术研究院、中国科学院半导体研究所等单位合作,通过混合集成分布式反馈激光器与薄膜铌酸锂光子芯片,成功实现了电泵浦片上集成的高亮度偏振量子纠缠光源,向集成化量子信息处理迈出重要一步。
2025-12-18 10:02
肺鱼,一种可以“绝境求生”的神奇生物,部分种类能在缺水时躲入泥中使用肺呼吸,直到雨季才复苏。借助高精度CT扫描与三维重建技术,乔妥、崔心东与团队其他成员对云南古嵴鱼展开了细致的关键形态特征观察。
2025-12-18 10:00
气温下降容易影响呼吸系统和循环系统。
2025-12-18 09:59
在这些应用成果中,人工智能大模型赋予机器人“大脑”,具身智能赋予机器人“小脑”与“四肢”,让它们学会像人一样思考和行动。蒸汽机延伸了人类的体能,计算机延伸了人类的智能,具身智能意味着一个“人机共生”的新纪元——机器人不再是冷冰冰的机器,而是生产生活中的得力伙伴。
2025-12-18 09:50
其中,“泛在操作系统”“高性能制造”“深部固体资源流态化开采”“超级微创手术”4项体系化新名词,均为我国科学家率先提出。超级微创手术经由自然腔道、隧道、穿刺通道、多腔隙通道,构建起覆盖全器官系统的技术体系。
2025-12-18 09:49
当晨曦穿透亚马孙雨林的薄雾,一组由废旧手机改装的声学传感器正竖起“耳朵”,人工智能(AI)模型在毫秒间分辨出三公里外链锯切割树干的异常声响。这一由AI编织的生态防护网络,正以超越人类感知的速度与精度,重构全球生态环境保护的技术版图。
2025-12-18 09:46
近期,一款名为重力眼罩的产品在各大电商平台迅速走红,成为众多消费者追捧的“助眠神器”。在首都医科大学附属北京世纪坛医院眼科主任医师解晓斌看来,商家宣传的“精准按压穴位”大多是营销话术,重力眼罩的助眠原理并非穴位按压。
2025-12-17 09:45
我1999年从海外回国,26年来,有两个梦日夜萦绕在脑海:一是作为一名物理学者征服世界级难题的“量子梦”,二是作为高等教育工作者为祖国培养一流人才、抢占科技高地的“强国梦”。
2025-12-17 09:40
2022年,我全职加入清华大学,建立求真书院,立志在中国本土培养更多数学人才。 展望“十五五”,国际形势风云激荡,我们要以高瞻远瞩的战略定力,在中国本土培育一批有能力、有魄力、敢于挑战前沿的年轻领军学者。
2025-12-17 09:39
《2022版中国科普期刊概览与目录》为科普成果认定提供了统一标尺。
2025-12-17 09:43
“不断地优化和发展新的专业结构,这是高校本身要做的。”北京林业大学校长李召虎表示,在高等教育不断发展的进程中,满足并引领社会发展是核心逻辑。
2025-12-17 09:23
题:抗流感、重养生,巧用中医方法安度寒冬 齐文升说,此时应尽量早睡晚起;饮食应减少生冷寒凉之物,适当食用牛羊肉、桂圆、核桃等温补食材,怕上火可适当添加银耳、百合或山药。
2025-12-17 09:46
长途出行,电动汽车、充电桩随处可见;冬天取暖,不再以烧煤为主,而转为电采暖……今天,我们身边用能电气化的场景愈发常见。
2025-12-16 10:13
记者从2026中国信通院深度观察报告会上获悉:“十四五”时期,我国6G发展处于愿景需求定义清晰、技术突破初见成效、标准研究全面启动的关键阶段。
2025-12-16 10:06
相较西方国家而言,中国现代科研体系起步较晚,直至改革开放后才重建硕博制度,科研力量逐步壮大。(作者系中国科学院院士,本报记者冯丽妃据其在新疆科普专家报告团活动中的发言整理)  《中国科学报》 (2025-12-16 第1版 要闻)
2025-12-16 10:02
种子休眠是指种子在适宜发芽的条件下仍“按兵不动”,直到环境真正安全才“启动”发芽,是农作物在驯化过程中被深刻改造的关键性状之一。研究发现,一个名为MKK3的基因通过“拷贝数+激酶活性”双轮驱动,塑造了大麦在全球不同气候区的休眠节律。
2025-12-16 09:58
区块链、云计算等技术的应用,正推动畜牧业形成从养殖到消费的全程数字化溯源体系,提升整体协同效率,创造产业协同新价值。推动数字技术与畜牧业深度融合,有赖于构建多方参与、协同推进的长效机制。
2025-12-16 09:55
作为国际上首个建成的新一代超大规模、超高精度的中微子实验装置,这里吸引着全世界的目光。细数这一年,更多创新成果从“实验室”走向“生产线”并落地应用场景,创新“势能”向经济“动能”不断转化。
2025-12-16 09:52
深海、极地,这两个词给普通人带来的是神秘又浪漫的感觉。但对于一线科研人员来说,却意味着枯燥与艰辛:在狭小的潜水器球舱里工作9个小时,为了工作甚至不敢多喝水;在零下十几摄氏度的后甲板上作业,海风吹在脸上如刀割般疼痛;在高达13级的风暴中,晕船到无法站立……
2025-12-15 09:56
12月12日中午,在北京中国科学院国家天文台会议室内,研究员刘继峰、王亚楠与中国科学院大学副教授黄样、华中科技大学教授雷卫华等正在聚焦1.2亿光年外的一场“宇宙风暴”—— 一颗恒星被超大质量黑洞撕裂,残骸形成炽热的吸积盘,并驱动喷流同步摆动。
2025-12-15 09:53
加载更多