点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:人工智能还能这么干?全域敏感数据发现的秘密武器!
首页> 科技频道> 人工智能 > 正文

人工智能还能这么干?全域敏感数据发现的秘密武器!

来源:光明网2022-04-07 11:06

  随着大数据时代的到来,数据价值的深度应用成为助力企业发展的重要源动力。在企业的数字化转型过程中,加强数据治理、深化数据开发、保障数据安全成为释放数据价值的关键环节,而强化数据安全对企业的数字化转型和升级起着至关重要的作用。

  基于此,CIO时代、新基建创新研究院联合霍因科技推出“霍因安全观”系列线上微课堂,详细介绍数据安全治理的方法论、先进技术、典型案例及实践成果,展现数据安全治理的全生命周期管理,助力企业的数字化转型与升级。

  大数据时代,所有数据都具有了一定的价值。价值的背后潜藏着巨大风险,大量敏感数据被贩卖、窃取和无授权滥用,这一问题已经严重危害到个人隐私、企业发展甚至国家安全。

  首期“霍因安全观”系列微课堂,我们共同关注人工智能在全域敏感数据发现中的应用。

  如何迈好数据安全治理的第一步

  数据安全治理是企业安全管理的重要组成也是管理难点之一,随着《网络安全法》、《民法典》、《数据安全法》和《个人信息保护法》等国家相关法律法规的出台,以及地方性、行业性的规范及指导意见的实施,都体现出数据安全管理的重要性和必要性。但数据安全治理并不是一蹴而就的,从《GB∕T 37988-2019 信息安全技术数据安全能力成熟度模型》(DSMM模型)中可以看出,数据安全是涉及到数据完整生命周期的全过程安全管理。

人工智能还能这么干?全域敏感数据发现的秘密武器!

  图:《GB∕T 37988-2019 信息安全技术 数据安全能力成熟度模型》

  从数据安全过程管理角度看,数据采集阶段是践行DSMM数据安全管理的第一步。在数据采集阶段所需要做的数据发现、数据定义、数据分级分类等工作,是后续更好的完成数据过程管理的基础。

  全域敏感数据发现正在面临巨大挑战

  对于企业而言,数据安全的核心是针对特定的敏感信息实施安全防护。在数据安全治理中,数据采集阶段的重要目标是完成数据分类分级。可在执行中,企业通常会面临以下的一些挑战:

  1. 不知道哪些系统存有需要处置的数据?

  2. 只有数据库中的数据才需要管理么?

  3. 如何根据自身业务情况配置分类分级策略?

  由此可见,进行数据分类分级的前提是了解客户环境中全量数据情况。从目前主流的数据安全管理产品现状来看,除开进行敏感数据发现时手段单一之外,还存在以下两方面的问题:

  1. 支持的数据源范围有限:以主流的敏感数据扫描产品为例,在进行敏感数据发现时,主要面向的是数据库系统,但大量客户的数据使用环境并不是只有数据库,包括企业网盘、流程平台、大数据开发甚至IM通讯软件中都存有大量的敏感信息数据。

  2. 数据发现的手段单一:传统的数据安全产品依据的是大量定义正则表达式规则匹配完成数据库的敏感数据扫描。数据发现的范围及精准度完全依赖于正则规则丰富度及准确度。很难确保数据发现不出现遗漏、偏离等问题。

  除此之外,诸如大量人工配置、发现效率低等问题都制约了客户完成数据安全治理的目标达成。

  全域敏感数据发现的秘密武器

  1)善用机器学习的能力

  经过霍因的长期经验总结,机器学习是目前分析、理解、识别数据模式的最佳工具。在数据安全治理过中合理的借助机器学习的能力,能有效解决全域敏感数据发现过程中准确度、匹配度等问题。

  其次,机器学习具备广泛的技术适配性,可通过多种技术的复合应用来解决企业应用场景中异构数据类型及不同数据源的全域敏感数据的发现。

  例如,在针对传统敏感数据发现产品中不具备的非结构化数据扫描,可通过NLP(自然语言处理)技术进行扫描及敏感特征发现,还可以通过k-means算法技术完成相似数据的发现、聚类识别等。

  2)AI(人工智能)赋能全域敏感数据发现

  目前,企业生成的数据量正呈指数级增长,这是由于隐藏于数据库中所有未被发现的敏感信息进行评估而产生的。自动化的广泛应用,是可以有效提升数据治理的。因此,可通过两方面实现AI赋能全域敏感数据发现:

  1、基于AI发现能力:

  通过自动化嗅探技术将客户环境中的存储进行识别,并通过扫描样例数据摸底,初步梳理出客户的数据资产。包括:

  1)通过SQL检索摸底并梳理结构化数据库数据信息;

  2)通过NLP及对应的数据学习模型完成非结构化文档中的敏感数据解析;

  3)通过大数据连接组件及内置的正则式发现半结构化数据中的敏感信息。

  2、利用AI分类分级

  在了解客户基本数据环境情况以后,产品通过内置的智能分类器对全量数据进行自动化标签处理,并再结合法律法规的解读和导入进行自动化的分级分类处置。在处理过程中,通过聚类算法等方式提高处理效率及准确性。

  数据安全管理的前提是对全域全量数据的发现及合理化的分类分级,霍因数据安全治理平台可通过AI技术赋能数据安全治理过程,让客户了解数据现状,从而更好的开展后续数据安全管理工作。(霍因科技)

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 湖南轨道交通装备制造企业加紧生产

  • 广西强化防汛备汛工作

独家策划

推荐阅读
从1999年起,有着“神箭”称号的长二F火箭全程参与了中国载人航天工程“三步走”战略的每一步。它用100%的成功率,为航天员搭建出一条安全“天梯”。
2024-04-26 09:33
近期,人工智能(AI)+机器人赛道广受关注。尤翔宇表示,梳理人形机器人产业技术发展脉络,主要有底层硬件、运动控制和具身智能3条路线。优必选相关负责人表示,未来,公司将聚焦人形机器人的三大应用场景,包括工业制造、商用服务和家庭陪伴。
2024-04-26 09:41
中国工程院院士、中国探月工程总设计师吴伟仁在4月24日举行的2024年中国航天大会主论坛上透露,我国计划于2030年前后发射天问三号探测器,实施火星采样返回任务。
2024-04-26 09:40
春日里,云南双江县各大茶山的春茶迎来开采季。北回归线横穿而过的双江,拥有适宜茶树生长发育的自然条件,现有以“冰岛茶”为代表的百年以上栽培型古茶树3.69万亩。
2024-04-26 09:35
每年,都有这样一群“空中旅客”,南北来回奔波。迁徙之路漫长曲折,一路充满生死考验,它们却高声歌唱,不知疲倦地追逐着自己的目标。
2024-04-26 09:34
力争在生命科学等领域达到全球领先水平,在颠覆性技术和关键核心技术上实现重大突破;打造高水平人才集聚地,人才梯队体系较为完备,成为全球向往的创业乐土。
2024-04-26 09:26
4月25日20时59分,搭载神舟十八号载人飞船的长征二号F遥十八运载火箭在酒泉卫星发射中心点火发射,约10分钟后,神舟十八号载人飞船与火箭成功分离,进入预定轨道。航天员乘组状态良好,发射取得圆满成功。
2024-04-26 09:24
朱松纯表示,“通通”在日常学习与训练中,使用的A100芯片不超过10块,这意味着“通通”不依赖庞大的算力和海量数据就能学习成长。“通通”也可以与具身智能机器人相结合,为智能制造、智慧城市、医疗健康等领域带来革命性变化。
2024-04-26 09:38
日前,农业农村部发布非主要农作物品种登记撤销公告,撤销向日葵、黄瓜、甜瓜、油菜等问题品种312个,切实推进登记品种从严规范管理,持续营造激励创新、公平竞争的市场环境。
2024-04-25 10:36
英国牛津大学和美国麻省理工学院领导的一项新研究恢复了37亿年前的地球磁场记录,发现它与今天地球周围的磁场非常相似。
2024-04-25 10:34
“载人月球探测工程登月阶段任务经中央政府批准启动实施,总体目标是2030年前实现中国人登陆月球,目前各系统正按计划开展研制建设。神舟十七号航天员乘组在与神舟十八号航天员乘组完成在轨轮换后,计划于4月30日返回东风着陆场。
2024-04-25 10:32
国家卫健委24日发布的数据显示,2023年,我国居民健康素养水平达到29.7%,比2022年提高1.92个百分点,继续呈现稳步提升态势。 据了解,本次监测覆盖31个省(自治区、直辖市)的336个县(区)1008个乡镇(街道),对象为15岁至69岁的常住人口,共得到有效调查问卷73340份。
2024-04-25 10:30
中央气象台预计,24日夜间至26日白天,江南、华南等地雨势将再度加强,其中广东中部和西北部、广西东北部等地有大暴雨,局地伴有雷暴大风等强对流天气。
2024-04-25 10:28
日前,中国纤维质量监测中心发布2023年度新疆棉花生产加工过程质量状况监测结果。
2024-04-24 10:33
1998年,聂海胜成为我国首批航天员,先后执行过神舟六号、神舟十号、神舟十二号3次载人飞行任务。
2024-04-24 10:17
在北京航天飞行控制中心的统一调度下,酒泉卫星发射中心、西安卫星测控中心以及任务各测控站点实施联调联控,全面模拟发射准备、发射以及飞行过程中的各种技术状态和工作过程。
2024-04-24 10:16
1996年,我从技校毕业后,来到金川公司工作。当时总听师傅们讲,贵金属冶炼技术难以突破。提高我国铂族贵金属提炼的技术水平,对于守护国家安全极为必要。
2024-04-24 10:14
截至2023年底,我国大陆在运核电机组55台,总装机容量为57吉瓦,核准及在建核电机组36台,总装机容量为44吉瓦;全年核电发电量44万吉瓦时,占全国累计发电量近5%,相当于节约标煤1.3亿吨,减排二氧化碳3.5亿吨。
2024-04-24 10:05
截至2022年末,我国电动自行车社会保有量已达3.5亿辆。2023年,全国规模以上企业累计生产电动自行车4228万辆。
2024-04-23 04:00
加载更多