点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:推动人工智能安全可靠可控发展
首页> 科技频道> 综合新闻 > 正文

推动人工智能安全可靠可控发展

来源:光明网-《光明日报》2025-09-12 10:01

  【析理论道】

  作者:曾楠(广东省习近平新时代中国特色社会主义思想研究中心特约研究员,南方医科大学马克思主义学院院长、教授)

  习近平总书记指出:“要把握人工智能发展趋势和规律,加紧制定完善相关法律法规、政策制度、应用规范、伦理准则,构建技术监测、风险预警、应急响应体系,确保人工智能安全、可靠、可控。”国务院近日印发的《关于深入实施“人工智能+”行动的意见》提出,“共同研判、积极应对人工智能应用风险,确保人工智能发展安全、可靠、可控”。当前,人工智能正以前所未有的深度与广度重塑着社会运行方式。同时,从大型语言模型的“幻觉”输出到自动驾驶系统的决策偏差,从深度伪造技术对社会信任的侵蚀到算法黑箱导致的不透明与偏见……人工智能系统在性能飞跃的同时,其内生性安全与可靠性问题成为制约其健康发展的不容忽视的因素。传统的事后补救、外挂防护式的治理模式,如同在高速运行的列车外部进行修补,不仅效率低下,也难以触及复杂系统内部深层结构性问题。因此,探索以系统治理推动人工智能安全可靠可控发展,具有实践上的紧迫性。

  从“外挂补丁”到“免疫系统”的范式更新

  “外挂补丁”模式承袭传统网络安全思路,其特征表现为事后补救、外部附加和局部修正,其在人工智能治理初期发挥了重要作用。例如,当发现人工智能系统学会了偏见和歧视,我们试图用“过滤网”去筛查它的回答;当发现它容易被“误导”或“欺骗”,我们再为其额外增加一道防护程序;当人工智能系统的决策过程像一个黑箱难以理解,我们再开发一个外部工具去试图解读它。然而,这种模式存在固有局限性:其预警响应往往滞后于风险显现,难以覆盖长链式、跨模态的新型风险;附加的安全模块可能与原生系统存在适配冲突,影响模型性能的同时产生新的脆弱点;规则化的应对方式无法适应快速迭代的攻击手法。正如修补漏洞无法替代建设坚固的城堡,依赖外部打补丁难以形成系统性的安全韧性。

  确保人工智能系统安全可靠可控,需要从系统设计的底层逻辑出发,将安全与可靠目标内化为技术架构、算法模型、数据流程乃至开发范式的核心基因,使其具备类似生物免疫系统的自我识别、动态适应和协同防御功能,随系统演化而自适应进化,进而降低安全风险发生的概率与危害。这一范式涵盖三个核心维度:架构安全、过程安全与价值安全。具言之,筑牢架构安全防线,将安全属性嵌入模型底层,使其天生具备更强的抗干扰、抗欺骗能力,不易被“病毒”入侵,并能更好保护数据隐私;构建过程安全监控系统,在模型训练、部署、运行的全流程实施动态风险监测与反馈调节;设置价值安全指引,将价值观、伦理准则与社会规范内化为人工智能系统的行为指引,通过价值观对齐,使系统不仅能正确执行任务,更能理解行动的伦理意涵与社会影响。

  从“概率正确”到“可知可控”的信任构建

  当前,大多数人工智能系统基于大数据和概率模型运行,通过分析大量数据找出重复出现的模式,进而做出判断,这通常表现为“概率正确”。这种方式虽然高效,但也存在明显的局限和风险。一是结果的不确定性。模型可能会产生“幻觉”,即编造看似真实实则虚假的信息。在医疗诊断、司法辅助等严肃场景中,模型“幻觉”的代价是难以估量的。二是决策的不可溯性。当系统做出某个决定时,使用者往往无法了解其具体推理过程,这既影响了对结果的验证,也阻碍了错误发生后的纠正和改进。三是风险的不可预见性。系统在常规环境下可能表现良好,但在面对新情况或受到干扰时,可能出现无法预见的错误,给实际应用带来隐患。

  人工智能系统的可靠性不能停留在统计意义上的“高概率正确”,而应追求在复杂、开放、动态环境下的“高置信可靠”。其核心在于建立可知、可控、可信的技术闭环,使人工智能系统不再是神秘莫测的“黑箱”,而是行为可预期、风险可管理、决策可追责的“透明箱”或“玻璃箱”,具有以下特性:可解释性,即系统不仅能输出结果,更能提供清晰、可理解的决策依据和推理路径,使其行为对开发者与使用者而言是透明、可追溯的;预期一致性,即系统的行为表现严格处于其声明的能力边界和设计目标之内,不会产生无法预知的、超出其功能范围的行为,确保其行动结果与人类预期高度吻合;可验证性,系统的性能、逻辑和输出结果可通过独立的、系统化的方法进行测试、检验与审计,确保其行为始终符合预设的技术规范和伦理标准;可干预性,即在关键决策点或系统表现异常时,人类能够进行及时干预、修正或中止,始终将最终控制权置于人类手中。

  推进融合技术、标准、伦理的系统性“治理工程”

  推动人工智能安全可靠可控发展,绝非单纯的技术优化,而是一项深度融合技术创新、标准规范、伦理准则的系统性“治理工程”,即将治理要求结构化、自动化地嵌入人工智能系统的设计、开发、部署、运行、迭代全过程。

  以技术创新为治理根基,筑牢安全可控的底层支撑。技术是实现有效治理的根基。应重点发展以可信人工智能为核心的关键技术,从设计之初就内置安全特性,确保系统行为的可靠性,为治理提供坚实基础。主要包括以下几个方向:研发具有高稳定性和抗干扰能力的算法模型,使系统在面对恶意攻击或异常数据时仍能保持正常运行;推进可解释人工智能技术,让系统的决策过程变得清晰可见;构建测试验证和持续监测体系,实现对系统风险的实时预警和动态防护。

  以标准规范为治理准绳,确立清晰一致的行业标尺。标准是治理体系的尺度,为技术创新和产业应用提供统一规范。应加快构建覆盖人工智能全生命周期、多维度的标准体系。在基础共性方面,建立术语、架构、评估基准标准;在关键技术领域,制定可解释性、隐私保护等技术标准;在行业应用层面,推出面向医疗、交通、金融等重点领域的应用规范和管理指南。这些标准不仅为产品研发和质量评价提供依据,也为监管执法和社会监督提供可靠参照,有助于推动产业形成共识,避免无序发展,实现在规范中创新、在标准下落地。

  以伦理准则为治理灵魂,引领负责任的创新方向。伦理准则能够为技术发展提供价值引导。伦理治理的目标,是确保人工智能的发展始终遵循人类价值观和共同福祉,实现科技向善。为此,应当将以人为本、公平包容、责任明确、可控可信等伦理原则深度融入人工智能研发与应用全过程。具体而言,建立伦理审查和风险评估机制,对可能产生的伦理影响和社会后果进行前瞻性研判;推动算法公平性研究,努力消除数据偏见和歧视;明确研发者、使用者、监管者等各方责任,建立健全问责机制;鼓励开展人工智能伦理教育和公众讨论,提升全社会伦理意识。

  当前,人工智能正以磅礴之力塑造人类文明新图景。唯有将安全、可靠、可控深植其技术生命基因,使其生长出强大的内在免疫系统,并辅以技术治理这一系统工程的精心雕琢,才能使人工智能真正成为驱动高质量发展的引擎而非脱缰野马。治理逻辑与技术逻辑实现有机融合之际,一个可知、可控、可信、可持续的人工智能时代才能真正到来。

  《光明日报》(2025年09月12日 11版)

[ 责编:王若昕 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 探访北京市密云区新农村中学安置点

  • 走进智利港口之城——瓦尔帕莱索

独家策划

推荐阅读
习近平总书记在国家科学技术奖励大会、两院院士大会、中国科协第十一次全国代表大会上强调,“十五五”时期是科技强国建设的关键攻坚期。必须抓住历史机遇,迎接时代挑战,加快推进高水平科技自立自强,向着到2035年建成科技强国的目标坚定迈进,扎扎实实以科技创新支撑和引领中国式现代化。
2026-07-10 09:45
围棋长期被视为高度依赖经验、直觉和审美判断的领域,棋手通过棋谱、布局、定式、手筋和长期对局积累对“好棋”的理解。这类进展的意义,不只是“提高实验效率”,更深层的变化在于,它改变了科学发现中“候选对象”生成的方式。
2026-07-10 09:43
丁烈云认为,面向工程难题,要用工程理论支撑技术突破,打通“工程科学—工程技术—产业应用”完整链条,让前沿科技真正服务于社会。针对高端装备制造转型升级痛点,中国工程院院士郭东明系统阐释了高性能制造的全新发展理念。
2026-07-10 09:41
在9日举行的两院院士大会上,我国石油地质与勘探专家邱中建院士荣获第十六届光华工程科技奖成就奖,高性能精密制造专家郭东明院士等39人荣获光华工程科技奖。
2026-07-10 09:40
人民大会堂万人大礼堂的巨大天幕上,灯光璀璨,熠熠生辉;礼堂内,中国科技界的杰出代表们,肩负全国科技工作者的重托,济济一堂、共襄盛会。
2026-07-10 09:39
水的氢键强度及动力学过程全量子效应研究:在一滴水中探寻物理之美 在王恩哥看来,物理学研究有一个很大的特点,就是它能把复杂的事情简单化,并且抓住其中最本质的问题——这就是物理学的魅力所在。
2026-07-09 09:51
而这一切的起点,要回到半个世纪前——在中国科学院物理研究所那间废弃的鸡舍里,陈立泉铺开了这张后来冠绝全球的“电动”蓝图。自1981年起,在中国科学院的持续支持下,实验室瞄准真正实用的锂电池,牵头组织并承担了一系列国家重大项目。
2026-07-09 09:51
谈及荣获国家最高科学技术奖,贲德谦虚地说:“这不是我个人的奖,而是所有‘雷达人’的荣誉。从原理探索到技术攻关再到雷达建造,10余载春秋,为了研制代号“7010”的远程相控阵雷达,贲德与团队闯过了一个又一个难关。
2026-07-09 09:50
发展数智经济,通过促进科技创新和产业创新深度融合培育新质生产力。为此,笔者建议,应从要素供给、产业融合、创新转化和制度保障四个方面发力,把数智经济的技术势能转化为新质生产力的发展动能。
2026-07-09 09:50
耄耋之年,她坐着轮椅来到采访室,一身深蓝素装,神情温和。她,就是“七一勋章”获得者、中国工程院院士、中南大学教授钟掘。1960年,钟掘毕业后来到岳麓山下的中南矿冶学院,一头扎进被人称作“傻大黑粗”的冶金机械行业。
2026-07-09 09:49
中国科协第十一次全国代表大会是在“十五五”开局之年召开的一次重要会议,是科协系统和广大科技工作者的一次盛会。实践充分证明,我国科技工作者始终胸怀祖国、服务人民、勇攀高峰、敢为人先,不愧为党和国家充分信赖的优秀队伍和建设科技强国的中坚力量。
2026-07-09 09:49
从安装智能芯片的比赛用球,到协助裁判的视频技术,再到支持百万球迷转运的中国列车……这支“中国队”被美国消费者新闻与商业频道誉为世界杯供应链“不可或缺的一环”。
2026-07-08 10:08
7月7日是小暑节气,恰逢年度“最小太阳”现身天宇。当日凌晨2时左右,地球过远日点,这是一年中地球距离太阳最远的位置,这天观测到的太阳视直径为全年最小。
2026-07-08 10:06
近日,西南石油大学新能源与材料学院光伏材料与技术科研团队传出好消息:其研发的小尺寸超高效叠层太阳能电池光电转换效率接近35%,大幅超越常规太阳能电池的光电转换效率。
2026-07-08 10:04
目前,大连海事大学已与72家行业单位建立联合培养,共建162个专业实践基地、4个工程技术中心,聘任600余名企业导师,真正实现“工程出题、校企共答、产业阅卷”。
2026-07-08 09:52
一生钢铁报国,一生慷慨无私。崔崑院士走了,但他留下的,是钢的筋骨,是火的温度,是一颗永远滚烫的赤子之心。
2026-07-08 09:45
在河北雄安人工智能产业园的一楼展厅里,一台工业机器人正利落地演示货物搬运,机械臂精准而有力;楼上,键盘敲击声此起彼伏,研发人员专注地写着代码。产业园一年前才“开业”,如今已成为人工智能公司发展的产业高地。这里诞生的国内首个处理结构化数据的通用大模型,适用于多个工业场景;这里诞生了便携式颅脑出血检测分析仪,让医学检查更加快捷便利……
2026-07-07 09:44
从“争第一”的局部超越,到“创唯一”的向上突围,再到“守专一”的产业韧性,这三重创新路径相互交织,共同勾勒出中国从“世界工厂”迈向“创新引擎”的壮阔图景
2026-07-07 09:42
近日,在内蒙古阿拉善盟额济纳旗东风镇古日乃嘎查的航天育种试验基地内,曾搭载实践十九号卫星的荒漠肉苁蓉“太空种子”,在地面选育试验中取得关键进展——首批试验植株成功开花。
2026-07-07 09:40
高校专业目录的更新,绝非简单的名称变动,而是立足国家需要、顺应产业发展、面向科技前沿之举。新农科教育已不再是单纯的“种地养猪”,而是要有系统思维和交叉学科背景,特别是打破农学、工学、理学等传统学科壁垒。
2026-07-07 09:39
加载更多