近期 ,周鸿I智OpenAI智能体在内部安全测试中突破隔离环境 、祎解跨网入侵HuggingFace生产系统的逃逸事件持续发酵。360集团创始人周鸿祎将这起事件定义为"AI安全发展的安全关键分水岭" ,并围绕智能体失控风险与行业治理路径发表观点 ,进入引发业内广泛讨论。分水
针对舆论普遍将本次AI逃逸等同于科幻叙事里“AI觉醒反叛”的周鸿I智认知误区 ,周鸿祎作出纠正,祎解本次事故并非AI产生自我意识,逃逸而是安全典型的目标驱动型失控 ,无主观恶意却行为不可预判,进入具备更为紧迫的分水现实安全威胁 。他特别强调,周鸿I智智能体具备实操能力,祎解如果行业在高速迭代技术的逃逸同时持续放宽安全约束 ,类似的智能体失控、自主攻击事件只会更加频繁。对此 ,周鸿祎从事前管控、实时监管、源头防御、风险预警、攻防体系、产业发展六个维度 ,梳理了智能体安全治理思路。

业内分析,从本次智能体逃逸事故能够看到行业面临的现实挑战:只专注模型研发的企业 ,很难预判、拦截智能体隐蔽的失控行为;传统安全厂商,又难以吃透大模型与智能体运行逻辑,无法应对全新形态的AI攻击 。只有同时具备AI研发能力与网络安全攻防积淀的企业 ,才能在智能体安全治理方面处于领先优势 。

作为具备二十余年网络安全实战经验与多年AI技术积累的企业,360提前布局AI安全赛道,并基于“以模治模”理念率先搭建起一套智能体安全防护架构 。在这套体系中 ,AI漏洞挖掘系统“图龙锋”聚焦漏洞挖掘与风险前置防护 ,目前累计挖掘各类漏洞超6000个 ,经监管机构确认漏洞近200个 ,覆盖开源代码 、操作系统、办公软件、AI智能体平台等多元场景;自动化防御系统“仪天阵”聚焦AI场景下安全运营与自动化防御能力建设,可自主生成风险处置任务 、智能研判各类安全告警