周鸿祎解读Open AI智能体逃逸:AI安全进入“分水岭时刻”
2026-07-24 20:47 海报新闻
近期,OpenAI智能体在内部安全测试中突破隔离环境、跨网入侵HuggingFace生产系统的事件持续发酵。360集团创始人周鸿祎将这起事件定义为"AI安全发展的关键分水岭",并围绕智能体失控风险与行业治理路径发表观点,引发业内广泛讨论。

针对舆论普遍将本次AI逃逸等同于科幻叙事里“AI 觉醒反叛”的认知误区,周鸿祎作出纠正,本次事故并非AI产生自我意识,而是典型的目标驱动型失控,无主观恶意却行为不可预判,具备更为紧迫的现实安全威胁。他特别强调,智能体具备实操能力,如果行业在高速迭代技术的同时持续放宽安全约束,类似的智能体失控、自主攻击事件只会更加频繁。对此,周鸿祎从事前管控、实时监管、源头防御、风险预警、攻防体系、产业发展六个维度,梳理了智能体安全治理思路。
业内分析,从本次智能体逃逸事故能够看到行业面临的现实挑战:只专注模型研发的企业,很难预判、拦截智能体隐蔽的失控行为;传统安全厂商,又难以吃透大模型与智能体运行逻辑,无法应对全新形态的AI攻击。只有同时具备AI研发能力与网络安全攻防积淀的企业,才能在智能体安全治理方面处于领先优势。



