OpenAI承认其模型失控 专家:AI安全治理迫在眉睫
2026-07-24 06:22 央视新闻客户端
美国开放人工智能研究中心(OpenAI)21日承认,该公司的GPT-5.6模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸公司的系统。美国抱抱脸公司最后使用了中国公司的AI模型,得以及时采取应对措施。
这种“自主性”是模型能力增强的必然副产品,还是训练方式出了某种偏差?这起事件对AI行业和网络安全有什么启示?来听中国社会科学院大学数字中国研究院特聘研究员、数字经济学者刘兴亮的解读。
专家:AI失控可能是模型能力提升带来的结果
中国社会科学院大学数字中国研究院特聘研究员 刘兴亮:我个人更倾向于认为,这是模型能力提升带来的一个自然结果。大家可以把AI理解成一个特别聪明、执行力特别强的员工。你给它一个目标,它不会只等着别人安排下一步,而是会自己规划路径、寻找工具解决障碍。这一次的测试里,当正常路径走不通的时候,它就去寻找其他能够完成目标的方法,包括利用漏洞,寻找互联网出口。这说明它越来越会做事,而不是越来越有意识。真正需要解决的问题不是让AI变笨,而是让AI知道哪些边界绝对不能跨越。
专家:AI的发展速度要求安全体系全面升级
中国社会科学院大学数字中国研究院特聘研究员 刘兴亮:过去我们更多是在防黑客,以后可能还要防AI驱动的攻击,甚至会出现AI攻击、AI防御、AI取证这样的新格局。这意味着网络安全将进入AI对AI的时代。

