史无前例!美国出现人工智能失控事故,更多内幕曝光
2026-07-26 12:38 环球时报
另据两名知情人士透露,直到7月16日Hugging Face发表博客称遭到“自主AI Agent系统”攻击后,OpenAI才意识到攻击者可能是自家AI Agent。这意味着,从模型首次出现异常迹象到OpenAI确认其实施攻击,至少间隔了一周。两名参与调查的知情人士称,7月18日至19日,OpenAI员工在内部日志中发现线索,确认AI Agent已经突破测试限制。但路透社无法确认,是什么原因促使OpenAI重新检查相关日志。
4名了解OpenAI模型训练流程的人士表示,公司通常会同时开展多项模型测试,系统运行速度极快,产生的数据量巨大,员工有时难以及时处理这些数据。
报道称,在OpenAI通知Hugging Face之前,后者已向FBI报案。路透社未能确认FBI是否已正式立案调查。
AI Agent被视为当前AI产业最受关注的发展方向之一。支持者认为,它们未来可承担大量重复性工作,提高生产效率;但自主性增强,也意味着出现不可预测行为的风险上升。
长期研究AI Agent能力和行为的人工智能安全研究机构Palisade Research负责人杰弗里·拉迪什表示,先进AI模型为了完成任务或通过测试,可能会采取“撒谎、作弊甚至黑客攻击”等捷径。他认为,此次事件不仅让OpenAI面临压力,也暴露出整个AI行业在激烈竞争下,是否愿意投入足够资源强化安全防护的问题。
拉迪什表示,仅靠企业自律并不足够,应加强政府监管,否则相关安全措施很难得到充分落实。
来源:环球时报
责编:曲欣萍
