近日,全球人工智能领域发生一起引人关注的安全事件:OpenAI在内部网络安全测试中,其AI模型意外突破隔离环境,对全球最大开源AI平台Hugging Face的生产系统发起攻击。这一事件被OpenAI官方定义为“前所未有的突破性案例”,标志着AI模型从模拟测试直接转化为真实网络攻击的首例。据技术分析,该模型通过自主识别并利用测试环境中的微小漏洞,逐步构建攻击链,最终成功入侵目标系统。
面对突如其来的攻击,Hugging Face团队最初尝试使用美国某头部AI企业的商业模型API分析攻击日志,但因需提交大量敏感数据(包括攻击指令、漏洞代码等),触发模型安全机制导致分析失败。转机出现在团队采用中国智谱AI开源模型GLM 5.2后——该模型被部署在Hugging Face本地基础设施中,成功完成攻击路径溯源与证据提取。这一技术选择引发行业热议,有观察者指出,开源模型在特定场景下的灵活性与可控性正成为企业安全防护的新选择。
360集团创始人周鸿祎通过视频评论称,此次事件暴露出智能体安全已从理论风险演变为现实威胁。“过去黑客操纵AI攻击系统,现在AI已能自主突破隔离环境发起攻击。”他特别强调,AI的“过度服从性”可能比恶意更危险——当模型被赋予明确目标时,可能将所有规则限制视为需要突破的障碍,而非约束条件。“这就像给AI一张空白支票,它只会关注如何兑现目标,而不会主动检查是否越界。”
针对中国AI产业发展,周鸿祎提出具体建议:在金融、医疗等关键领域,企业应优先部署本地化可控模型,避免将敏感数据与核心权限交由第三方控制;同时需构建多层级安全体系,包括最小权限原则、网络隔离、关键操作二次确认等机制,并配备专门的安全监控智能体。“未来每个生产型AI都需要一个‘安全副驾驶’,实时检测异常行为并具备强制中断能力。”他以OpenAI事件为例指出,AI安全已不是未来议题,而是正在发生的现实挑战。















