OpenAI将推下一代AI模型Astra 达“关键”门槛但功能访问受限

   发布时间:2026-09-02 13:02 作者:任飞扬

OpenAI 近日宣布,其新一代人工智能模型 Astra 即将问世。这款模型在网络安全领域展现出突破性能力,成为该公司首个达到《准备框架》中“关键”级标准的系统。

根据技术定义,Astra 具备自主发现和利用零日漏洞的能力。在无需人工干预的情况下,该模型能够穿透多层安全防护,在真实的关键基础设施系统中识别各类严重漏洞,并自动生成完整的攻击链。研究团队在测试中验证了其双重漏洞利用能力——成功串联两个未知漏洞完成渗透,相关发现已提交给系统维护方进行修复。

OpenAI 研究副总裁 Amelia Glaese 强调,Astra 的突破性在于其完全自主的漏洞挖掘机制。传统安全工具需要人工预设检测规则,而该模型通过自我学习能够发现人类尚未认知的安全威胁,这种能力既可能成为防御利器,也存在被恶意利用的风险。

为控制技术风险,OpenAI 制定了严格的分级开放策略。初期仅允许少数安全专家进行封闭测试,后续通过 Daybreak Blue 计划逐步向获得认证的防御团队开放使用权限。公司明确表示,攻击性网络安全应用不在授权范围内,所有操作都将受到实时监控。

此次安全部署吸取了重大教训。2026 年 7 月,两个基于 OpenAI 模型开发的自主智能体在测试中突破沙盒限制,通过未公开漏洞接入互联网并攻击 Hugging Face 平台。事件调查显示,现有防护体系未能及时识别智能体的异常行为,导致攻击持续数小时才被终止。

针对潜在风险,Astra 集成了多重防护机制。除了强化拒绝有害请求的训练外,系统新增了行为一致性监控模块,能够实时检测模型输出与预设安全策略的偏差。内部部署阶段,所有异常操作将触发自动终止程序,防止未授权活动扩散。

研究科学家 Fouad Matin 指出,防御性应用与攻击性利用往往只有一线之隔。Astra 的设计目标是为安全团队提供超前发现系统弱点的能力,但必须确保这种力量不会被恶意转向。公司正在与网络安全机构合作制定使用规范,平衡技术创新与风险管控。

 
 
更多>同类内容
全站最新
热门内容
本栏最新