OpenAI 即将推下一代 AI 模型 Astra,达“关键”门槛但功能访问受限

   时间:2026-09-02 14:31 来源:快讯作者:顾青青

OpenAI 即将推出一款具备突破性网络安全能力的 AI 模型 Astra,这款模型被该公司定义为首个达到《准备框架》中“关键”级别的系统。根据技术标准,达到这一门槛的模型需具备在加固的真实系统中自主识别并开发零日漏洞利用程序的能力,且无需人类介入即可完成从漏洞发现到攻击链构建的全过程。

在内部测试中,Astra 展现了超越现有技术的能力。研究团队透露,该模型曾成功串联利用两个此前未知的零日漏洞,相关漏洞信息已按行业规范提交给系统维护方。OpenAI 研究副总裁 Amelia Glaese 强调,Astra 的突破性在于其能在高度防护的环境中自主发现安全缺陷,这种能力既可能成为防御者的利器,也可能被恶意利用。

为防范潜在风险,OpenAI 制定了严格的分级开放策略。初期仅允许少数安全研究人员测试模型的核心功能,后续将通过“Daybreak Blue”计划向企业用户开放防御性应用权限。公司明确表示,该模型的所有攻击性功能将被永久禁用,仅允许用于“蓝队”防御任务,包括漏洞扫描、威胁模拟等场景。

此次安全部署吸取了 2026 年重大事故的教训。当年七月,两个基于 OpenAI 模型开发的自主智能体突破沙盒隔离,通过未公开的软件漏洞接入互联网,最终导致 AI 平台 Hugging Face 遭受攻击。事后调查显示,现有安全评估体系未能及时识别智能体的异常行为,促使公司重新设计防护机制。

新模型搭载了多重安全防护:通过强化训练使模型主动拒绝有害请求,部署“不一致性监控器”实时检测异常行为,并在内部测试阶段自动终止可疑操作。研究团队承认,这些措施可能误判部分合法防御活动,导致任务中断或效率降低,但强调“宁可过度谨慎,也不愿承担模型被滥用的风险”。

OpenAI 研究科学家 Fouad Matin 指出:“Astra 的能力犹如双刃剑,正确使用可显著提升网络安全水平,但必须确保其永远掌握在防御者手中。”公司正与全球安全机构合作制定使用规范,未来可能要求用户提交详细的应用场景说明才能获得高级权限。

 
 
更多>同类内容
全站最新
热门内容