关注我们: 微信公众号

扫码关注我们

OpenAI 紧急叫停 Astra 部分研发,最高风险警报拉响

云头条 2026-08-09 13

2026 年 8 月 8 日,OpenAI 披露即将推出的新模型 Astra 在智能体编程和网络安全方面取得显著进展。

4.png

根据最近几天的内部测试和专家评估,OpenAI 目前无法排除 Astra 已达到其《准备框架》中的“关键级”(Critical)网络安全能力门槛。

5.png

OpenAI 强调,这一结论仍属于初步判断,正在继续对 Astra 进行基准测试和能力评估,尚未正式确认其已经达到关键级。

不过,现有测试结果已经足以促使 OpenAI 提前按照这一最高能力等级加强安全措施。 

按照 OpenAI 的定义,一款模型达到关键级网络安全能力,需要具备以下两种能力之一:

1)在没有人工干预的情况下,对大量经过加固的真实关键系统发现漏洞,并开发出可实际运行、覆盖不同严重程度的零日漏洞利用程序;

2)或者只需获得一个高层级攻击目标,就能自行设计并执行针对加固目标的全流程新型网络攻击。

此前,包括 GPT-5.6-Sol 在内的 OpenAI 模型,网络安全能力均被评估为“高级”(High),尚未达到关键级。 

针对 Astra 可能出现的能力跃升,OpenAI 已经加强模型开发和测试过程中的安全控制,包括使用隔离测试环境,限制网络和工具访问,加强模型权重保护和加密,增加监控、检测能力,并在沙箱环境中运行模型。

OpenAI 同时暂停了所有尚未达到上述强化安全要求的 Astra 内部活动。暂停范围并非 Astra 的全部训练和测试,而是安全控制尚未达到新标准的相关工作。 

在监控方面,OpenAI 已经对 Astra 的所有智能体应用实施统一风险监控,覆盖模型训练和评估环节。监控系统将检查模型的思维过程,识别潜在的高风险行为或目标偏离,并触发安全响应,由相关人员审查和中断有关活动。

OpenAI 还计划与相关政府机构及部分人工智能安全组织共同测试 Astra,并向参与高风险评估的第三方合作伙伴提供安全控制建议,降低模型测试和工作负载运行期间的风险。 

OpenAI 表示,具备高级网络安全能力的模型也可以用于帮助防御方更早发现和修复漏洞,但随着模型能够更快、更大规模地执行复杂任务,同样可能被用于发动网络攻击,因此需要在模型正式部署前验证现有安全措施是否足以应对新的能力水平。

OpenAI 同时澄清,Astra 是一款尚未发布的模型,与此前针对 Hugging Face 的安全事件无关。 

云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。

关键词:

网友留言2

未查询到任何数据!
◎欢迎您留言咨询,请在这里提交您想咨询的内容。