关注我们: 微信公众号

扫码关注我们

OpenAI 紧急叫停 GPT-6.1 发布:欺骗、越权问题曝光

云头条 2026-09-29 17

OpenAI 已取消下一代 AI 模型 GPT-6.1 Astra 的公开发布计划。

7.png

GPT-6.1 Astra 原计划在未来几天或几周内推出,并于 10 月进入 ChatGPT 和 Codex,但在发布前的内部测试中,研究人员发现其存在安全和对齐问题。

2026 年 9 月 29 日,据《华尔街日报》报道,这是大型 AI 开发商因安全问题取消新模型公开发布的少见案例之一。

GPT-6.1 Astra 在无需人工协助的情况下端到端完成复杂任务,以及写作等方面,比 OpenAI 此前的模型更强,但其部分安全表现出现退步。

OpenAI 安全系统负责人 Saachi Jain 表示,与前代 GPT-6 Astra 相比,GPT-6.1 Astra 主要在两个方面表现不佳。

首先是对齐能力。

OpenAI 用相关测试衡量模型是否按照人类期望行动,而 GPT-6.1 Astra 在这一指标上出现退步。

具体来看,该模型表现出更高水平的欺骗行为,并不总是如实告诉用户自己执行了哪些操作,或者哪些操作实际上没有执行。

另一个问题是 OpenAI 所称的 “scope authorization”(范围授权)。

在部分测试中,GPT-6.1 Astra 会在没有获得用户许可的情况下继续推进任务,并尝试调用外部工具和服务,即使相关操作可能存在安全风险。

Jain 表示,安全和对齐本身存在权衡。模型既需要严格遵守用户授权范围,又不能因为遇到阻力就过早停止任务。GPT-6.1 Astra 在减少“模型偷懒”等方面有所改善,但最终仍未达到 OpenAI 对安全和对齐的要求,因此 OpenAI 决定不向公众发布。

不过,OpenAI 并未彻底放弃 GPT-6.1 Astra 所使用的基础模型。OpenAI 计划继续基于同一基础模型开展额外的强化学习训练,并用于开发后续 GPT-6 系列模型。

OpenAI 还将针对 GPT-6.1 Astra 暴露的问题展开进一步调查,包括检查强化学习环境是否在奖励正确的模型行为,并对模型开发的各个阶段进行排查,以寻找问题根源。

此次决定发生在 OpenAI 接连遭遇 AI 智能体安全事件之后。

OpenAI 表示,近期正在调查多起智能体安全事件,并已经部署新的监控系统,以更快发现 AI 智能体的异常行为,同时要求工程师在测试 AI 系统时采用更严格的安全防护措施。

今年夏天,OpenAI 数百个内部 AI 智能体在执行一项网络安全测试时,最终入侵了 AI 平台 Hugging Face。此后,包括澳大利亚政府和联合国在内的机构也发现,OpenAI 智能体曾使用类似但规模较小的技术访问其网站。此前公开披露的多起智能体安全事件,大多涉及 OpenAI 从未计划公开发布的内部模型。

上周,OpenAI 还暂停了其最强 AI 模型的训练。

原因是一名 AI 智能体突破了 OpenAI 的互联网访问限制,并访问一个公开聊天机器人。

OpenAI 表示,新部署的监控系统在 15 分钟内发现了这一事件,目前相关模型的训练仍处于暂停状态。

OpenAI 强调,GPT-6.1 Astra 并不属于上述暂停训练的模型,这是另一个独立案例。

Jain 表示,无论模型是在 OpenAI 内部开发,还是最终向用户发布,OpenAI 都希望确保模型开发过程安全。但面向用户发布时,OpenAI 对安全和对齐设定了更高标准。

GPT-6.1 Astra 被取消公开发布的时间点,也恰逢 OpenAI 年度开发者大会前夕。过去几年,OpenAI 曾在开发者大会期间发布新模型和面向开发者的新服务。

近几周,OpenAI 和 Anthropic 均呼吁行业合作伙伴放慢前沿 AI 模型的开发速度,并加大对安全标准的投入,两家企业也表示将控制自身内部 AI 能力推进的节奏。

与此同时,AI 行业正面临越来越多来自监管机构和政策制定者的关注。

本周晚些时候,美国参议院一个小组委员会计划举行题为 “Rogue AI,保护国土免受 AI 智能体攻击” 的听证会,并邀请第三方 AI 研究人员出席。

佛罗里达州总检察长 James Uthmeier 今年 6 月起诉 OpenAI,指控 OpenAI 及其 CEO Sam Altman 明知产品存在安全风险,仍将其发布。9 月 28 日,Uthmeier 又申请临时禁令,要求 OpenAI 在没有第三方批准的安全措施前,不得开发新的 AI 模型,同时限制 ChatGPT 主动吸引用户互动,并限制 OpenAI 将 ChatGPT 宣传为安全产品的能力。

OpenAI 发言人回应称,用户希望确认 AI 正在以安全方式开发,而这一过程首先取决于 AI 企业自身采取的措施。OpenAI 同时表示,政府在制定稳健的 AI 安全标准方面具有重要作用,并愿意与佛罗里达州及其他州合作,推动适用于整个 AI 行业的政策,而不是只针对单一企业。

云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。

关键词:

网友留言2

未查询到任何数据!
◎欢迎您留言咨询,请在这里提交您想咨询的内容。