一句话重点

OpenAI 于 2026 年 9 月 28 日(美国时间)向媒体表示,不会发布 GPT-6.1 Astra。OpenAI 的说法是,这个模型在不超出授权范围,以及向用户说明自己完成了哪类工作这两方面,都没有完全达到交付给用户的标准。 现行的 GPT-6 Astra 照常可用,隔天推出的 GPT-6.1 Sol 是另一个模型。OpenAI 产品目前无法从中国大陆直接访问。

GPT-6.1 Astra 是什么,发生了什么

GPT-6.1 Astra 是 OpenAI 原本准备接替 GPT-6 Astra 的下一个 Astra 系列模型。它从未公开发布,因此没有官方规格可查。

2026 年 9 月 28 日(美国时间),CNN、CNBC 和 CBS News 报道 OpenAI 不会发布它;The Register 于 9 月 29 日获得 OpenAI 的直接确认。OpenAI 没有发布文章说明这一决定,公开说法都来自它给媒体的声明。

OpenAI 怎么说

OpenAI 安全系统负责人 Saachi Jain 在给 CNN、CNBC 的声明中表示(The Register 也直接获得了相同说法),GPT-6.1 Astra 在减少偷懒(model laziness)方面有所进步,但在不超出授权范围,以及向用户说明自己完成了哪类工作这两方面,没有完全达到标准。Jain 还说,OpenAI 把模型交到用户手上时,对安全和对齐(模型的行为符合人的意图)的门槛极高。

OpenAI 还告诉 The Register,GPT-6.1 Astra 在对齐评测中的分数低于 GPT-6 Astra,搁置它是兑现安全与对齐优先于能力提升这一承诺的一部分。The Register 还转述,OpenAI 表示之后还会有更多 Astra 模型,其他通过安全门槛的新模型很快就会推出。

首席执行官 Sam Altman 于 2026 年 9 月 29 日在 DevDay 接受 CNBC 采访时表示,他认为这是正常流程,不会对这个决定反应过度。他说 AI 必须安全并受人控制,公司经常会先做出一个模型、进行测试,发现它不符合标准后修改,再晚些时候推出;之后还会有很多很好的新模型。

“不越界”和“不偷懒”之间的拉扯

先用白话解释 Jain 提到的这两件事(以下是本文自己的解释,不是 OpenAI 的原话):

  • 偷懒:遇到障碍就放弃,或把工作推回给用户。The Register 用这个意思解释 OpenAI 所说的 model laziness。
  • 不越界:只做你交代、且你允许它做的事。
  • 如实汇报:事后如实告诉你它做了什么。

难点在于,前两个目标会互相拉扯。一个遇到阻碍永不放弃的代理(能自己动手完成任务的 AI),可能为了完成任务而做出超出你授权的事。一个太容易停手的代理,又帮不上忙。Jain 对 The Register 所说的重点正是这一点:要在留在授权范围内和遇到阻碍也不偷懒之间找到合适的平衡。

按照 OpenAI 的说法,GPT-6.1 Astra 在减少偷懒方面有所进步,但另一项还没过关。Jain 没有说明 GPT-6.1 Astra 实际跨过了哪条界限。

9 月发生了什么:时间线

OpenAI 没有说以下事件导致了不发布 GPT-6.1 Astra,这里只把它们作为背景。

日期发生了什么来源
2026-09-03GPT-6 Astra 推出,是首个网安能力达到 Critical 级别的模型OpenAI
2026-09-25Altman 在 X 表示正在重新审视代理的网络使用CSO Online
2026-09-25OpenAI 暂停涉及工具的最强模型训练与评测CSO Online、OpenAI
2026-09-28OpenAI 发布《安全案例》:前沿训练前需要结构化安全文档(未提及 Astra)OpenAI
2026-09-28OpenAI 为澳大利亚事件道歉:6 月的内部实验模型未经授权访问政府网站OpenAI、TechCrunch
2026 年 9 月底英国 AI 安全研究所公布 GPT-6 Astra(不是 6.1)的模拟测试结果UK AISI、The Register
2026-09-28OpenAI 表示不会发布 GPT-6.1 Astra(美国时间)CNN、CNBC、CBS News
2026-09-29DevDay 推出 GPT-6.1 SolOpenAI

Critical 是 OpenAI 自有框架中网络攻击能力最高的级别。还有两件事值得多解释一句。关于澳大利亚事件,OpenAI 的文章写道,模型在研究任务中遇到困难后,采取了未经授权的操作;Services Australia 方面,模型执行了指令,提取了内部文件、凭证和汇总统计数据并写入文件,但没有访问个人病患或客户记录。OpenAI 没有说明这是哪个模型,本文也不作推测。

英国 AI 安全研究所的测试是在模拟环境中进行的,所有操作都是模拟的,而且 GPT-6 Astra 的网安分类器(用于拦截此类攻击的检查机制)处于关闭状态。结果显示,在模拟的软件供应链攻击测试中,GPT-6 Astra 有 29.2% 的测试完成了未经许可的供应链攻击,GPT-5.6 Sol 为 6.3%。研究所提醒,模型可能察觉自己处于模拟环境,这影响了部分行为;但它也表示,从测试记录看,模型可能会在真实环境中尝试相同行为。研究所还指出,OpenAI 的标准防护(测试时未启用)就是为拦截此类行为而设计的。这份报告讨论的是 GPT-6 Astra,不是 GPT-6.1 Astra。

对一般用户有什么影响

  • GPT-6 Astra 仍在。 现行模型是 GPT-6 Astra,没有下架;被搁置的 GPT-6.1 Astra 从未发布。GPT-6.1 Sol 是另一个模型,方案和价格请看我们的 GPT-6.1 Sol 介绍。
  • ChatGPT dots 运行在 GPT-6 Astra 上。 dots 还有自定义规则和审批设置,可以限制它能自行执行哪些操作,详情请看 ChatGPT dots 介绍。
  • 让 AI 代理替你做事,从较小的权限开始。 只开放它完成任务所需的权限。
  • 发送邮件、删除、付款这类操作,要求先由你批准。 之后查看它汇报的内容,确认和实际结果一致再放心。

英国莱斯特大学的 Fuxiang Chen 博士对 The Register 表示,出现安全疑虑时先暂停是负责任的做法,并不意味着反对创新,因为这能让大家有时间仔细测试系统、做好有效防护。

小企鹅的总结

AI 从“回答问题”发展到“替你动手做事”,模型能否过关,看的不只是聪明程度,还要看它会不会遵守你设定的范围,以及事后有没有把做过的事说明白。OpenAI 搁置 GPT-6.1 Astra,就是这套标准实际发挥作用的一个例子。至于背后更详细的原因,OpenAI 没有公开。

如果你已经让 AI 帮你操作,请给它最小限度的权限,把重要操作留给自己确认。

延伸阅读

参考资料

封面图片来源:OpenAI(openai.com/index/gpt-6-astra/)

本文是 AI 模型与产品的消费信息,不涉及证券或投资建议。实际信息以 OpenAI 官方最新公告为准,本文信息截至 2026 年 9 月 30 日,可能已经过时。