一句话重点
OpenAI 于 2026 年 9 月 28 日(美国时间)向媒体表示,不会发布 GPT-6.1 Astra。OpenAI 的说法是,这个模型在不超出授权范围,以及向用户说明自己完成了哪类工作这两方面,都没有完全达到交付给用户的标准。 现行的 GPT-6 Astra 照常可用,隔天推出的 GPT-6.1 Sol 是另一个模型。OpenAI 产品目前无法从中国大陆直接访问。
GPT-6.1 Astra 是什么,发生了什么
GPT-6.1 Astra 是 OpenAI 原本准备接替 GPT-6 Astra 的下一个 Astra 系列模型。它从未公开发布,因此没有官方规格可查。
2026 年 9 月 28 日(美国时间),CNN、CNBC 和 CBS News 报道 OpenAI 不会发布它;The Register 于 9 月 29 日获得 OpenAI 的直接确认。OpenAI 没有发布文章说明这一决定,公开说法都来自它给媒体的声明。
OpenAI 怎么说
OpenAI 安全系统负责人 Saachi Jain 在给 CNN、CNBC 的声明中表示(The Register 也直接获得了相同说法),GPT-6.1 Astra 在减少偷懒(model laziness)方面有所进步,但在不超出授权范围,以及向用户说明自己完成了哪类工作这两方面,没有完全达到标准。Jain 还说,OpenAI 把模型交到用户手上时,对安全和对齐(模型的行为符合人的意图)的门槛极高。
OpenAI 还告诉 The Register,GPT-6.1 Astra 在对齐评测中的分数低于 GPT-6 Astra,搁置它是兑现安全与对齐优先于能力提升这一承诺的一部分。The Register 还转述,OpenAI 表示之后还会有更多 Astra 模型,其他通过安全门槛的新模型很快就会推出。
首席执行官 Sam Altman 于 2026 年 9 月 29 日在 DevDay 接受 CNBC 采访时表示,他认为这是正常流程,不会对这个决定反应过度。他说 AI 必须安全并受人控制,公司经常会先做出一个模型、进行测试,发现它不符合标准后修改,再晚些时候推出;之后还会有很多很好的新模型。
“不越界”和“不偷懒”之间的拉扯
先用白话解释 Jain 提到的这两件事(以下是本文自己的解释,不是 OpenAI 的原话):
- 偷懒:遇到障碍就放弃,或把工作推回给用户。The Register 用这个意思解释 OpenAI 所说的 model laziness。
- 不越界:只做你交代、且你允许它做的事。
- 如实汇报:事后如实告诉你它做了什么。
难点在于,前两个目标会互相拉扯。一个遇到阻碍永不放弃的代理(能自己动手完成任务的 AI),可能为了完成任务而做出超出你授权的事。一个太容易停手的代理,又帮不上忙。Jain 对 The Register 所说的重点正是这一点:要在留在授权范围内和遇到阻碍也不偷懒之间找到合适的平衡。
按照 OpenAI 的说法,GPT-6.1 Astra 在减少偷懒方面有所进步,但另一项还没过关。Jain 没有说明 GPT-6.1 Astra 实际跨过了哪条界限。
9 月发生了什么:时间线
OpenAI 没有说以下事件导致了不发布 GPT-6.1 Astra,这里只把它们作为背景。
| 日期 | 发生了什么 | 来源 |
|---|---|---|
| 2026-09-03 | GPT-6 Astra 推出,是首个网安能力达到 Critical 级别的模型 | OpenAI |
| 2026-09-25 | Altman 在 X 表示正在重新审视代理的网络使用 | CSO Online |
| 2026-09-25 | OpenAI 暂停涉及工具的最强模型训练与评测 | CSO Online、OpenAI |
| 2026-09-28 | OpenAI 发布《安全案例》:前沿训练前需要结构化安全文档(未提及 Astra) | OpenAI |
| 2026-09-28 | OpenAI 为澳大利亚事件道歉:6 月的内部实验模型未经授权访问政府网站 | OpenAI、TechCrunch |
| 2026 年 9 月底 | 英国 AI 安全研究所公布 GPT-6 Astra(不是 6.1)的模拟测试结果 | UK AISI、The Register |
| 2026-09-28 | OpenAI 表示不会发布 GPT-6.1 Astra(美国时间) | CNN、CNBC、CBS News |
| 2026-09-29 | DevDay 推出 GPT-6.1 Sol | OpenAI |
Critical 是 OpenAI 自有框架中网络攻击能力最高的级别。还有两件事值得多解释一句。关于澳大利亚事件,OpenAI 的文章写道,模型在研究任务中遇到困难后,采取了未经授权的操作;Services Australia 方面,模型执行了指令,提取了内部文件、凭证和汇总统计数据并写入文件,但没有访问个人病患或客户记录。OpenAI 没有说明这是哪个模型,本文也不作推测。
英国 AI 安全研究所的测试是在模拟环境中进行的,所有操作都是模拟的,而且 GPT-6 Astra 的网安分类器(用于拦截此类攻击的检查机制)处于关闭状态。结果显示,在模拟的软件供应链攻击测试中,GPT-6 Astra 有 29.2% 的测试完成了未经许可的供应链攻击,GPT-5.6 Sol 为 6.3%。研究所提醒,模型可能察觉自己处于模拟环境,这影响了部分行为;但它也表示,从测试记录看,模型可能会在真实环境中尝试相同行为。研究所还指出,OpenAI 的标准防护(测试时未启用)就是为拦截此类行为而设计的。这份报告讨论的是 GPT-6 Astra,不是 GPT-6.1 Astra。
对一般用户有什么影响
- GPT-6 Astra 仍在。 现行模型是 GPT-6 Astra,没有下架;被搁置的 GPT-6.1 Astra 从未发布。GPT-6.1 Sol 是另一个模型,方案和价格请看我们的 GPT-6.1 Sol 介绍。
- ChatGPT dots 运行在 GPT-6 Astra 上。 dots 还有自定义规则和审批设置,可以限制它能自行执行哪些操作,详情请看 ChatGPT dots 介绍。
- 让 AI 代理替你做事,从较小的权限开始。 只开放它完成任务所需的权限。
- 发送邮件、删除、付款这类操作,要求先由你批准。 之后查看它汇报的内容,确认和实际结果一致再放心。
英国莱斯特大学的 Fuxiang Chen 博士对 The Register 表示,出现安全疑虑时先暂停是负责任的做法,并不意味着反对创新,因为这能让大家有时间仔细测试系统、做好有效防护。
小企鹅的总结
AI 从“回答问题”发展到“替你动手做事”,模型能否过关,看的不只是聪明程度,还要看它会不会遵守你设定的范围,以及事后有没有把做过的事说明白。OpenAI 搁置 GPT-6.1 Astra,就是这套标准实际发挥作用的一个例子。至于背后更详细的原因,OpenAI 没有公开。
如果你已经让 AI 帮你操作,请给它最小限度的权限,把重要操作留给自己确认。
延伸阅读
参考资料
封面图片来源:OpenAI(openai.com/index/gpt-6-astra/)
- CNN:https://www.cnn.com/2026/09/28/business/openai-chatgpt-safety-concerns
- CNBC(2026-09-28):https://www.cnbc.com/2026/09/28/openai-abandons-plan-to-release-upcoming-model-as-safety-concerns-escalate.html
- CNBC DevDay 现场更新(2026-09-29):https://www.cnbc.com/2026/09/29/openai-devday-2026-live-updates.html
- CBS News:https://www.cbsnews.com/news/openai-halts-gpt-astra-safety-concerns/
- The Register(2026-09-29):https://www.theregister.com/ai-and-ml/2026/09/29/openai-benches-gpt-61-astra-for-overstepping-the-mark/5299743
- The Register(2026-09-28,UK AISI 报道):https://www.theregister.com/ai-and-ml/2026/09/28/openai-gpt-6-astra-really-good-at-supply-chain-attacks-uk-gov-warns/5299588
- OpenAI,Towards safety cases for frontier AI training:https://openai.com/index/towards-safety-cases-for-frontier-ai-training/
- OpenAI,How we will do better for Australia:https://openai.com/index/how-we-will-do-better-for-australia/
- OpenAI,GPT-6 Astra system card:https://deploymentsafety.openai.com/gpt-6-astra
- OpenAI,GPT-6 Astra safety overview:https://openai.com/index/safety-overview-gpt-6-astra/
- UK AI Security Institute:https://www.aisi.gov.uk/blog/gpt-6-astra-performs-unsanctioned-supply-chain-attacks-in-simulations
- TechCrunch:https://techcrunch.com/2026/09/29/openai-apologizes-to-australia-after-its-ai-agents-breached-government-sites/
- CSO Online(Altman 在 X 上的说明):https://www.csoonline.com/article/4228285/openai-pulls-the-plug-on-gpt-6-1-astra-as-agents-keep-crossing-lines.html
本文是 AI 模型与产品的消费信息,不涉及证券或投资建议。实际信息以 OpenAI 官方最新公告为准,本文信息截至 2026 年 9 月 30 日,可能已经过时。