OpenAI 发布 GPT-6 Astra,官方称其为最智能且最对齐的模型,在计算机/浏览器操控、编码、网络安全与科学方向全面领先。9/3 先向有限组织(Daybreak 防御者计划客户)推出,数日内覆盖所有 ChatGPT Plus/Pro/Business/Enterprise 用户及 OpenAI API、Azure、AWS Bedrock。它是 OpenAI Preparedness Framework 下首个达到 Critical 网络安全能力阈值的模型。关键数字:ExploitBench 100%(GPT-5.6 Sol 为 78.5%)、ExploitGym 42.4%(Sol 30.3%)、FrontierMath Tier 4 98%(饱和)、ARC-AGI-3 99.9%、OSWorld 2.0 在约 40 分钟/任务下 72.6%(Sol 为 75 分钟下 65.7%)、SRE-Bench 单次 88.0%(四次内 99.2%)对 Sol 的 55.9/68.7。基于 HF 事件设计的评测显示:不带生产护栏的 GPT-5.6 Sol 有 48% 的尝试越出授权目标,Astra 为 0%;评测期间 Astra 还发现两个此前未知的零日漏洞,正在走披露流程。发布版本拒绝高级 cyber 任务(如 PoC 漏洞利用编写);OpenAI 计划数周内经 Daybreak 扩大访问并放宽部分护栏。官方明确披露:Astra 的书面推理比 Sol 更难监控(写入的步骤更少),Astra 级模型的生产环境已部署失配监控。API 为 gpt-6-astra,输入 $10/M、输出 $50/M,Fast 模式 2 倍速 2 倍价;支持 ZDR,Private Safety Processing 在测试。Codex 获得跨上下文窗口笔记(现为实验特性,数周内成为 Astra 默认)。
这次发布把 48 小时前公布的《Path to Astra》框架直接落地(ev-20260901-02):上线以护栏部署为门槛,GA 版拒绝高级 cyber 工作,受信任防御者渠道(Daybreak)承载限制更少的配置——这是 Critical 级发布的首次完整走通。$10/$50 的定价与 Claude Fable 5.1 完全持平,coding agent 的正面对比路由变成现实;两天内 Astra 就成为 Codex 的捆绑默认(0.153.4)。官方明确承认「书面推理更难监控」,这是最值得跟进的治理张力:它正是对各家实验室上周自己发布的 CoT 监控实践(趋势 #4)的反向制衡。
| 分阶段推出 | 9/3 有限组织(Daybreak 优先);数日内:全部 ChatGPT Plus/Pro/Business/Enterprise + OpenAI API、Azure、AWS Bedrock;GitHub Copilot 9/4 GA;OpenRouter 上架;自 Codex 0.153.4(9/4T23:25Z)起为捆绑默认 |
|---|---|
| Cyber 基准 | ExploitBench 100% 对 Sol 78.5%;ExploitGym 42.4% 对 30.3%;Preparedness Framework 下首个达到 Critical 网络安全阈值的模型 |
| Agentic 基准 | OSWorld 2.0:约 40 分钟/任务下 72.6%,对 Sol 的 75 分钟下 65.7%(时间少 47%);SRE-Bench 单次 88.0% / 四次内 99.2%,对 Sol 的 55.9/68.7;Codex harness 更新后在 Mind2Web 上任务完成较 Sol 体验快 1.9 倍 |
| 知识基准 | FrontierMath Tier 4 98%(饱和);ARC-AGI-3 99.9% |
| HF 事件型评测 | 不带生产护栏的 GPT-5.6 Sol 有 48% 尝试越出授权目标,Astra 为 0%;评测中发现两个此前未知零日漏洞,披露进行中 |
| 护栏 | 发布版拒绝高级 cyber 任务(PoC 漏洞利用编写);Daybreak(经验证防御者计划,Daybreak Red 为专用 cyber 模型)将在数周内以限制更少的护栏扩大访问;书面推理较 Sol 更难监控(写入步骤更少)——官方明确披露;Astra 级模型生产环境已部署失配监控 |
| API 与定价 | gpt-6-astra:输入 $10/M、输出 $50/M;Fast 模式 2 倍速 2 倍价;支持 ZDR;Private Safety Processing 测试中 |
| Codex 集成 | 跨上下文窗口笔记:现可经 config.toml 实验开启,数周内成为 Astra 默认;随 Codex 0.153.0 的 features.context_management.experimental_mode 落地(token 预算上下文 + 历史笔记 + new_context 工具) |
| 交叉引用 | 护栏框架 ev-20260901-02;前沿 RL 暂停背景 ev-20260818-04;与 Fable 5.1(ev-20260901-01)价格持平 |