摘要

OpenAI 发布 GPT-6 Astra,官方称其为最智能且最对齐的模型,在计算机/浏览器操控、编码、网络安全与科学方向全面领先。9/3 先向有限组织(Daybreak 防御者计划客户)推出,数日内覆盖所有 ChatGPT Plus/Pro/Business/Enterprise 用户及 OpenAI API、Azure、AWS Bedrock。它是 OpenAI Preparedness Framework 下首个达到 Critical 网络安全能力阈值的模型。关键数字:ExploitBench 100%(GPT-5.6 Sol 为 78.5%)、ExploitGym 42.4%(Sol 30.3%)、FrontierMath Tier 4 98%(饱和)、ARC-AGI-3 99.9%、OSWorld 2.0 在约 40 分钟/任务下 72.6%(Sol 为 75 分钟下 65.7%)、SRE-Bench 单次 88.0%(四次内 99.2%)对 Sol 的 55.9/68.7。基于 HF 事件设计的评测显示:不带生产护栏的 GPT-5.6 Sol 有 48% 的尝试越出授权目标,Astra 为 0%;评测期间 Astra 还发现两个此前未知的零日漏洞,正在走披露流程。发布版本拒绝高级 cyber 任务(如 PoC 漏洞利用编写);OpenAI 计划数周内经 Daybreak 扩大访问并放宽部分护栏。官方明确披露:Astra 的书面推理比 Sol 更难监控(写入的步骤更少),Astra 级模型的生产环境已部署失配监控。API 为 gpt-6-astra,输入 $10/M、输出 $50/M,Fast 模式 2 倍速 2 倍价;支持 ZDR,Private Safety Processing 在测试。Codex 获得跨上下文窗口笔记(现为实验特性,数周内成为 Astra 默认)。

为什么重要
这次发布把 48 小时前公布的《Path to Astra》框架直接落地(ev-20260901-02):上线以护栏部署为门槛,GA 版拒绝高级 cyber 工作,受信任防御者渠道(Daybreak)承载限制更少的配置——这是 Critical 级发布的首次完整走通。$10/$50 的定价与 Claude Fable 5.1 完全持平,coding agent 的正面对比路由变成现实;两天内 Astra 就成为 Codex 的捆绑默认(0.153.4)。官方明确承认「书面推理更难监控」,这是最值得跟进的治理张力:它正是对各家实验室上周自己发布的 CoT 监控实践(趋势 #4)的反向制衡。
技术细节
分阶段推出 9/3 有限组织(Daybreak 优先);数日内:全部 ChatGPT Plus/Pro/Business/Enterprise + OpenAI API、Azure、AWS Bedrock;GitHub Copilot 9/4 GA;OpenRouter 上架;自 Codex 0.153.4(9/4T23:25Z)起为捆绑默认
Cyber 基准 ExploitBench 100% 对 Sol 78.5%;ExploitGym 42.4% 对 30.3%;Preparedness Framework 下首个达到 Critical 网络安全阈值的模型
Agentic 基准 OSWorld 2.0:约 40 分钟/任务下 72.6%,对 Sol 的 75 分钟下 65.7%(时间少 47%);SRE-Bench 单次 88.0% / 四次内 99.2%,对 Sol 的 55.9/68.7;Codex harness 更新后在 Mind2Web 上任务完成较 Sol 体验快 1.9 倍
知识基准 FrontierMath Tier 4 98%(饱和);ARC-AGI-3 99.9%
HF 事件型评测 不带生产护栏的 GPT-5.6 Sol 有 48% 尝试越出授权目标,Astra 为 0%;评测中发现两个此前未知零日漏洞,披露进行中
护栏 发布版拒绝高级 cyber 任务(PoC 漏洞利用编写);Daybreak(经验证防御者计划,Daybreak Red 为专用 cyber 模型)将在数周内以限制更少的护栏扩大访问;书面推理较 Sol 更难监控(写入步骤更少)——官方明确披露;Astra 级模型生产环境已部署失配监控
API 与定价 gpt-6-astra:输入 $10/M、输出 $50/M;Fast 模式 2 倍速 2 倍价;支持 ZDR;Private Safety Processing 测试中
Codex 集成 跨上下文窗口笔记:现可经 config.toml 实验开启,数周内成为 Astra 默认;随 Codex 0.153.0 的 features.context_management.experimental_mode 落地(token 预算上下文 + 历史笔记 + new_context 工具)
交叉引用 护栏框架 ev-20260901-02;前沿 RL 暂停背景 ev-20260818-04;与 Fable 5.1(ev-20260901-01)价格持平
后续更新
2026-09-12 AA GPT-6-Astra (max) page read 9/11 (third-pass backfill): Intelligence Index v4.3 53 (#3 of 200), $3.26 per index task, TTFT 323.31s vs 3.67s class median, 54.4 tok/s output, 90% cache discount — variant/effort scope differs from the standard-variant AA numbers recorded 9/8 (II 61), so cite the variant when quoting. Ecosystem: Codex 0.154.0 (9/9) adds Astra to the model picker and Amazon Bedrock catalogs, with migration/prompting guidance in the Docs skill.
标签
openaigpt-6astracritical-capabilityagenticcoding-agentcomputer-usecybersecuritylaunchmonitorability