摘要
Anthropic 发布 Claude Fable 5.1——面向 coding 与知识工作的最强模型,全平台 GA(API 为 claude-fable-5-1,另覆盖 AWS、GCP、Azure),并成为 Claude Code 的默认 Fable 模型。定价维持输入 $10/M、输出 $50/M,但缓存读取从 $1.00/M 降到 $0.25/M:典型负载比 Fable 5 便宜约 25%,缓存占比高的 agentic 负载最多省约 45%。基准:Terminal-Bench 4.0 55.8%(Fable 5 为 42.0,GPT-5.6 Sol 为 37.3)、Terminal-Bench-Science 0.1 52.6% 对 GPT-5.6 Sol 的 22.4、GPQA 88.5(新 SOTA)、无工具 HLE 60.9。同一模型以 Mythos 5.1 名义走信任访问计划(生物方向 LSVP 由美国政府参与,cyber 方向 CYP),具备 Anthropic 最强 cyber 能力但低于其下一个生物风险层级。同场发布 Enterprise Frontier Safeguards(与 ZDR 等效的隐私 + 护栏,2026 秋起分阶段)与 EU AI Act 要求的输出水印(8 月 2 日后发布的模型适用,Fable 5.1 已带)及私有预览的检测 API。
为什么重要
对在 Claude 上跑 agentic 负载的团队,缓存读取降价是头号变量:每轮都要重读大段冻结上下文的 agent 正是能省最多(约 45%)的负载形态,这会直接改变 coding agent 的模型路由成本账。Terminal-Bench 4.0 上 55.8 对 GPT-5.6 Sol 37.3 的差距,加上 effort 档位公开为 1-10 的连续标尺,让「按档位控成本」变得可操作。两个治理变化值得跟进:Enterprise Frontier Safeguards 与 OpenAI 的 Private Safety Processing 正在向同一形态收敛(无留存推理 + 安全工具),EU 水印 + 检测 API 则把来源标记变成面向欧洲部署的集成需求。
技术细节
| 可用性 | claude-fable-5-1 全平台 GA:Claude Platform、Claude Code、Claude Enterprise、AWS Bedrock、Google Cloud、Microsoft Azure;自 Claude Code 2.1.257 起为默认 Fable 模型 |
|---|---|
| 定价 | 输入 $10/M、输出 $50/M(不变);缓存读取 $0.25/M(较 $1.00/M 降 75%);典型负载较 Fable 5 省约 25%,高缓存 agentic 负载最多约 45%;1M 上下文;effort 公开为 1-10 连续标尺,默认 Claude Code 为 High、Claude Cowork 与 Claude.ai 为 Medium |
| Coding Agent 基准 | Terminal-Bench 4.0:Fable 5.1 55.8%、Mythos 5.1 60.9%,对比 Fable 5 42.0 / Opus 5 52.3 / GPT-5.6 Sol 37.3;Terminal-Bench-Science 0.1:52.6% 对 Fable 5 24.7 / Opus 5 29.0 / GPT-5.6 Sol 22.4;CursorBench 3.2.0:73.4% 对 GPT-5.6 Sol 65.8 / 71.2;OSWorld 2.0 strict:41.7%(此前开源权重 SOTA 为 24.3);AutomationBench:31.4% |
| 知识基准 | GPQA 88.5(新 SOTA);HLE 无工具 60.9 / 带工具 65.0;AIME 2026 98.9;ARC-AGI-2 36.1 |
| Mythos 5.1 | 同一底座、更强护栏形态,仅经信任访问计划分发:Life Sciences Vulnerability Program(LSVP,与美国政府合作)与 Cyber Vulnerability Program(CYP);具备 Anthropic 各模型中最强的 cyber 能力,在 Frontier Compliance Framework 中归入较低风险类,RSP 生物风险低于下一层级 |
| EFS | Enterprise Frontier Safeguards:与 ZDR 等效的隐私 + 护栏;客户可控云存储;2026 秋起分阶段上线(在此之前合格客户先获 ZDR);支持 Claude Code、Claude Enterprise、Claude Platform、Bedrock、Google Agent Platform、Foundry |
| Cyber 护栏 | 误报干预较 Fable 5 减少约 60%;Fable 5.1 允许用于漏洞发现(防御向),漏洞利用开发重定向到 Opus 系模型;Mythos 级客户获得增强护栏集 |
| 水印 | EU AI Act 第 50(2) 条适用于 2026-08-02 后投放市场的模型——Fable 5.1 输出带水印;水印检测 API 处于私有预览 |
| 反蒸馏 | 新 API 账户不再能在保留 Claude 思考记录的同时编辑先前上下文(封堵一种已被记录的蒸馏手法) |
| 科学应用 | 蛋白质 binder 设计在 12 个靶标上实验命中率约 50%(常规 10-15%),3 个靶标上结合亲和力达竞赛最优的 10 倍;CC 许可发布金星地表高程图(覆盖约 1/3 星球、2-3 km 分辨率,此前全球约 10-20 km);用定制 GPU kernel 将 7 个开源生物 DL 模型提速最高 2.5 倍(GPU 成本降 30-60%),kernel 将开源 |
| 交叉引用 | 配套安全报告 2026-08-31 发布(ev-20260831-01);EU 水印机制背景见 ev-20260814-07 |
后续更新
2026-09-04 Third-party eval + tooling follow-up: Artificial Analysis model page (captured 9/5; eval reflected ~9/2) scores Fable 5.1 at 57 on the Intelligence Index, ranked #1 of 202 listed models, $6.12 per Intelligence Index task — AA flags it as 'particularly expensive when comparing to other models of similar price' despite the cache-read cut. Claude Code 2.1.260 (9/3) fixed Fable 5.1 in the /model picker, fable agents ignoring the [1m] tag (silently running 200K windows), and a tool-result prompt-cache miss on Fable 5.1; 1M-context auto-compact improved. Recommendation stays ADOPT
标签
claudefablemythoscoding-agentagenticpricingcachebenchmarkwatermarkefszdr