OpenAI 生态 9-02 速报:Anthropic 发布 Claude Fable 5.1 / Mythos 5.1,基准表含 GPT-5.6 Sol
竞品速报:Anthropic 9-01 发布 Claude Fable 5.1 / Mythos 5.1——同一模型两档安全配置;$10/$50 定价、缓存读 $0.25/MTok、降本 25%-45%;官方基准表直接对比 GPT-5.6 Sol。
OpenAI 生态 9-02 速报,本期主条目是竞品动态:Anthropic 于 2026-09-01 发布 Claude Fable 5.1 与 Claude Mythos 5.1,并在官方基准对比表中把 GPT-5.6 Sol 列为直接对比对象。本速报只转述 Anthropic 官方公告中可核实的部分——模型结构、定价、数据保留、安全准入与基准数字——不对"对 OpenAI 的影响"做推演;OpenAI 侧暂无可引用的新公告,本文不做无源陈述。本站周报此前已在"与竞品(Claude / Gemini / Llama)边界"栏目持续跟踪竞品信号,本期是该栏目的第一条专项速报。
1. 一句话版本
Anthropic 发布了 Claude Fable 5.1(全面开放)与 Claude Mythos 5.1(受信访问计划专供)——同一个模型的两档安全配置;单价与 Fable 5 持平($10/$50 per MTok),但缓存读降至 $0.25/MTok(官方口径降 75%),按官方实测口径典型负载降本约 25%、高 agentic 负载最高约 45%;官方基准表把 GPT-5.6 Sol 列为直接对比对象。
2. 模型结构:一个模型,两档安全配置
公告的核心结构 decision 值得注意:Fable 5.1 与 Mythos 5.1 不是两代模型,而是同一模型的两档安全配置。
| Claude Fable 5.1 | Claude Mythos 5.1 | |
|---|---|---|
| 可用性 | 全面开放(GA) | 仅受信访问计划 |
| 面向 | 一般用途(编码、知识工作等) | 网络防御与生命科学 |
| 准入 | Claude API、AWS、Google Cloud、Azure | CVP 注册(网络防御);生命科学计划与美国政府合作建设,当前仅限美国组织 |
官方对 Mythos 5.1 的表述是"安全配置专门设计以支持网络安全与生命科学工作",并称正与美国政府协调扩大国内外访问范围、将很快向科学家开放注册。
3. 定价:单价不动,缓存读砍 75%
这是本条新闻里对开发者账单最直接的部分:
- 单价持平:$10 per MTok(输入)、$50 per MTok(输出),与 Fable 5 相同。
- 缓存读降价:降至 $0.25 per MTok,官方口径为降 75%。缓存读指模型复用已经处理并存储过的输入上下文。
- 总账单影响(官方实测口径):以 default effort 下 2026 年 8 月四周真实用量做指数化对比(Fable 5 = 100)——典型负载约 75(降本约 25%);高 agentic 负载约 55(降本最高约 45%),后者指缓存读占成本大头、上下文重工具多的工作。官方口径明确带 estimated(预计)字样。
对照本站世界线:GPT-5.6 Sol 当前促销价为 $4/$20 per MTok(2026-08-21 起,至少持续至 2026-11-21)。两家定价口径不同(促销承诺期、缓存定价结构不同),本文不做折算结论,读者可自行按各自账单结构代入。
4. 数据保留与安全:EFS 与误报下降
- EFS(Enterprise Frontier Safeguards):数据存储在完全由客户控制(而非 Anthropic 控制)的云基础设施中,官方表述其隐私效果等同零数据保留策略,同时保持对抗性使用的先进防护。2026 年秋季晚些时候起分阶段向企业客户开放;在此之前,合资格客户可以零数据保留方式使用 Fable 5.1。
- 安全防护改进:网络安全方向误报(拦截良性内容)减少 60%。配套的能力边界调整:Fable 5.1 可以用于发现软件漏洞,但不能用于开发 exploit。
- 生命科学:与美国政府合作建立访问计划,开放 Claude Mythos 5.1 的高级生物学能力,官方称将很快开放科学家注册。
5. 官方基准表:GPT-5.6 Sol 列怎么读
公告的横向对比表把 GPT-5.6 Sol 与 Fable 5.1、Fable 5、Opus 5 并列。Sol 列的完整数字(原样转述,口径为公告标注的各基准官方设置):
| 基准 | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1(agentic 科研) | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0(agentic 编码) | 55.8%(Mythos 5.1:60.9%) | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2(知识工作) | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0(计算机使用,partial / strict) | 77.9% / 41.7% | 72.9% / 36.1% | 75.4% / 39.6% | — / — |
| Humanity's Last Exam(多学科推理,无工具 / 带工具) | 60.9% / 65.0% | 57.8% / 63.8% | 56.6% / 63.6% | — / — |
| AutomationBench(业务流程自动化) | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0(agentic 编码) | 73.4% | 70.5% | 70.0% | 67.2% |
读这张表必须带上公告自带的四个限定(详见本站同日发布的《怎么读模型发布里的基准对比图:effort 曲线、对数成本轴与安全干预》):
- 安全干预计零分:Fable 5.1 是带生产安全防护跑的,防护介入的任务计零分——OSWorld 2.0 上两个 Fable 模型各有零分任务,AutomationBench 上 Fable 5 有零分任务;官方明说这大概率拉低了它们的成绩。
- 两项基准没有 Sol 成绩:OSWorld 2.0 与 HLE 的 Sol 单元格是破折号——缺列不等于落后,只是发布方未报。
- 自建设置与公共榜有差:Terminal-Bench-Science 0.1 的公共榜(3 trials/task,Claude Code harness)报 Opus 5 为 30.0%、Fable 5 为 21.4%,Anthropic 自己的设置复现值是 29.0% 与 24.7%——官方注明均在噪声范围内,但两套设置数字不同。
- 误差范围:Terminal-Bench-Science 0.1 每个模型标准误差 ±3.5–4.5 个百分点。
6. effort 档位与默认值
公告的成本曲线按 effort 档位展开:low / med / high / xhigh / max,并且官方明示了默认值——Claude Code 里默认 High,Claude Cowork 与 Claude.ai 里默认 Medium;低档位下"Fable 5.1 能以更低成本拿到与 Fable 5 相当或更好的结果"(官方口径)。这与 GPT-5.6 的 reasoning.effort 连续控制是同一类设计问题:跨家比价必须锁同一 effort 档位,否则比较不成立。
7. 本周 OpenAI 侧状态
OpenAI 侧本篇没有可联动的新公告可引用:本站最近一次成功核对 API changelog 是 2026-09-01,当时最新条目为 8-29 的 mTLS / X.509 正式可用(详见《OpenAI 生态第 43 周速报(2026-09-01):mTLS 正式可用 / Sora 2 关停倒计时 / 秋冬关停日历》);9-02 当日开发者文档域对本站抓取限流,未能重核,本篇不对 OpenAI 侧状态做超出该次核验的断言。
8. 下一步
- 基准对比图的完整阅读方法(对数成本轴、误差范围、partial/strict 记分、缺列语义):《怎么读模型发布里的基准对比图:effort 曲线、对数成本轴与安全干预》。
- GPT-5.6 家族与本季定价格局:《GPT 模型完全指南(2026-07):GPT-5.6 Sol / Terra / Luna 选型》。
- 上期速报:《OpenAI 生态第 43 周速报(2026-09-01):mTLS 正式可用 / Sora 2 关停倒计时 / 秋冬关停日历》。
关键要点
- Fable 5.1 与 Mythos 5.1 是同一个模型的两档安全配置:Fable 5.1 全面开放,Mythos 5.1 仅经受信访问计划(网络防御走 CVP,生命科学项目与美国政府合作,当前仅限美国组织)
- 定价 $10/$50 per MTok 与 Fable 5 持平;缓存读降至 $0.25/MTok(降 75%),官方按 default effort 下 2026-08 四周真实用量索引测算:典型负载约 -25%,高 agentic 负载最高约 -45%
- EFS(Enterprise Frontier Safeguards):数据存客户侧云基础设施、等效零数据保留,2026 年秋起分阶段向企业开放;开放前合资格客户可先用零数据保留
- 官方基准表含 GPT-5.6 Sol 列:Terminal-Bench-Science 0.1 52.6% vs 22.4%、Terminal-Bench 4.0 55.8% vs 37.3%、AutomationBench 31.4% vs 19.6%、GDPval-AA v2 1853 vs 1711、CursorBench 3.2.0 73.4% vs 67.2%;OSWorld 2.0 与 HLE 未报 Sol 成绩
- effort 档位 low / med / high / xhigh / max;默认值:Claude Code 为 High,Claude Cowork 与 Claude.ai 为 Medium
- 安全侧:网络防御误报减少 60%;Fable 5.1 可用于发现软件漏洞但不可用于开发 exploit; Anthropic 现役家族公告内出现 Fable 5.1 / Mythos 5.1 / Opus 5 / Sonnet
常见问题
官方参考
相关文章
OpenAI 生态第 43 周速报(2026-09-01):mTLS 正式可用 / Sora 2 关停倒计时 / 秋冬关停日历
OpenAI 生态第 43 周速报:mTLS 与 X.509 工作负载身份正式可用;Sora 2 与 Videos API 进入 9-24 关停倒计时;Prompt Caching 面板上线;附 2026-09 至 2027-02 官方关停日历。
阅读全文OpenAI 生态第 42 周速报(2026-08-30 至 2026-08-31):Assistants API 已关停 / Sol 降价确认 / 转写模型弃用
OpenAI 生态第 42 周速报:Assistants API 已于 8-26 关停(迁移 Responses API);四个转写模型 2027-02-26 关停;Sol 降价获官方 changelog 确认($4/$20 促销价);DALL·E GPT 如期退役。
阅读全文OpenAI 生态第 41 周速报(2026-08-28 至 2026-08-29):终止向 Cursor 供模 / 多 Google 账号 / DALL·E GPT 退役倒计时
OpenAI 生态第 41 周速报:官宣 2026-11-12 终止向 Cursor 供应模型(SpaceX 收购后);ChatGPT 支持一个对话内使用多个 Google 账号;临时聊天支持个性化;DALL·E GPT 今日退役。
阅读全文订阅 GPTMap Weekly
每周一封邮件,精选 OpenAI 重要更新、深度解读与最佳实践。无广告,可随时退订。