GPTMap

OpenAI 生态 9-02 速报:Anthropic 发布 Claude Fable 5.1 / Mythos 5.1,基准表含 GPT-5.6 Sol

竞品速报:Anthropic 9-01 发布 Claude Fable 5.1 / Mythos 5.1——同一模型两档安全配置;$10/$50 定价、缓存读 $0.25/MTok、降本 25%-45%;官方基准表直接对比 GPT-5.6 Sol。

TL;DR
Anthropic 于 2026-09-01 发布 Claude Fable 5.1 与 Mythos 5.1:同一个模型的两档安全配置——Fable 5.1 全面开放(API 名 claude-fable-5-1,已上 Claude API / AWS / Google Cloud / Azure),Mythos 5.1 仅限受信访问计划。定价 $10/$50 per MTok 持平,缓存读降至 $0.25/MTok(降 75%);官方按 2026-08 四周真实用量测算典型负载降本约 25%、高 agentic 最高约 45%。基准表直接对比 GPT-5.6 Sol:Terminal-Bench-Science 52.6% vs 22.4%,Terminal-Bench 4.0 55.8% vs 37.3%。本文为竞品动态速报,事实全部来自 Anthropic 官方公告。
Claude Fable 5.1 / Mythos 5.1 是 Anthropic 于 2026-09-01 发布的模型:两者是同一个模型的两档安全配置——Fable 5.1 面向一般可用(GA),Mythos 5.1 面向网络防御与生命科学的受信访问计划。定价 $10/$50 per MTok,缓存读 $0.25/MTok,官方基准表将 GPT-5.6 Sol 列为直接对比对象。

OpenAI 生态 9-02 速报,本期主条目是竞品动态:Anthropic 于 2026-09-01 发布 Claude Fable 5.1 与 Claude Mythos 5.1,并在官方基准对比表中把 GPT-5.6 Sol 列为直接对比对象。本速报只转述 Anthropic 官方公告中可核实的部分——模型结构、定价、数据保留、安全准入与基准数字——不对"对 OpenAI 的影响"做推演;OpenAI 侧暂无可引用的新公告,本文不做无源陈述。本站周报此前已在"与竞品(Claude / Gemini / Llama)边界"栏目持续跟踪竞品信号,本期是该栏目的第一条专项速报。

1. 一句话版本

Anthropic 发布了 Claude Fable 5.1(全面开放)与 Claude Mythos 5.1(受信访问计划专供)——同一个模型的两档安全配置;单价与 Fable 5 持平($10/$50 per MTok),但缓存读降至 $0.25/MTok(官方口径降 75%),按官方实测口径典型负载降本约 25%、高 agentic 负载最高约 45%;官方基准表把 GPT-5.6 Sol 列为直接对比对象。

2. 模型结构:一个模型,两档安全配置

公告的核心结构 decision 值得注意:Fable 5.1 与 Mythos 5.1 不是两代模型,而是同一模型的两档安全配置

Claude Fable 5.1Claude Mythos 5.1
可用性全面开放(GA)仅受信访问计划
面向一般用途(编码、知识工作等)网络防御与生命科学
准入Claude API、AWS、Google Cloud、AzureCVP 注册(网络防御);生命科学计划与美国政府合作建设,当前仅限美国组织

官方对 Mythos 5.1 的表述是"安全配置专门设计以支持网络安全与生命科学工作",并称正与美国政府协调扩大国内外访问范围、将很快向科学家开放注册。

3. 定价:单价不动,缓存读砍 75%

这是本条新闻里对开发者账单最直接的部分:

  • 单价持平:$10 per MTok(输入)、$50 per MTok(输出),与 Fable 5 相同。
  • 缓存读降价:降至 $0.25 per MTok,官方口径为降 75%。缓存读指模型复用已经处理并存储过的输入上下文。
  • 总账单影响(官方实测口径):以 default effort 下 2026 年 8 月四周真实用量做指数化对比(Fable 5 = 100)——典型负载约 75(降本约 25%);高 agentic 负载约 55(降本最高约 45%),后者指缓存读占成本大头、上下文重工具多的工作。官方口径明确带 estimated(预计)字样。

对照本站世界线:GPT-5.6 Sol 当前促销价为 $4/$20 per MTok(2026-08-21 起,至少持续至 2026-11-21)。两家定价口径不同(促销承诺期、缓存定价结构不同),本文不做折算结论,读者可自行按各自账单结构代入。

4. 数据保留与安全:EFS 与误报下降

  • EFS(Enterprise Frontier Safeguards):数据存储在完全由客户控制(而非 Anthropic 控制)的云基础设施中,官方表述其隐私效果等同零数据保留策略,同时保持对抗性使用的先进防护。2026 年秋季晚些时候起分阶段向企业客户开放;在此之前,合资格客户可以零数据保留方式使用 Fable 5.1。
  • 安全防护改进:网络安全方向误报(拦截良性内容)减少 60%。配套的能力边界调整:Fable 5.1 可以用于发现软件漏洞,但不能用于开发 exploit
  • 生命科学:与美国政府合作建立访问计划,开放 Claude Mythos 5.1 的高级生物学能力,官方称将很快开放科学家注册。

5. 官方基准表:GPT-5.6 Sol 列怎么读

公告的横向对比表把 GPT-5.6 Sol 与 Fable 5.1、Fable 5、Opus 5 并列。Sol 列的完整数字(原样转述,口径为公告标注的各基准官方设置):

基准Fable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.1(agentic 科研)52.6%24.7%29.0%22.4%
Terminal-Bench 4.0(agentic 编码)55.8%(Mythos 5.1:60.9%)42.0%52.3%37.3%
GDPval-AA v2(知识工作)1853172318241711
OSWorld 2.0(计算机使用,partial / strict)77.9% / 41.7%72.9% / 36.1%75.4% / 39.6%— / —
Humanity's Last Exam(多学科推理,无工具 / 带工具)60.9% / 65.0%57.8% / 63.8%56.6% / 63.6%— / —
AutomationBench(业务流程自动化)31.4%17.1%26.9%19.6%
CursorBench 3.2.0(agentic 编码)73.4%70.5%70.0%67.2%

读这张表必须带上公告自带的四个限定(详见本站同日发布的《怎么读模型发布里的基准对比图:effort 曲线、对数成本轴与安全干预》):

  1. 安全干预计零分:Fable 5.1 是带生产安全防护跑的,防护介入的任务计零分——OSWorld 2.0 上两个 Fable 模型各有零分任务,AutomationBench 上 Fable 5 有零分任务;官方明说这大概率拉低了它们的成绩。
  2. 两项基准没有 Sol 成绩:OSWorld 2.0 与 HLE 的 Sol 单元格是破折号——缺列不等于落后,只是发布方未报。
  3. 自建设置与公共榜有差:Terminal-Bench-Science 0.1 的公共榜(3 trials/task,Claude Code harness)报 Opus 5 为 30.0%、Fable 5 为 21.4%,Anthropic 自己的设置复现值是 29.0% 与 24.7%——官方注明均在噪声范围内,但两套设置数字不同。
  4. 误差范围:Terminal-Bench-Science 0.1 每个模型标准误差 ±3.5–4.5 个百分点。

6. effort 档位与默认值

公告的成本曲线按 effort 档位展开:low / med / high / xhigh / max,并且官方明示了默认值——Claude Code 里默认 High,Claude Cowork 与 Claude.ai 里默认 Medium;低档位下"Fable 5.1 能以更低成本拿到与 Fable 5 相当或更好的结果"(官方口径)。这与 GPT-5.6 的 reasoning.effort 连续控制是同一类设计问题:跨家比价必须锁同一 effort 档位,否则比较不成立。

7. 本周 OpenAI 侧状态

OpenAI 侧本篇没有可联动的新公告可引用:本站最近一次成功核对 API changelog 是 2026-09-01,当时最新条目为 8-29 的 mTLS / X.509 正式可用(详见《OpenAI 生态第 43 周速报(2026-09-01):mTLS 正式可用 / Sora 2 关停倒计时 / 秋冬关停日历》);9-02 当日开发者文档域对本站抓取限流,未能重核,本篇不对 OpenAI 侧状态做超出该次核验的断言。

8. 下一步

关键要点

  • Fable 5.1 与 Mythos 5.1 是同一个模型的两档安全配置:Fable 5.1 全面开放,Mythos 5.1 仅经受信访问计划(网络防御走 CVP,生命科学项目与美国政府合作,当前仅限美国组织)
  • 定价 $10/$50 per MTok 与 Fable 5 持平;缓存读降至 $0.25/MTok(降 75%),官方按 default effort 下 2026-08 四周真实用量索引测算:典型负载约 -25%,高 agentic 负载最高约 -45%
  • EFS(Enterprise Frontier Safeguards):数据存客户侧云基础设施、等效零数据保留,2026 年秋起分阶段向企业开放;开放前合资格客户可先用零数据保留
  • 官方基准表含 GPT-5.6 Sol 列:Terminal-Bench-Science 0.1 52.6% vs 22.4%、Terminal-Bench 4.0 55.8% vs 37.3%、AutomationBench 31.4% vs 19.6%、GDPval-AA v2 1853 vs 1711、CursorBench 3.2.0 73.4% vs 67.2%;OSWorld 2.0 与 HLE 未报 Sol 成绩
  • effort 档位 low / med / high / xhigh / max;默认值:Claude Code 为 High,Claude Cowork 与 Claude.ai 为 Medium
  • 安全侧:网络防御误报减少 60%;Fable 5.1 可用于发现软件漏洞但不可用于开发 exploit; Anthropic 现役家族公告内出现 Fable 5.1 / Mythos 5.1 / Opus 5 / Sonnet

常见问题

不是。官方公告原话:两者是同一个模型,但安全防护级别不同(the same model, but with different levels of safeguards)。Fable 5.1 面向一般可用(GA);Mythos 5.1 只通过受信访问计划提供,其安全配置专门面向网络安全与生命科学工作。公告的 Terminal-Bench 4.0 图中两者成绩差距被官方归因于早期较粗粒度的网络安全防护介入。

官方参考

相关文章

订阅 GPTMap Weekly

每周一封邮件,精选 OpenAI 重要更新、深度解读与最佳实践。无广告,可随时退订。

GPTMap Editorial发布于 2026-09-02 9 分钟阅读
测试环境(EEAT)
最后测试时间:2026-09-02
使用模型:gpt-5.6