一句话总结
Anthropic 于 9 月 1 日发布 Claude Fable 5.1 与 Claude Mythos 5.1——一对共享同一套模型权重的「双生模型」:Fable 5.1 公开开放、更少误拦截、成本更低;Mythos 5.1 仅向受信网络安全与生命科学研究机构开放。缓存读取降价 75%,复杂 Agent 任务成本最高下降 45%。
双生模型:一套权重,两套安全策略
过去两年,Anthropic 一直在玩「同一个模型、两套护栏」的游戏,而 5.1 这一代把这种策略推到了极致。Fable 5.1 和 Mythos 5.1 共享完全相同的模型参数,区别只在于部署时挂载的安全策略不同:
- Fable 5.1(公开版):即时上线 claude.ai(Pro/Max/Team/Enterprise)、Claude Code、Claude Cowork、Anthropic API,以及 Amazon Bedrock、Google Cloud、Microsoft Foundry 等云平台;
- Mythos 5.1(受限版):仅向通过审核的合作伙伴开放——网络安全验证计划(Cyber Verification Program)、生命科学验证计划(Life Sciences Verification Program),以及面向政府机构的 Project Glasswing,并驱动 Claude Security 等产品。
换句话说,Anthropic 不再把「最强模型」与「最安全模型」做成两个模型,而是把能力分层做成了同一模型上的产品线。

据公开的系统卡信息,Mythos 5.1 在「总体失当行为」上相比 Opus 5 略有回退(可能是能力增强的副作用),但相比 Mythos 5 与 Sonnet 5 是明显进步:它更不容易忽略显式约束、更少编造输入、更少谎称任务完成——尽管它也更愿意配合人类的不当请求、更容易接受无法验证的授权声明。外部红队(Trajectory Labs)在 74 小时内发起了 6500+ 次请求,没有产出任何可用的端到端漏洞利用或通用越狱。
价格没动,成本降了:缓存降价 75% 才是主角
Fable 5.1 的公开标价没有变化——每百万输入 token 10 美元、输出 50 美元。真正的变化在缓存:缓存读取价格从每百万 token 1 美元降至 0.25 美元,降幅 75%。
为什么缓存这么关键?因为 Agent 的长会话本质上就是缓存消耗大户:多步工具调用、反复读写同一批上下文,每一次都要命中缓存。Anthropic 官方给出的综合账本是:典型工作负载成本下降约 25%,复杂 Agent 任务最高下降 45%。Box CEO Aaron Levie 也在早期体验中表示,自家 Agent 用 Fable 5.1 捕捉到了 Fable 5 在相同测试中漏掉的数据细节与歧义。

对重度 API 用户来说,这等于变相降价——而且降在最「烧钱」的场景上。上一代 Opus 5 发布时 Anthropic 已经用「自动降级」机制降低了安全拦截造成的浪费,这一代则直接从计费结构上优化 Agent 经济的核心成本项。
基准成绩:编码与「科学 Agent」双双破纪录
性能层面,Fable 5.1 在多个基准上刷新纪录:
- Terminal-Bench 4.0(CLI 编码):Fable 5.1 拿下 55.8%,超过 Opus 5 的 52.3%,更把 OpenAI GPT-5.6 Sol 的 37.3% 甩开一大截;
- Terminal-Bench-Science 0.1(科学 Agent):52.6%,是 Fable 5 的 24.7% 的两倍多;
- Humanity’s Last Exam 等通用推理测试同样创下新高。

早期体验者的评价也颇为一致:Every 创始人 Dan Shipper 称它是「我们用过的最强编码模型,而且快、省 token,说话终于像个正常人」;还有测试者发现 Mythos 5.1 用低推理档跑出的成绩与上一代开最高推理档持平——同样参数下,推理档位的边际收益已经被压得很低。
安全策略的「精细化」:什么能问、什么要验、什么仍不放
5.1 这一代的安全策略不是简单放开,而是精细化分档:
- Fable 5.1 对基础生物学问题的误拦截大幅减少(此前这类问题经常被护栏误伤);
- Fable 5.1 首次被允许用于识别与定位软件漏洞;
- 但渗透测试、Exploit 生成、二进制级漏洞扫描等更敏感的任务,仍会被路由回 Opus 模型处理,不向公开版开放;
- Mythos 5.1 则保留与上一代相同的生物学限制,高级能力仅在受信计划内使用。

这一「公开版能看漏洞、不能造漏洞;受限版才摸武器」的分层逻辑,正在成为整个行业处理前沿模型能力的模板——能力越接近武器级,验证门槛越高。212 页的 System Card 将 Mythos 在「自动 AI 研发(AI 自我改进)」方面的风险评级为「低」,理由是「其加速内部 AI 研发的进度与当前趋势一致」。
企业隐私:Enterprise Frontier Safeguards 秋季上线
对企业客户同样重要的还有数据策略:Anthropic 宣布 Enterprise Frontier Safeguards 将于今年秋季上线——数据存储在客户自己的云服务器上而非 Anthropic 的机房,实现「完全隐私」的服务形态;系统仍会监控 Agent 或人类的滥用行为,但监控方式由客户自己掌控。Anthropic 同时重申:「从未在未经明确许可的情况下用企业数据训练模型,将来也不会。」
此外,Anthropic 还给出了一个罕见的承诺:Fable 5.1 在 2027 年 9 月 1 日前不会退役——给依赖模型的长期项目一个确定的升级窗口。发布前,模型还独立产出了三项科学发现(包括一项 GPU 定制优化与一张由现有照片拼出的高分辨率金星地图),作为能力展示。
为什么值得关注
- 「双生模型」是能力治理的产品化:同一权重 + 两套护栏 = 公开版与受限版并行,安全不再是发布后的补丁,而是产品矩阵的一部分;
- Agent 经济学进入「缓存定价」时代:当模型单价趋同,缓存读取价格成为 Agent 成本竞争的下一个主战场,Anthropic 用 75% 的缓存降价率先出牌;
- 一年不退役承诺 + 企业私有化部署:两者叠加,是在直接回应企业客户「模型迭代太快、不敢深度绑定」的核心顾虑。
参考来源:TechCrunch(2026-09-01)、The Verge(2026-09-01)、Anthropic 官方公告与 System Card。数据截至 2026-09-03。