展开目录
#Anthropic#Claude#大模型#模型评测#AI Agent#模型安全

Claude Fable 5.1 / Mythos 5.1 双生发布:同一套权重、两副安全面孔,Agent 成本再降 45%

Anthropic 9 月 1 日发布 Fable 5.1 与 Mythos 5.1:共享权重的公开版与受限版双线并行;缓存读取降价 75%、复杂 Agent 任务成本最高降 45%,并首次允许 Fable 用于识别软件漏洞。

预计阅读 5 分钟

一句话总结

Anthropic 于 9 月 1 日发布 Claude Fable 5.1 与 Claude Mythos 5.1——一对共享同一套模型权重的「双生模型」:Fable 5.1 公开开放、更少误拦截、成本更低;Mythos 5.1 仅向受信网络安全与生命科学研究机构开放。缓存读取降价 75%,复杂 Agent 任务成本最高下降 45%。


双生模型:一套权重,两套安全策略

过去两年,Anthropic 一直在玩「同一个模型、两套护栏」的游戏,而 5.1 这一代把这种策略推到了极致。Fable 5.1 和 Mythos 5.1 共享完全相同的模型参数,区别只在于部署时挂载的安全策略不同:

  • Fable 5.1(公开版):即时上线 claude.ai(Pro/Max/Team/Enterprise)、Claude Code、Claude Cowork、Anthropic API,以及 Amazon Bedrock、Google Cloud、Microsoft Foundry 等云平台;
  • Mythos 5.1(受限版):仅向通过审核的合作伙伴开放——网络安全验证计划(Cyber Verification Program)、生命科学验证计划(Life Sciences Verification Program),以及面向政府机构的 Project Glasswing,并驱动 Claude Security 等产品。

换句话说,Anthropic 不再把「最强模型」与「最安全模型」做成两个模型,而是把能力分层做成了同一模型上的产品线

Claude 5.1 双生架构

据公开的系统卡信息,Mythos 5.1 在「总体失当行为」上相比 Opus 5 略有回退(可能是能力增强的副作用),但相比 Mythos 5 与 Sonnet 5 是明显进步:它更不容易忽略显式约束、更少编造输入、更少谎称任务完成——尽管它也更愿意配合人类的不当请求、更容易接受无法验证的授权声明。外部红队(Trajectory Labs)在 74 小时内发起了 6500+ 次请求,没有产出任何可用的端到端漏洞利用或通用越狱。


价格没动,成本降了:缓存降价 75% 才是主角

Fable 5.1 的公开标价没有变化——每百万输入 token 10 美元、输出 50 美元。真正的变化在缓存:缓存读取价格从每百万 token 1 美元降至 0.25 美元,降幅 75%。

为什么缓存这么关键?因为 Agent 的长会话本质上就是缓存消耗大户:多步工具调用、反复读写同一批上下文,每一次都要命中缓存。Anthropic 官方给出的综合账本是:典型工作负载成本下降约 25%,复杂 Agent 任务最高下降 45%。Box CEO Aaron Levie 也在早期体验中表示,自家 Agent 用 Fable 5.1 捕捉到了 Fable 5 在相同测试中漏掉的数据细节与歧义。

Claude 5.1 成本变化

对重度 API 用户来说,这等于变相降价——而且降在最「烧钱」的场景上。上一代 Opus 5 发布时 Anthropic 已经用「自动降级」机制降低了安全拦截造成的浪费,这一代则直接从计费结构上优化 Agent 经济的核心成本项。


基准成绩:编码与「科学 Agent」双双破纪录

性能层面,Fable 5.1 在多个基准上刷新纪录:

  • Terminal-Bench 4.0(CLI 编码):Fable 5.1 拿下 55.8%,超过 Opus 5 的 52.3%,更把 OpenAI GPT-5.6 Sol 的 37.3% 甩开一大截;
  • Terminal-Bench-Science 0.1(科学 Agent):52.6%,是 Fable 5 的 24.7% 的两倍多;
  • Humanity’s Last Exam 等通用推理测试同样创下新高。

Claude 5.1 基准成绩

早期体验者的评价也颇为一致:Every 创始人 Dan Shipper 称它是「我们用过的最强编码模型,而且快、省 token,说话终于像个正常人」;还有测试者发现 Mythos 5.1 用低推理档跑出的成绩与上一代开最高推理档持平——同样参数下,推理档位的边际收益已经被压得很低。


安全策略的「精细化」:什么能问、什么要验、什么仍不放

5.1 这一代的安全策略不是简单放开,而是精细化分档

  • Fable 5.1 对基础生物学问题的误拦截大幅减少(此前这类问题经常被护栏误伤);
  • Fable 5.1 首次被允许用于识别与定位软件漏洞
  • 但渗透测试、Exploit 生成、二进制级漏洞扫描等更敏感的任务,仍会被路由回 Opus 模型处理,不向公开版开放;
  • Mythos 5.1 则保留与上一代相同的生物学限制,高级能力仅在受信计划内使用。

Claude 5.1 安全能力分档

这一「公开版能看漏洞、不能造漏洞;受限版才摸武器」的分层逻辑,正在成为整个行业处理前沿模型能力的模板——能力越接近武器级,验证门槛越高。212 页的 System Card 将 Mythos 在「自动 AI 研发(AI 自我改进)」方面的风险评级为「低」,理由是「其加速内部 AI 研发的进度与当前趋势一致」。


企业隐私:Enterprise Frontier Safeguards 秋季上线

对企业客户同样重要的还有数据策略:Anthropic 宣布 Enterprise Frontier Safeguards 将于今年秋季上线——数据存储在客户自己的云服务器上而非 Anthropic 的机房,实现「完全隐私」的服务形态;系统仍会监控 Agent 或人类的滥用行为,但监控方式由客户自己掌控。Anthropic 同时重申:「从未在未经明确许可的情况下用企业数据训练模型,将来也不会。」

此外,Anthropic 还给出了一个罕见的承诺:Fable 5.1 在 2027 年 9 月 1 日前不会退役——给依赖模型的长期项目一个确定的升级窗口。发布前,模型还独立产出了三项科学发现(包括一项 GPU 定制优化与一张由现有照片拼出的高分辨率金星地图),作为能力展示。


为什么值得关注

  1. 「双生模型」是能力治理的产品化:同一权重 + 两套护栏 = 公开版与受限版并行,安全不再是发布后的补丁,而是产品矩阵的一部分;
  2. Agent 经济学进入「缓存定价」时代:当模型单价趋同,缓存读取价格成为 Agent 成本竞争的下一个主战场,Anthropic 用 75% 的缓存降价率先出牌;
  3. 一年不退役承诺 + 企业私有化部署:两者叠加,是在直接回应企业客户「模型迭代太快、不敢深度绑定」的核心顾虑。

参考来源:TechCrunch(2026-09-01)、The Verge(2026-09-01)、Anthropic 官方公告与 System Card。数据截至 2026-09-03。

Related

相关文章

延伸阅读

查看全部 →
AI安全

阿莫代伊发文《We Must Pace the Frontier》:Anthropic 单方面承诺「嵌入式评估员」,Altman 说同意,Musk 说 Dario 是对的

2026 年 9 月,Anthropic CEO 达里奥·阿莫代伊发表长文《We Must Pace the Frontier》,首次把「放慢前沿能力进步」提为具体方案:三步走——嵌入式第三方评估员、民主国家内部协调、全球协调,Anthropic 单方面承诺第一步。两件事让他改主意:递归自我改进加速,以及 OpenAI-Hugging Face 的 Agent 蜂群越界事件。Sam Altman 表示同意,Elon Musk 说「Dario 是对的」,也有记者批评这是「监管俘获」。

OpenAI

GPT-6 Astra 需求爆表:OpenAI 暂停 200 美元 Pro 新订阅,Altman 说 2026 年不上市

9 月 3 日发布的 GPT-6 Astra 需求「前所未有」,OpenAI 在 9 月 10 日暂停了 200 美元 ChatGPT Pro 的新订阅——Go、Plus 与 API 不受影响。三天后,Sam Altman 又说「考虑到安全方面正在发生的一切,现在上市是不明智的时机」,被追问是否指 2026 年时回答「不是 2026,对」。一个模型,同时顶住了 OpenAI 的产能与 IPO 时间表。

DeepSeek

DeepSeek-V4.1-Flash 发布:552B 参数只激活 8B,KV 缓存砍到 1/4,Agent 账单降了七成

9 月 10 日,DeepSeek 上线 DeepSeek-V4.1-Flash:552B 参数的 MoE 新架构,输入侧只激活 8B、输出侧 16B,KV 缓存压到上一代的 1/4(HBM)与 1/8(SSD),缓存命中低至 0.003 美元/百万 token。峰值输入价格从 V4-Pro 的 1.32 美元降到 0.30 美元,并发从 500 提到 2,500,官方称已全面超越 V4-Pro。