
当地时间 9 月 1 日,Anthropic 正式宣布推出 Claude Fable 5.1 和 Claude Mythos 5.1。Anthropic 将这两款模型定位为“全球最先进的编程与知识工作模型”。两款模型采用相同的基础模型,区别在于安全防护等级不同——Fable 5.1 面向所有用户开放,Mythos 5.1 仅通过可信访问计划向经过审核的网络安全和生命科学领域机构提供。
模型地址:Claude官网(海外网站需要科学上网)
一、性能:Terminal-Bench-Science得分翻倍,科学Agent能力跃升
Claude Fable 5.1 在多项基准测试中相较前代 Fable 5 实现了显著提升:
| 基准测试 | Fable 5.1 | Mythos 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench-Science 0.1 (Agentic 科学研究) | 52.6% | — | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 (Agentic 编程) | 55.8% | 60.9% | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 (知识工作) | 1853 | — | 1723 | 1824 | 1711 |
在 Terminal-Bench-Science 0.1 上,Fable 5.1 的 52.6% 得分是 Fable 5(24.7%)的两倍多。在 Terminal-Bench 4.0 上,Fable 5.1 得分 55.8%,Mythos 5.1 更是达到 60.9%,均大幅超越 Fable 5 的 42.0%。在知识工作基准 GDPval-AA v2 上,Fable 5.1 获得 1853 分,同样领先于前代及竞品。

除了性能提升,Fable 5.1 还提供了可调节的“努力程度”(effort level)选项。当设置为 Low 或 Medium 时,Fable 5.1 能以更低的成本实现与 Fable 5 相似或更好的结果。默认情况下,Fable 5.1 在 Claude Code 中为 High effort,在 Claude Cowork 和 Claude.ai 上为 Medium effort。
在实际应用层面,Anthropic 披露了一个案例:在对冲基金 Millennium 的内部测试中,Fable 5.1 找到了其内部系统中一个罕见崩溃的根本原因——该问题在数年内未被任何工程师或其他模型解释清楚。
二、定价:缓存读取费用从 $1.00 降至 $0.25,降幅 75%
Fable 5.1 的输入和输出基础定价与 Fable 5 保持一致——输入 $10/百万 Token、输出 $50/百万 Token。真正的价格变动发生在缓存读取(cache reads)环节 :缓存读取价格从每百万 Token $1.00 降至 $0.25,降幅达 75%。
Anthropic 表示,这一调整将使典型工作负载下的模型成本降低约 25%,而对于高度代理性(highly agentic)的工作负载,节省幅度可高达 45%。

三、企业前沿防护措施(EFS):零数据保留隐私 + 前沿安全检测
Anthropic 同步推出了 Enterprise Frontier Safeguards(EFS) ,这是一套面向企业客户的新型安全防护体系。
EFS 的核心设计理念是解决企业长期面临的两难困境:一方面,企业需要零数据保留(ZDR)级别的隐私保护;另一方面,检测 AI 滥用又需要跨时间、跨账户的数据存储与关联分析。EFS 的解决方案是将数据存储在客户完全控制的云基础设施中 ,而非 Anthropic。当监控系统检测到需要关注的行为模式时,相关信号直接发送给客户。
EFS 是 Anthropic 与超过 100 家客户 密切合作的成果,涵盖金融服务、医疗保健、制造、电信、法律、零售和公共部门等行业。参与设计的机构包括 Goldman Sachs、Morgan Stanley、Citi、Bank of America、Wells Fargo 等美国最大银行的首席信息安全官,以及 Comcast、KPMG、Mastercard、Salesforce、Visa 等企业。Anthropic 的对话覆盖了四分之一的财富 100 强企业、所有美国全球系统重要性银行,以及几乎所有受监管行业 。
EFS 将于今年秋季晚些时候开始分阶段向企业客户推出。在 EFS 正式可用之前,符合条件的客户可在 Fable 5 和 Fable 5.1 上使用零数据保留政策。EFS 将支持 Claude Code、Claude Enterprise、Claude Platform、Amazon Bedrock、Google Agent Platform 和 Microsoft Foundry 等平台。
四、安全防护改进:网络误报减少 60%,生物回退减少 85%
Anthropic 同时对模型的安全防护措施进行了多项优化:
- 网络安全方面 :最新的网络防护措施误报率(将良性内容标记为有害)降低了约 60%。Fable 5.1 现在可用于发现软件漏洞 ——即开展改善软件安全的防御性工作——但不可用于开发漏洞利用程序。不过,渗透测试、漏洞利用生成和基于二进制的漏洞扫描等双重用途的网络任务仍会被重定向至 Opus 模型处理。
- 生物安全方面 :在基础生物学和医学问题上,安全回退率已降低约 85%。Anthropic 与美国政府合作建立了 Claude Mythos 5.1 的生命科学访问计划,预计将很快向科学家开放申请。
- 防蒸馏机制 :Fable 5.1 强化了防蒸馏攻击机制。例如,从今日起新创建的 API 账户不再能在多轮对话中手动编辑 Claude 的上下文同时保留其思考过程的完整记录——这堵住了一种公开文档化的常见蒸馏技术。该变更将逐步推出,现有账户暂不受影响。
- 水印合规 :Anthropic 已签署欧盟 AI 法案的 AI 生成内容透明度实践守则,Fable 5.1 的输出已加入文本水印——该水印对未持有检测 API 的用户不可见,且无实际影响。
五、Mythos 5.1:同一模型,差异化安全防护
Claude Mythos 5.1 与 Fable 5.1 是同一基础模型,但为经过审核的网络安全和生命科学专业人士提供了更宽松的安全防护。
Mythos 5.1 通过两个可信访问计划提供:
- 网络验证计划(CVP) :目前已为 Opus 和 Sonnet 级别的模型提供降低网络防护的访问权限,用于防御性安全工作,未来将扩展至 Mythos 级别模型。
- 生命科学验证计划(LSVP) :专为生命科学专业人士设计,使其能在专为专业研发活动设计的防护措施下使用 Claude Mythos 5.1。该计划与美国政府合作,首批参与者已注册,计划将向更广泛的生命科学社区开放。
此外,Anthropic 的代码漏洞扫描产品 Claude Security 现已由 Claude Mythos 5.1 提供支持。
在风险测试方面,Anthropic 对 Mythos 5.1 进行了化学与生物武器、网络攻击、代理安全等多维度评估。评估表明,Mythos 5.1 的能力虽强于 Mythos 5,但仍未达到 Anthropic 负责任扩展政策中定义的下一个风险等级。在提示注入基准测试中,Mythos 5.1 是 Anthropic 迄今为止最鲁棒的模型。
Claude Fable 5.1 已在全球范围内向所有用户开放。Mythos 5.1 则通过可信访问计划向经过审核的网络防御者和生命科学家提供。
Anthropic 此次发布的亮点在于:
- 性能上 ,Fable 5.1 在科学研究 Agent 基准上得分翻倍,Mythos 5.1 在编程基准上达到 60.9%;
- 成本上 ,缓存读取费用直降 75%,典型工作负载成本降低约 25%;
- 安全上 ,EFS 在零数据保留隐私与前沿安全检测之间找到了平衡点,网络误报减少 60%、生物回退减少 85%。
这三者的结合,使 Fable 5.1 在保持前沿能力的同时,向企业客户关心的成本、数据隐私和安全防护三大核心诉求做出了实质性回应。
更多信息请参阅官方博客 :anthropic.com/claude-fable-and-mythos-5-1 |
AITOP100-AI资讯频道将持续关注AI行业新闻资讯消息,带来最新AI内容讯息。
想了解AITOP100平台其它版块的内容,请点击下方超链接查看
AI创作大赛 | AI活动 | AI工具集 | AI资讯专区 | AI小说
AITOP100平台官方交流社群二维码:










