Claude Fable 5.1 and Claude Mythos 5.1 icon

Claude Fable 5.1 and Claude Mythos 5.1

Claude Fable 5.1 面向编程、知识工作和长期问题解决,现已开放使用;Claude Mythos 5.1 仅限受信任访问计划,并新增企业安全防护与更低的典型用量预计按令牌计费价格。

Claude Fable 5.1 and Claude Mythos 5.1

概览

Claude Fable 5.1 和 Claude Mythos 5.1 是 Anthropic 最新发布的模型,面向编程、知识工作和智能体问题解决。Anthropic 将它们描述为具有不同安全防护级别的同一底层模型:Fable 5.1 现已普遍可用,而 Mythos 5.1 仅限受信任访问计划。

除能力提升外,此次发布还强调了三项产品变化:Fable 5.1 典型工作负载的预计按令牌计费价格更低;推出名为 Enterprise Frontier Safeguards 的全新企业隐私与安全防护方案;以及减少安全系统中的误报。Anthropic 还将这些模型定位于研究密集型工作流,包括科学研究、网络安全和生命科学,同时对高风险使用场景保持更严格的访问控制。

在性能方面,Anthropic 表示,Fable 5.1 在编程、知识工作和长期任务方面均有所提升,超过 Fable 5;在某些情况下,较低的努力程度设置也能以更低成本取得相近或更好的结果。该公司将此次发布定位为面向需要更高输出质量、更可控支出,以及针对敏感工作负载更清晰安全防护的团队的更新。

核心能力

聚焦编程与知识工作

Anthropic 将 Fable 5.1 定位为面向编程、知识工作和长期问题解决的模型,并表示其在多项任务的基准测试中超过 Fable 5。

面向研究的性能

发布说明重点介绍了智能体科学研究和多学科推理基准测试,将该模型定位为不仅适用于软件任务。

基于努力程度的成本控制

Anthropic 表示,Fable 5.1 可在 Low、Medium、High、xHigh 和 Max 五种努力程度下运行,并且在某些工作负载中,较低的努力程度可以以更低成本产生相近结果。

长周期调试

该模型被描述为能够解决软件问题的根本原因,而不是走捷径;其中一个示例涉及 Millennium 在测试中发现的一次罕见崩溃。

不同的安全防护配置

Anthropic 表示,该模型与 Mythos 5.1 使用相同的底层系统,但安全防护不同;Mythos 仅面向受信任访问计划,定位于网络安全和生命科学使用场景。

更新的企业安全防护

发布公告称,改进后的安全防护旨在减少网络安全领域的误报,并介绍了新的、注重隐私的企业安全防护,可在保留业界领先的滥用检测能力的同时支持完整隐私。

实际使用场景

  • 软件开发与调试

    对于编写或审查软件的团队,Anthropic 将 Fable 5.1 定位为适用于智能体编程、代码审查,以及持续调查后才能找到根本原因的错误。

  • 知识工作与分析

    对于分析师和运营团队,该模型面向长期知识任务,例如综合整理、问题拆解,以及基于复杂输入进行多步骤推理。

  • 科学研究工作流

    对于研究密集型用户,Anthropic 将智能体科学研究和多学科推理列为明确的基准测试领域,表明其适合探索性研究工作流。

  • 网络安全分析

    对于安全团队,发布说明称 Fable 5.1 可以帮助发现软件漏洞,而具备更高安全防护级别的 Mythos 5.1 则面向受信任访问下的网络安全工作。

  • 采用更严格安全防护的企业部署

    对于受监管或处理敏感信息的组织,Enterprise Frontier Safeguards 和零数据保留过渡选项被介绍为企业部署中的隐私与滥用检测方案。

Pros and Cons

Pros

  • 重点支持编程、知识工作和长期问题解决。
  • Anthropic 报告称,其在包括智能体编程和科学研究在内的多项基准测试中,性能优于 Fable 5。
  • 在某些工作负载中,较低的努力程度设置可以降低成本,同时保持相近结果。
  • 此次发布针对网络安全和生物学使用场景,采用了更严格、更明确的安全防护处理。
  • Anthropic 表示,Fable 5.1 可用于发现软件漏洞,但不能用于开发漏洞利用程序。

Cons

  • Mythos 5.1 并未广泛开放,仅限受信任访问计划。
  • Anthropic 指出,某些安全防护可能会在基准测试中介入,从而压低特定任务的得分。
  • Enterprise Frontier Safeguards 的完整企业部署将分阶段进行,因此可用性取决于推出时间。

FAQ

Fable 5.1 和 Mythos 5.1 有什么区别?

Claude Fable 5.1 是普遍可用的版本,而 Claude Mythos 5.1 仅通过受信任访问计划提供。Anthropic 表示,两者基于相同的底层模型,但安全防护级别不同。

该模型适用于哪些类型的工作?

Anthropic 表示,Fable 5.1 面向编程、知识工作和长期问题解决任务。发布说明还介绍了其面向研究的能力,以及在智能体科学研究、终端编程和多学科推理方面的基准测试结果。

它如何定位于网络安全和生命科学领域?

Anthropic 表示,Fable 5.1 可用于发现软件漏洞,但不能用于开发针对这些漏洞的利用程序。Mythos 5.1 则面向网络安全和生命科学工作流中的更高安全防护级别访问。

Anthropic 如何说明数据保留和安全防护?

Anthropic 表示,在 Enterprise Frontier Safeguards 可用之前,符合条件的客户可以对 Fable 5.1 使用零数据保留。该公司还表示,新安全防护可减少误报,EFS 将分阶段向企业客户推出。

该产品如何定价?

Anthropic 将 Fable 5.1 列为按令牌计费的用量模式,并注明提示缓存读取价格为每百万令牌 0.25 美元;在定价页面上,批处理的输入价格为每百万令牌 10 美元,输出价格为每百万令牌 50 美元。发布文章称,在按令牌计费的典型用量下,Fable 5.1 的预计成本比 Fable 5 低 25%。

Quick Facts

产品类型
AI 模型发布
供应商
Anthropic
主要用途
编程、知识工作和智能体研究
可用性
Fable 5.1 普遍可用;Mythos 5.1 仅限受信任访问计划
平台
Anthropic 提及的 Claude、Claude Code、Claude Cowork、Claude.ai 和企业渠道
定价模式
按令牌计费;Anthropic 表示,Fable 5.1 在典型工作负载下的预计成本低于 Fable 5