聚焦编程与知识工作
Anthropic 将 Fable 5.1 定位为面向编程、知识工作和长期问题解决的模型,并表示其在多项任务的基准测试中超过 Fable 5。
Claude Fable 5.1 和 Claude Mythos 5.1 是 Anthropic 最新发布的模型,面向编程、知识工作和智能体问题解决。Anthropic 将它们描述为具有不同安全防护级别的同一底层模型:Fable 5.1 现已普遍可用,而 Mythos 5.1 仅限受信任访问计划。
除能力提升外,此次发布还强调了三项产品变化:Fable 5.1 典型工作负载的预计按令牌计费价格更低;推出名为 Enterprise Frontier Safeguards 的全新企业隐私与安全防护方案;以及减少安全系统中的误报。Anthropic 还将这些模型定位于研究密集型工作流,包括科学研究、网络安全和生命科学,同时对高风险使用场景保持更严格的访问控制。
在性能方面,Anthropic 表示,Fable 5.1 在编程、知识工作和长期任务方面均有所提升,超过 Fable 5;在某些情况下,较低的努力程度设置也能以更低成本取得相近或更好的结果。该公司将此次发布定位为面向需要更高输出质量、更可控支出,以及针对敏感工作负载更清晰安全防护的团队的更新。
Anthropic 将 Fable 5.1 定位为面向编程、知识工作和长期问题解决的模型,并表示其在多项任务的基准测试中超过 Fable 5。
发布说明重点介绍了智能体科学研究和多学科推理基准测试,将该模型定位为不仅适用于软件任务。
Anthropic 表示,Fable 5.1 可在 Low、Medium、High、xHigh 和 Max 五种努力程度下运行,并且在某些工作负载中,较低的努力程度可以以更低成本产生相近结果。
该模型被描述为能够解决软件问题的根本原因,而不是走捷径;其中一个示例涉及 Millennium 在测试中发现的一次罕见崩溃。
Anthropic 表示,该模型与 Mythos 5.1 使用相同的底层系统,但安全防护不同;Mythos 仅面向受信任访问计划,定位于网络安全和生命科学使用场景。
发布公告称,改进后的安全防护旨在减少网络安全领域的误报,并介绍了新的、注重隐私的企业安全防护,可在保留业界领先的滥用检测能力的同时支持完整隐私。
对于编写或审查软件的团队,Anthropic 将 Fable 5.1 定位为适用于智能体编程、代码审查,以及持续调查后才能找到根本原因的错误。
对于分析师和运营团队,该模型面向长期知识任务,例如综合整理、问题拆解,以及基于复杂输入进行多步骤推理。
对于研究密集型用户,Anthropic 将智能体科学研究和多学科推理列为明确的基准测试领域,表明其适合探索性研究工作流。
对于安全团队,发布说明称 Fable 5.1 可以帮助发现软件漏洞,而具备更高安全防护级别的 Mythos 5.1 则面向受信任访问下的网络安全工作。
对于受监管或处理敏感信息的组织,Enterprise Frontier Safeguards 和零数据保留过渡选项被介绍为企业部署中的隐私与滥用检测方案。
Claude Fable 5.1 是普遍可用的版本,而 Claude Mythos 5.1 仅通过受信任访问计划提供。Anthropic 表示,两者基于相同的底层模型,但安全防护级别不同。
Anthropic 表示,Fable 5.1 面向编程、知识工作和长期问题解决任务。发布说明还介绍了其面向研究的能力,以及在智能体科学研究、终端编程和多学科推理方面的基准测试结果。
Anthropic 表示,Fable 5.1 可用于发现软件漏洞,但不能用于开发针对这些漏洞的利用程序。Mythos 5.1 则面向网络安全和生命科学工作流中的更高安全防护级别访问。
Anthropic 表示,在 Enterprise Frontier Safeguards 可用之前,符合条件的客户可以对 Fable 5.1 使用零数据保留。该公司还表示,新安全防护可减少误报,EFS 将分阶段向企业客户推出。
Anthropic 将 Fable 5.1 列为按令牌计费的用量模式,并注明提示缓存读取价格为每百万令牌 0.25 美元;在定价页面上,批处理的输入价格为每百万令牌 10 美元,输出价格为每百万令牌 50 美元。发布文章称,在按令牌计费的典型用量下,Fable 5.1 的预计成本比 Fable 5 低 25%。
ByteAsk 是面向 C 和 C++ 的终端优先 AI 编码 agent,可直接编辑仓库,并在展示 diff 前用真实编译器、调试器、sanitizers 和测试验证修改。提供免费版与付费方案。
Ghost 是一款基于终端的 AI 助手,可在命令行中聊天、生成代码并运行任务。内置免费模型,支持 Linux、macOS 和 Windows,且为开源项目。
Vi3ecode 是面向 AI 编程代理的持续开发环境,保留项目上下文、终端、Git、记忆、流程、评审与沟通,围绕你正在使用的 agent 协同工作。
Lucid Train 是一款本地优先的 AI 编码工具,可将仓库代码生成架构图,并把图作为编码代理的规格说明。支持桌面应用与轻量 Rust CLI,可运行本地模型或使用自有 API key。
MeetStream 是一款适用于 Zoom、Google Meet、Microsoft Teams 和 Webex 的会议 bot API,帮助开发者以按量计费方式程序化录制、直播和分析会议,注册即送 $5 试用额度。
CreateOS Sandbox 是基于 Firecracker 微型虚拟机的隔离计算环境,用于运行代码和 agent 工作负载,支持私有网络、SDK、CLI 和 MCP 程序化控制。