AI 模型

Anthropic 发布 Claude Fable 5.1,并以受限方式开放 Mythos 5.1

Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,强调编码、知识工作和科研能力提升,同时调整价格并加强安全保护。

发布于 更新于
AnthropicClaudeAI 模型

Anthropic 9 月 1 日发布 Claude Fable 5.1 和 Claude Mythos 5.1,把它们定位为面向编码、知识工作、长时间 agent 任务和科学研究的重要升级。两个版本基于同一底层模型,但采用不同保护级别。Fable 5.1 面向一般用户开放,Mythos 5.1 则只通过可信访问项目提供,其保护措施专门面向高级网络安全和生命科学工作设计。

这次发布同时包含性能、价格和安全策略调整。Anthropic 表示,由于降低了缓存读取价格,在按 token 计费的典型工作负载中,Fable 5.1 预计比 Fable 5 便宜 25%。在高度 agent 化的任务中,节省幅度通常可以达到约 45%。这对前沿模型的企业使用很关键,因为长时间任务往往需要反复读取大型代码库、文档和工具输出。缓存成本下降后,企业可能不再只把高端模型用于最后润色,而是让它从研究、计划到实现更完整地承担工作。

Anthropic 还强调 Fable 5.1 的性能提升。公司称,该模型在 Terminal-Bench-Science、Terminal-Bench、Humanity’s Last Exam、OSWorld、AutomationBench 和 CursorBench 等基准上优于 Fable 5。公司还引用 Jane Street、Cognition、Millennium、MongoDB、Red Hat、Rakuten、Block、Ramp、Canva、Hebbia、Plaid 等早期合作方反馈,强调模型在实际 agent 工作中的表现,包括定位罕见软件崩溃原因、持续数天构建原型、审查复杂代码变更和发现新的研究方向。Anthropic 想传达的并不只是分数更高,而是模型能更长时间保持推理、沟通和执行质量。

科研部分尤其值得关注。Anthropic 称模型参与了蛋白结合物设计、计算分析和生物模型性能优化等任务。一个例子中,Claude Fable 5.1 基于 NASA Magellan 任务 30 多年前的雷达图像和已有地图,训练神经网络,为金星约三分之一表面生成更高分辨率的高程图。公司称,新地图把细节从 10 至 20 公里提升到 2 至 3 公里,并让高度估计准确度提升最多 25%。在计算生物学中,Anthropic 表示 Mythos 5.1 通过编写自定义 GPU kernel 和缓存中间结果,使七个开源深度学习模型加速最高 2.5 倍,并让部分全基因组分析的估算 GPU 成本降低 30% 至 60%。

这些能力也伴随更严格控制。Anthropic 称,Mythos 5.1 具备公司已发布模型中最强的网络能力,但仍处于其 Frontier Compliance Framework 下较低风险类别。公司还描述了化学和生物风险、提示注入抵抗能力以及对齐行为测试。Mythos 5.1 将继续采用限制研究级生物能力访问的保护措施,Anthropic 还表示,面向高级生物工作的访问项目是与美国政府合作开发的。对于 Fable 5.1,公司则让网络安全保护更精确,允许模型用于识别软件漏洞等防御性工作,同时把漏洞利用生成、渗透测试等更高风险双用途任务重定向到 Opus 模型。

此次发布还与 Anthropic 的 Enterprise Frontier Safeguards 紧密相关。该方案试图同时提供更强滥用监控和接近零数据保留的企业隐私保护;符合条件的客户在 EFS 今年秋季分阶段推出前,可使用带零数据保留的 Fable 5.1 和 Fable 5。整体来看,前沿模型公司正在把能力、成本和治理捆绑成同一个产品决策。Fable 5.1 旨在让高级 agent 工作更便宜、更可用;Mythos 5.1 则说明,最敏感的能力会越来越多通过受控访问分发,而不是一次性全面开放。