Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1:性能超越前代,缓存读取费用下调 75%
IT之家 9 月 2 日消息,当地时间 9 月 1 日,Anthropic 宣布推出 Claude Fable 5.1 和 Claude Mythos 5.1 模型。该公司称这两款模型为“全球最先进的编程与知识工作模型”。 Fable 5.1 与 Mythos 5.1 采用相同的基础模型,区别在于安全防护等级不同 ——Fable 5.1 面向所有用户开放,Mythos 5.1 仅通过可信访问计划向经过审核的网络安全和生命科学领域的机构提供。 性能方面,Anthropic 披露的基准测试数据显示,Fable 5.1 在多项测试中超过了前代 Fable 5、Opus 5 以及 OpenAI 的 GPT-5.6 Sol。 在智能体科学研究基准 Terminal-Bench-Science 0.1 中,Fable 5.1 得分为 52.6%,而 Fable 5 为 24.7%、Opus 5 为 29.0%、GPT-5.6 Sol 为 22.4%。 在智能体编程基准 Terminal-Bench 4.0 中,Fable 5.1 得分为 55.8%,Mythos 5.1 在更宽松的安全防护下达到 60.9%。 知识工作方面,Fable 5.1 在 GDPval-AA v2 测试中获得 1853 分,高于 Opus 5 的 1824 分和 Fable 5 的 1723 分。 价格方面,Fable 5.1 的缓存读取(cache reads)费用下调 75%,降至每百万词元 0.25 美元。典型工作负载下,Fable 5.1 的成本比 Fable 5 低约 25%;对于高度智能体化的工作负载,成本最高可降低 45%。基础定价保持不变:输入词元每百万 10 美元,输出词元每百万 50 美元。 数据保留方面,Anthropic 推出了全新的企业级前沿防护措施(Enterprise Frontier Safeguards,EFS)。该方案将零数据保留的隐私保护与先进的安全防护相结合,客户数据存储在由企业完全控制的云基础设施中,而非 Anthropic 的系统中。EFS 将于今年秋季开始分阶段向企业客户推出。在 EFS 可用之前,符合条件的客户可使用零数据保留政策使用 Fable 5.1。 安全防护方面,Anthropic 对 Fable 5.1 的防护机制进行了改进,以减少误报。 在网络安全领域,新版防护措施的误报拦截数量比此前减少约 60%。Fable 5.1 现在可用于发现软件漏洞,但不会用于开发针对这些漏洞的利用程序。 生物学领域,Anthropic 与美国政府合作建立了访问计划,允许研究人员利用 Mythos 5.1 的高级生物学能力,并计划在近期向科学家开放注册。 科学能力方面,Anthropic 展示了 Mythos 5.1 在多个领域的成果。在分子设计领域,Myth
说明:本站展示中文整理摘要,便于快速阅读;完整内容和版权归原站所有。