人工智能

Anthropic推出Claude Fable 5.1和Mythos 5.1,降低代理成本并加强模型保护

Anthropic推出Claude Fable 5.1和Claude Mythos 5.1,用于编程、科学研究和长期任务,同时将缓存读取成本降低75%,并向通过专业验证项目的用户开放Mythos版本。该公司还对API账户实施了新限制,以应对模型蒸馏攻击。

2026-09-02
1 分钟阅读
9 浏览量
certi.news
Anthropic推出Claude Fable 5.1和Mythos 5.1,降低代理成本并加强模型保护

Anthropic宣布推出Claude Fable 5.1和Claude Mythos 5.1,重点面向编程、信息密集型任务和长期问题解决。两款模型采用相同的基础架构,但Mythos 5.1具有更灵活的安全限制,仅向在网络安全和生命科学领域通过验证的用户和机构开放。

Fable 5.1面向一般用途,而Mythos 5.1则面向可能需要更广泛测试范围或技术操作的专业业务。Anthropic表示,新模型沿用Fable 5的输入和输出令牌价格,即通过API每百万输入令牌10美元、每百万输出令牌50美元。与此同时,该公司将缓存读取令牌的价格降低75%,至每百万令牌0.25美元。

降低代理任务成本

据Anthropic称,与Fable 5相比,这些变化可使用户在通常工作负载下节省约25%,而在包含多次工具调用和长上下文的代理任务中,节省幅度可能达到约45%。该公司表示,Fable 5.1在使用低或中等计算能力级别时,就能达到与Fable 5相当或更高的性能。在Claude Code中,该模型默认以高能力级别运行;在Claude Cowork和Claude.ai中则默认以中等能力级别运行。

编程和研究结果更佳

Anthropic公布的测试显示,部分领域取得了明显改进。Fable 5.1在Terminal-Bench-Science 0.1测试中得分52.6%,而Fable 5为24.7%。在用于编程的Terminal-Bench 4.0测试中,Fable 5.1得分55.8%,Mythos 5.1达到60.9%,而Fable 5约为42%。

该公司列举了长期任务的示例,其中包括Fable 5.1发现投资公司Millennium系统中的一个罕见软件错误,该错误大约每运行一百万次才出现一次。该模型还利用美国国家航空航天局(NASA)Magellan任务收集的雷达图像,创建了一幅覆盖金星约三分之一、具有高分辨率的高程地图。在计算生物学领域,Mythos 5.1帮助优化了七个开源深度学习模型的图形处理单元(GPU)处理流程,使部分模型的运行速度提高了最多2.5倍。

应对模型蒸馏的新限制

Fable 5.1包含用于防范模型蒸馏的机制。模型蒸馏是大规模收集高级模型输出,以训练另一个模型的过程。Anthropic表示,这些操作可能依赖数千个虚假账户,将高级模型的能力转移到未实施同等安全控制的系统中。

根据这项变更,新的Claude API账户将不允许用户在多轮对话中手动修改此前的对话上下文,同时保留模型此前的思维记录。Anthropic表示,该措施关闭了公开记录的一种模型蒸馏途径。此前,该公司曾宣布发现涉及约2.4万个虚假账户以及与Claude进行超过160万次互动的操作,并将其与DeepSeek、Moonshot AI和MiniMax联系起来。新限制目前仅适用于新账户,未来版本中可能扩大到所有账户。

实际会发生什么变化?

此次公告最突出的价值并不局限于两款模型的名称,而在于同时降低代理使用成本,并加强对访问此前上下文方式的控制。这可能使管理大量多次调用的长期任务的开发者受益,但同时也会给通过API测试或管理对话的方式增加一项限制。此外,文中列出的性能结果是Anthropic自行提供的数字,因此无法说明这些结果在所提测试之外的可比性。

Fable 5.1可通过Claude平台以及Amazon Web Services、Google Cloud和Microsoft Azure的服务使用,也可通过Claude API使用,模型标识符为claude-fable-5-1。Mythos 5.1则仅向通过Cyber Verification Program或Life Sciences Verification Program的网络安全和生命科学用户开放。生命科学项目由Anthropic与美国政府合作开发;用于检查代码库漏洞的Claude Security产品现已由Mythos 5.1提供支持。

新闻来源
c
作者

certi.news

同一分类

你可能还喜欢

查看所有新闻