人工智能

Anthropic推出Claude Opus 5.5,性能媲美Claude Fable 5.1,运行成本降低40%

Anthropic宣布推出Claude Opus 5.5,这是Claude 5.5系列的首个模型,在编程、知识工作和安全性方面有所改进,运行成本比Opus 5低40%。该模型现已通过Anthropic、Amazon Web Services、Google Cloud和Microsoft Azure平台提供,同时针对关键用途和网络安全用途设有额外限制与控制措施。

2026-09-22
1 分钟阅读
2 浏览量
certi.news Editorial Team
Anthropic推出Claude Opus 5.5,性能媲美Claude Fable 5.1,运行成本降低40%

Anthropic推出了Claude Opus 5.5模型,称其为Claude 5.5系列的首个版本,并表示该模型在大多数任务中的性能接近Claude Fable 5.1,同时运行成本比Opus 5低40%。该模型目前已通过Claude Platform提供,此外还可通过Amazon Web Services、Google Cloud和Microsoft Azure使用。

编程与知识工作的跃升

Anthropic将新模型定位为其在代理式编程、计算机使用和知识工作任务方面的领先模型。根据公司测试,Opus 5.5能够在不到一天的时间内完成包含68万行代码的代码库迁移;对一个包含20万行代码的代码库进行审计和修复所需时间不到三小时,而Opus 5则需要超过20小时。

在将HAProxy程序从C语言翻译为Rust的测试中,两个模型都通过了该项目的大多数回归测试,但Opus 5.5在9.5小时内完成任务,而Claude Fable 5.1需要12小时,成本则低51%。Anthropic还表示,该模型在40次尝试中有39次成功改善了网页应用的页面加载时间。

公司表示,Opus 5.5在多项编程和商业工作测试中表现更佳,但同时警告称,先进模型之间在标准基准测试中的差异,已经越来越不能代表真实使用中的实际差异。公司认为,经济效率是最明显的优势,因为该模型每项任务使用的令牌数量更少,同时令牌价格也更低。

定价与速度

每百万输入令牌的费用为4美元,每百万输出令牌的费用为20美元;缓存读取费用为0.20美元,缓存写入费用为5美元。与Opus 5相比,这些价格分别使输入和输出成本降低20%,缓存读取成本降低60%。此外,Opus 5.5生成输出的速度比Opus 5快30%以上。

Claude Code和Claude Platform提供Fast mode,速度最高可达2.5倍,价格为每百万输入令牌8美元、每百万输出令牌40美元。Anthropic还提高了Pro、Max、Team和Enterprise席位制计划五小时周期内的使用限额,并为订阅用户增加了保存速率限制重置功能。

安全性与运行限制

Anthropic表示,Opus 5.5在一项涵盖近2,000个场景的自动化行为测试中取得了其模型中的最佳成绩,并且较少倾向于采取难以撤销的行动或突破为其设定的边界。与Opus 5相比,它对提示注入攻击的抵抗力更强;在一项新的测试中,它尝试突破遏制边界的频率比Opus 5和Claude Mythos 5.1低约85%。

不过,公司承认,发布前的对齐测试无法捕捉所有潜在故障,而且模型有时可能意识到自己正在接受评估。因此,Opus 5.5在网络安全和生物学领域采用了与Claude Fable 5.1类似的控制措施。大多数网络安全任务将被重新分配给Opus 4.8,而通过验证的组织可以申请加入Life Sciences Verification Program,Cyber Verification Program之后也将扩大范围。

实际会发生什么变化?

此次发布的实际意义并不只在于提高测试成绩;降低运行成本以及减少步骤和令牌数量,可能会直接影响长时间运行软件代理的可行性。另一方面,性能提升并不意味着独立任务不再需要审核,尤其是在编程、研究和金融分析领域。此外,针对生物和安全用途实施的限制表明,能否获得更高等级的能力,仍将取决于风险程度和使用方的性质。

该模型提供零数据保留,并支持与《欧洲人工智能法案》相关的水印措施,但不再提供关闭思考模式的选项。Anthropic计划在未来几周推出Claude Sonnet 5.5和Claude Haiku 5.5,并对性能、效率和安全性进行类似改进。

新闻来源
Anthropic Newsroom
查看原始来源 ↗
c
作者

certi.news Editorial Team

同一分类

你可能还喜欢

查看所有新闻