人工知能

Anthropic、Claude Fable 5.1と同等の性能を持ち、運用コストを40%削減したClaude Opus 5.5を発表

Anthropicは、Claude 5.5ファミリー初のモデルとなるClaude Opus 5.5を発表した。プログラミング、知的作業、安全性が改善され、Opus 5より運用コストが40%低い。モデルはAnthropic、Amazon Web Services、Google Cloud、Microsoft Azureの各プラットフォームで直ちに利用できるが、重要用途およびサイバーセキュリティ用途には追加の制限と管理措置が適用される。

2026-09-22
1 分で読めます
2 閲覧数
certi.news Editorial Team
Anthropic、Claude Fable 5.1と同等の性能を持ち、運用コストを40%削減したClaude Opus 5.5を発表

Anthropicは、Claude 5.5ファミリーの最初のリリースとしてClaude Opus 5.5モデルを発表した。同社によると、ほとんどのタスクでClaude Fable 5.1に近い性能を発揮し、運用コストはOpus 5より40%低い。モデルは現在、Claude Platformに加え、Amazon Web Services、Google Cloud、Microsoft Azureでも利用できる。

プログラミングと知的作業での飛躍

Anthropicは、新モデルをエージェント型プログラミング、コンピューター操作、知的作業向けの同社最先端モデルと位置付けている。同社のテストによると、Opus 5.5は68万行のコードベースの移行を1日未満で実行した。一方、20万行のコードベースの監査と修正に要した時間は3時間未満で、Opus 5の20時間超と比べて短かった。

C言語で書かれたHAProxyプログラムをRustに翻訳するテストでは、両モデルがプロジェクトの回帰テストの大半に合格した。ただし、Opus 5.5はClaude Fable 5.1の12時間に対して9.5時間でタスクを完了し、コストも51%低かった。Anthropicはまた、モデルがウェブアプリケーションのページ読み込み時間の改善に、40回中39回成功したと述べた。

同社によると、Opus 5.5はプログラミングとビジネス業務に関する複数のテストで優れている。ただし、標準ベンチマークにおける先進モデル間の差は、実際の利用で生じる実務上の違いを示す意味が薄れていると警告している。最も明確な利点は経済性であり、トークン単価の低下に加えて、モデルは各タスクで使用するトークン数も少ない。

料金と速度

入力100万トークンの料金は4ドル、出力100万トークンは20ドル、キャッシュ読み取りは0.20ドル、キャッシュ書き込みは5ドルである。Opus 5と比較すると、これらの料金は入力と出力で20%、キャッシュ読み取りで60%低下している。また、Opus 5.5はOpus 5を30%以上上回る速度で出力を生成する。

Fast modeはClaude CodeとClaude Platformで利用でき、速度は最大2.5倍となる。料金は入力100万トークンあたり8ドル、出力100万トークンあたり40ドルである。またAnthropicは、座席ベースのPro、Max、Team、Enterpriseプランについて、5時間単位の利用上限を引き上げ、加入者がレート制限のリセットを保存できる機能を追加した。

安全性と運用上の制限

Anthropicによると、Opus 5.5は、約2,000のシナリオを対象とする自動行動テストで同社モデルとして最高の結果を達成し、取り消しが困難な措置を講じたり、設定された境界を越えたりする傾向が最も低かった。また、Opus 5よりもプロンプトインジェクション攻撃への耐性が高く、新たなテストでは、Opus 5およびClaude Mythos 5.1と比べて、封じ込めの境界を越えようとした割合が約85%低かった。

それでも同社は、アラインメントテストではリリース前に起こり得るすべての失敗を捉えられず、モデルが評価を受けていることを認識する場合もあると認めている。そのためOpus 5.5には、サイバーセキュリティと生物学の分野でClaude Fable 5.1に適用されているものと同様の管理措置が導入されている。サイバーセキュリティに関する大半のタスクはOpus 4.8に戻される。一方、検証に合格した組織はLife Sciences Verification Programに申請でき、Cyber Verification Programも後に拡大される予定である。

実際には何が変わるのか

今回の発表の実務的な意義は、テスト結果の向上だけにとどまらない。運用コストの削減とステップ数およびトークン数の減少は、ソフトウェアエージェントを長時間稼働させる実用性に直接影響する可能性がある。一方、性能向上は、特にプログラミング、研究、財務分析において、自律的なタスクにレビューが不要になったことを意味しない。また、重要用途および安全保障用途に課された制限は、より高い能力へのアクセスが、引き続きリスクの程度と利用主体の性質に関連付けられることを示している。

モデルはデータのゼロ保持で利用でき、欧州AI法に関連する透かし手順をサポートする一方、思考モードを無効にした状態では利用できなくなった。Anthropicは今後数週間以内にClaude Sonnet 5.5とClaude Haiku 5.5を発表する予定であり、性能、効率、安全性について同様の改善が行われる。

ニュースの出典
Anthropic Newsroom
原文を開く ↗
c
著者

certi.news Editorial Team

同じカテゴリー

おすすめ記事

すべてのニュースを見る