Anthropicは2026年10月6日、Cyber Verification Program(CVP)を拡大すると発表した。これにより、適格なセキュリティ組織は、業務内容に応じて高度なサイバー能力と、より制限の少ない分類上の保護策を利用できる。プログラムには、Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1の各モデルに加え、将来のモデルも含まれる。
業務の種類に応じた3段階
プログラムは、セキュリティ運用センターやインシデント対応の業務、マルウェアのリバースエンジニアリング、脆弱性の分析と検証といった防御作戦を対象とするDefense Accessから始まる。対象となり得る組織には、企業、大学、政府機関のセキュリティチーム、重要インフラの運用者、小規模なセキュリティ企業、オープンソースプロジェクトのメンテナー、脆弱性報告の実績が確認できる個人研究者が含まれる。Anthropicは、申請に数日以内に回答する見込みだ。
Red Team Accessでは、ペネトレーションテストと攻撃シミュレーションチームが追加される。ただし、テストは申請者がテストを許可されているシステムに限定されなければならない。ランサムウェアの展開、物理システムの破壊、高リスクの安全システムのテストなどは、引き続き直ちに禁止される。現在、このレベルは組織に限定されており、審査には数週間かかる場合がある。適格な申請者は一時的にDefense Accessに登録される。
Specialized Accessは、障害が人命や市場に影響を及ぼす可能性のあるシステムをテストする権限を持つ、少数の認証済み組織のために確保される。対象には、航空機の運航システム、電力網、通信、銀行間送金インフラ、政府ネットワークなどが含まれる。Anthropicはこのレベルの各組織を米国政府と協力して審査する。また、現在のProject Glasswingのメンバーは、現行モデルについて再認証を受けることなく新しいレベルへ移行する。
有用性と禁止のバランスを検証
Anthropicは、現実的な状況における複数段階のサイバー作戦の計画と実行を測定する評価、CyScenarioBenchを通じてClaude Opus 5.5をテストした。CVPへのアクセスがない場合、10種類のタスクは初回の試行ですべてブロックされた。Defense Accessでは、50回の試行のうち46回がいずれかの時点でブロックされ、4回の試行が成功した。Red Team Accessではブロックは発生せず、モデルは50タスク中34タスクを完了した。これは、保護策なしで実行した場合に記録した結果とほぼ同じで、成功率は67.6%だった。
実際に何が変わるのか
基本的な変更は、サイバー能力を全員に開放することではなく、多段階の認証を通じて一般に利用可能なモデルから切り離し、モデルの能力を権限の種類と必要な管理策に結び付けることだ。一般モデルは、コードレビュー、既知の問題の修正、所有するコード内の脆弱性の発見、セキュリティアラートの分類に引き続き適している。
Anthropicによると、Project Glasswingのパートナーは2026年4月から7月までに、少なくとも12万9,000件の確認済みソフトウェア脆弱性を発見した。また、同社が実施したオープンソースのスキャンでは、4月から10月までにさらに5,500件の脆弱性が見つかった。これまでに3万3,000件以上が重大または高リスクに分類されているが、同社は、数値がパートナーの一部から得たスキャンデータに部分的に依存しているため、実際より少ない可能性があると注意を促している。
プログラムへの参加には、サイバー上の悪用を監視するためのデータ保持が必要となる。Anthropicによると、適格な組織は後にEnterprise Frontier Safeguardsを利用できるようになる。これは、データのゼロ保持と保護管理を組み合わせ、組織が管理するクラウド基盤にデータを保存するものだ。利用可能になるまでの間、一部のClaude Fable 5.1またはClaude Mythos 5.1のゼロ保持ユーザーは、このポリシーでCVPを利用できる。
certi.newsの見解:このプログラムは、AIモデルにおけるデュアルユースのジレンマを実務的に解決しようとする試みを反映している。すなわち、一般的な攻撃利用を防ぎながら、防御チームから脆弱性の発見を加速し得るツールを奪わないということだ。しかし、テスト結果はAnthropic自身が出したものであり、より高いアクセスレベルへの移行には組織としての検証と継続的な監督が必要となる。一方、EFSの提供時期と、詳細な適格性評価の仕組みは依然として未解決の論点だ。