Anthropicは2026年9月18日、先進的なAIモデルの独立評価を実施するため、Accentureとの提携を発表した。これは、モデル開発企業の外部で完成後にレビューを行うだけでなく、独立した評価者をモデル開発企業の内部に迎え入れることを目指す取り組みだ。共同作業は、Accenture傘下の専門AI部門であるFacultyが主導する。
提携の範囲には、モデルの評価と攻撃シミュレーション手法によるテスト、アラインメント評価、安全対策の検証が含まれる。Anthropicは、企業や政府、複数の業界でAIを導入してきたAccentureの経験が、モデルの安全性と利用の評価に実務的な視点を加えると述べた。
両社は、今後5年間にこの分野に関連する能力の構築へ、それぞれ少なくとも10億ドルを投資する見通しだ。同社は発表で、支出計画や投資を測定する仕組みの詳細を明らかにしなかった。
組み込まれた評価とは何を意味するのか?
組み込まれた評価とは、独立した評価者がAI企業の内部で、従業員に近いレベルのアクセス権を持って活動することを意味する。これにより評価者は、トレーニング中のモデルを追跡し、モデルの構築と展開に影響する判断を検証し、開発担当者と直接話すことができる。Anthropicによれば、この立場によって評価者は、安全に関する約束を企業が守っているかを確認し、弱点を発見し、インシデントを報告し、利益とリスクについて、より情報に基づいた形で一般の人々に伝えられる可能性がある。
Anthropicは、独立した評価者の存在によって安全性に関する責任が同社から移転したり、説明責任が軽減されたりするわけではないと強調している。同社のモデルの安全性は、引き続きAnthropicが直接負う責任だ。この取り組みの実務的な価値は、開発段階と社内の意思決定への独立したアクセスを通じて、この責任をより検証可能にすることにある。
まだ解決されていない空白
現時点では、組み込まれた評価者が取得すべき情報や、評価結果を報告する方法を定めた合意済みの基準は存在しない。また、長期的に独立評価へ資金を提供する安定した制度もない。Anthropicは、将来的には資金を共同拠出型または政府の資金源から得るべきだと考えているが、現在の段階ではこうした代替手段が利用できないため、Accentureの活動に直接資金を提供する。
同社はまた、METRやその他の非営利団体と、自己資金によって組み込まれた評価の一部を試験するための協議を進めている。さらに、Accentureとの提携は独占的なものではなく、今後数週間で発表する他の評価者とも協力すると発表した。一方、Accentureも他のAI開発企業と協力する。
certi.newsの見解
この発表の重要性は、モデルの安全性をめぐる議論を、個別に分離された評価報告書から、開発プロセスそのものの監視へと移す点にある。これにより評価者は、初期段階の意思決定やリスクをより適切に把握できる可能性があるが、その一方で、評価者の独立性、アクセス範囲、情報保護の仕組み、結果の公開方法をめぐる重大な疑問が生じる。Anthropic自身が基準や安定した資金調達モデルの不在を認めているため、この提携は最終的なガバナンスの枠組みというより、基盤を築く重要な試みと位置づけられる。