米アクセンチュアとAnthropicは、AIモデルの安全性評価を担う「組み込み型評価者」チームの設立で提携した。両社は今後5年間で、それぞれ10億ドル以上をAIの安全性向上に投資する見通しだ。
AnthropicのAI開発に安全性評価の専門チームを配置
2026年9月18日の発表によると、「組み込み型評価者」チームはAnthropicの社内チームや安全性に関するパートナーと連携し、安全性の検証を担う。
主な業務には、AIモデルの評価、レッドチーム(※)による検証、アラインメント評価、安全対策機能のテストが含まれる。
両社はAIの安全性向上に向け、今後5年間でそれぞれ少なくとも10億ドルを投資する見通しを示した。アクセンチュアは、責任あるAIに関する長年の取り組みと技術的な専門性に加え、買収した応用AI企業Facultyの知見を活用する。
Facultyは、AIモデルのテストや評価、安全性と倫理性を設計段階から考慮したシステムの構築に取り組んできた。政府、防衛、医療、インフラなど幅広い分野で経験を持ち、新型コロナウイルスのパンデミック時には、英国の国民保健サービス(NHS)の早期警戒システムの開発にも携わった。
アクセンチュアのジュリー・スウィートCEOは、AIの安全性には高度な技術力と実社会での利用状況への理解が必要だと説明した。組み込み型評価は新興分野であり、組み込み型評価者の発展を加速させる手助けをしたい考えだ。
また、同社のマーク・ワーナーCTO兼Faculty CEOは、Anthropicと組んで組み込み型評価を担うことは、まさにFacultyが取り組むために築かれてきた仕事だと述べている。
※レッドチーム:攻撃者の視点からシステムやAIモデルを検証し、脆弱性や安全上の問題を発見する手法。想定外の入力や悪用を試すことで、安全対策の有効性を確認する。
評価体制の強化がもたらす利点と残る課題
組み込み型評価者を開発チームと連携させる仕組みは、安全上の問題を早い段階で発見し、改善につなげやすいと考えられる。完成後の検証では見えにくい開発途中の判断も、評価の対象に含めやすくなるだろう。
また、Facultyが持つ政府や医療などの分野での経験は、技術面だけでは捉えにくい実運用上のリスクを検討する際にも役立つとみられる。
利用場面を踏まえた評価ができれば、安全性をより多面的に判断できる可能性がある。
一方、専門チームを設けても、あらゆる問題を事前に発見できるとは限らない。新たなリスクに備え、評価基準や検証手法を継続的に更新する必要もある。
開発側と近い距離で働く体制は、評価が開発の論理に引きずられる懸念もあり、率直な指摘を保てるかどうかが信頼性を左右する論点になりそうだ。
今後は、両社が計画する投資が、評価体制の整備や具体的な安全性の改善にどこまでつながるかが注目点となる。AIを導入する企業にとって、こうした評価の取り組みが、安全性を見極める材料になるのかも見ていきたい。
関連記事:
アクセンチュア、Anthropicと日本連携強化 AI主導の全社変革支援が本格化

アクセンチュア、OpenAIとの国内協業を拡充 AIエージェントで企業全体の業務改革を支援

評価中のClaudeが実在3組織へ不正アクセス Anthropicが評価環境改善を提言
