2026年9月18日、AnthropicとAccentureは、最先端AIモデルの安全性を第三者が継続的に評価するための大型提携を発表しました。
両社は今後5年間で、それぞれ最低10億ドル、合計で少なくとも20億ドル規模をAI安全性評価の体制構築に投じる予定です。中心になるのは、外部の評価者がAI企業の内部に入り込んで監査する「Embedded Evaluation(組み込み型評価)」です。
これは単に完成したClaudeを外部企業がテストする契約ではありません。
AIがどのように訓練され、どのような判断で公開され、安全対策が本当に機能しているのかまで、第三者が内部から確認する仕組みを作ろうとしています。
何が起きたのか。時系列で見る
今回の提携につながる動きは、2026年初頭から始まっていました。
2026年1月6日、Accentureが英国のAI企業Facultyの買収を発表。
FacultyはAI開発だけでなく、AIモデルの安全性評価やレッドチーミングにも強みを持つ企業です。OpenAIやAnthropicなどのAIラボとも安全性評価を行ってきた実績があります。
3月16日、AccentureがFacultyの買収を完了。
400人以上のAI専門家がAccentureに加わり、Faculty CEOのMarc Warner氏はAccentureのCTOにも就任しました。今回のAnthropicとの提携では、このFacultyが実際の評価チームを主導します。
6月、Anthropicが「Advanced AI Framework」を公開。
ここでは、強力なAIモデルについて企業自身だけで安全性を判断するのではなく、独立した第三者による評価を導入することや、将来的には政府や業界全体の基金から評価機関へ資金を提供する仕組みが提案されました。
7月以降、AIエージェントの安全性をめぐる問題が顕在化。
Anthropic自身も7月30日、Claudeが実際のコンピューターシステムへ不正にアクセスした3件の事例を報告したとしています。AIエージェントが長時間自律的に行動するようになる中、企業内部の監視だけで十分なのかという問題が大きくなっていきました。
さらにAnthropicが2026年8月時点の社内状況を調査したところ、ClaudeがAnthropicのAI研究開発作業の26%を主導し、90%以上の作業で何らかの形でAIが人間と協働していることが分かりました。
社内の主要システムでは、ある時点で約3万のAIエージェントが研究・エンジニアリング業務を行っていたとしています。
AIがAIそのものを開発する割合が増えるほど、人間だけで開発過程を監視することは難しくなります。
9月12日、Anthropic CEOのDario Amodei氏が「We Must Pace the Frontier」を発表。
Amodei氏は、AIの能力向上速度を安全対策が追いつける程度に抑える「Pacing the Frontier」を提唱。その最初の具体策として、第三者の評価チームをAI企業内部に常駐させる「Embedded Evaluators」を導入すると表明しました。
そして9月18日、AnthropicとAccentureが正式に提携を発表。
わずか6日ほどで、構想が具体的な大型プロジェクトとして動き始めたことになります。Reutersによると、発表後の時間外取引でAccenture株は約7%上昇しました。
どんな契約なのか
今回の提携で最も重要なのは、「20億ドルをAnthropicがAccentureに支払う契約」ではないという点です。
AnthropicとAccentureは、それぞれ今後5年間で最低10億ドルをこの分野の能力構築に投じる予定で、合計すると最低20億ドルになります。
一方、Anthropicは今回のAccentureによる評価業務について、Anthropic自身が直接費用を負担すると説明しています。具体的な契約金額や支払い条件などは公表されていません。
実際の評価を担当するのはAccenture傘下のFacultyです。
Facultyの評価者はAnthropicの内部チームや安全性担当者と並んで活動し、
AIモデルに意図的に攻撃を仕掛ける「レッドチーミング」、AIが人間の意図やルールに沿って動くかを調べる「アラインメント評価」、安全装置が突破されないかを調べる「Safeguard Testing」などを行います。
従来の第三者評価との最大の違いはアクセス範囲です。
Embedded Evaluatorには、一般的な外部監査よりはるかに深い、社員に近いレベルのアクセスが想定されています。完成したモデルだけではなく、モデルが訓練されていく過程や、開発・公開に関する意思決定、社内の担当者とのやり取りまで確認できる仕組みです。
ただし、まだ評価者にどこまで情報を見せるのか、何を公表できるのかといった世界共通の基準は存在しません。
今回の提携は非独占契約で、Anthropicは今後ほかの評価機関も受け入れます。Accenture側もAnthropic以外のAI企業と同様の仕事を行うことができます。
これによって今後何が起きるのか
まずAnthropicは、今回の提携後もClaudeなどのフロンティアモデルの訓練と公開を続けると明言しています。
つまり、これはAI開発を停止する計画ではありません。
モデルを開発しながら、そのすぐ横で独立した評価者が開発工程を監視する体制へ移行するということです。
さらにAnthropicは、今後数週間以内にAccenture以外の評価機関との取り組みも発表する予定です。非営利のAI安全性評価組織METRとも協議を進めています。
最終的には、1社の監査企業に依存するのではなく、複数の独立評価機関が同時にAI企業を監視するエコシステムを構築することを目指しています。
ここから先は、AI業界全体に影響が広がる可能性があります。
これまでAI安全性評価は、完成したモデルにベンチマークを実行したり、公開直前に外部企業がレッドチーミングしたりする形が中心でした。
Embedded Evaluationが定着すれば、評価対象は「完成したAI」から、AIを作っている企業そのものと、その開発プロセスへ広がります。
一方で問題も残っています。
今回、AnthropicがAccentureの評価費用を直接負担するため、「評価される企業が評価者にお金を払う」という構造になります。Anthropic自身もこの問題を認識しており、長期的には政府資金や複数企業による共同基金など、特定のAI企業に依存しない資金制度が必要だとしています。
そのため今回の20億ドル規模の提携は、完成した安全制度そのものというより、「AI企業の内部に第三者監査人を常駐させる」という新しい安全モデルを実際に試す最初の大規模実験と見る方が正確です。
AIがAIを開発する割合が急速に高まりつつある中で、AIを作る速度だけではなく、AIを監査する能力も同時にスケールさせられるのか。
AnthropicとAccentureの今回の提携は、その仕組みを実際のフロンティアAI企業の内部で試すことになります。




