Anthropic が9月18日、自社のAIモデルを外から検証する相手として、コンサルティング大手のAccentureを選んだと発表した。両社はこの体制づくりに、今後5年でそれぞれ10億ドル以上を投じる見込みだという。合わせて20億ドル。AIの安全性検証にこの規模の金額が付いたのは、これが初めての部類に入る。
ただ、この発表で本当に目を引くのは金額ではない。その費用を、検証される側のAnthropicが検証する側のAccentureに直接支払うという一文のほうだ。Anthropic自身が発表文の中でそう書いている。
そして同じ9月18日、100人以上の研究者と評価者が連名で、「評価者は評価対象の企業と他の大きな商売をしていてはならない」という文書を公開した。AccentureはAnthropicの大口の取引先である。
何が発表されたのか──5年で各10億ドル
発表の骨子は短い。Accentureの人員がAnthropicの社内に入り、モデルの評価とレッドチーミング(攻撃する側に回って弱点を探す検証)、アラインメント評価(モデルが意図どおりに振る舞うかの検証)、安全装置の試験を担当する。この業務は、Accentureが買収したイギリスのAI企業Facultyが率いる。
Accenture公式のニュースリリースは、見出しの副題にこう置いた。「両社はそれぞれ、今後5年でAIを安全に構築するために10億ドル以上を投じる見込み」。Anthropic側の発表も同じ数字で、「この領域の能力構築に」各社10億ドル以上としている。
20億ドルという合計額は大きく見えるが、内訳を分けると印象が変わる。5年で割れば年あたり2社合計で4億ドル、1社あたりでは年2億ドルだ。
埋め込み評価者とは何か
「埋め込み評価者(embedded evaluator)」は、この数か月で出てきたばかりの言葉である。従来の第三者評価は、完成したモデルを外から叩いて結果を報告する形だった。埋め込み評価者はそうではなく、AI企業の中に席を置き、社員と同等の権限で開発の過程そのものを見る。
Anthropicの発表は、その権限で何ができるかを具体的に3つ挙げている。
その権限があれば、評価者はモデルが訓練の中で形になっていく様子を見て、モデルがどう作られどう配備されるかを決める判断を追い、従業員と直接話すことができる。
この構想の出どころははっきりしている。Anthropicのダリオ・アモデイCEOが9月12日に公開した「We Must Pace the Frontier(フロンティアの速度を律する)」というエッセイで、埋め込み評価者の導入を公約したのが先にあり、今回はその最初の実装にあたる。エッセイそのものについてはAnthropicが「AIの進化速度を意図的に落とす」と宣言した件で扱った。
Anthropicは同時に、この分野には決まりごとがまだ無いことも認めている。評価者がどの情報に触れてよいのか、見つけたことをどう公表するのか、標準は存在しない。資金の出どころについても「長期的には共同基金か公的資金から出るべきだ」と書いたうえで、「どちらも今日は存在しない」と続けている。
Anthropicの評価費用は誰が払うのか
ここが今回のいちばん重い論点だ。Anthropicの発表文には、こう書いてある。「この仕事の重要性と緊急性を踏まえ、AnthropicがAccentureの業務費用を直接負担する」。つまり、成績を付ける側の報酬を、成績を付けられる側が払う。
Anthropicはその構図を隠していない。共同基金も公的資金も存在しないから、当面は評価者ごとに異なる資金の出し方で進める、と書いている。METRのような非営利には相手の自己資金で、Accentureには自社負担で、という使い分けだ。
問題を難しくしているのは、AccentureとAnthropicがすでに深く商売でつながっていることである。両社は2025年12月9日に複数年の提携を発表し、Accenture Anthropic Business Groupという合弁の事業体を作った。約3万人のAccenture社員がClaudeの研修を受け、Claude Codeが同社の開発者に配られる。アモデイ氏自身がこれを「当社として過去最大の導入」と呼んだ提携である。
Accentureの業務費用はAnthropicが直接負担する。Anthropic自身が発表文にそう書いている。金額は「5年で各社10億ドル以上」という見込みの形でしか示されていない。
2025年12月に作られた合弁事業体では、約3万人のAccenture社員がClaudeの研修対象になっている。評価の契約が無くても、両社は取引関係にある。
Anthropicは「独立した埋め込み評価者は当社の説明責任を減らすものではなく、検証可能にするためのものだ。モデルの安全性の責任は当社にある」と書いている。責任の所在は動かさない、という立て付けである。
Accentureの側にとって、これは新しい収益源でもある。同社の2025年度の売上はおよそ700億ドル、社員数は約79万9,000人。その巨大なコンサル会社が、AIの安全性検証を事業として受注した。TechCrunchによれば、発表後の時間外取引でAccenture株は8%上昇している。業界関係者の多くはMETRやRedwood Researchのような非営利の評価機関が選ばれると見ていたところに、上場コンサルが入った形だ。
同じ日、100人以上が「それでは独立ではない」と書いた
偶然にしては出来すぎているのだが、同じ9月18日、AI Evaluator Forumという評価機関の連合体が「Minimum Conditions for Embedding Evaluators(埋め込み評価者の最低条件)」と題した公開文書を出した。署名者は100人以上。ジェフリー・ヒントン(Geoffrey Hinton)氏、カリフォルニア大学バークレー校のスチュアート・ラッセル(Stuart Russell)氏といった名前が並ぶ。
文書の要旨は、埋め込み評価が成り立つための条件を5つ示すものだ。報道されている範囲でまとめると、評価者は評価対象の企業に所有・支配されてはならず、その企業と他に大きな商売を持っていてはならず、評価結果に連動した報酬を受け取ってはならない。加えて、複数の評価機関が分野ごとに入ること、手法と結論を公開すること、報復(訴訟を含む)から守られること、そして社内の上級職と同等の情報にアクセスできること。
この文書が今回の提携を名指しで批判しているかどうかは、はっきりしない。ただ、条件のうち「評価対象企業と他に大きな商売を持たない」「結果に連動した報酬を受け取らない」の2つを、AnthropicとAccentureの組み合わせに当てはめると、少なくとも1つ目は当てはまらない。合弁事業体が現にある。
Anthropicの側の答えは、発表文の中にある。フロンティアAIには「共通の標準のもとで動く評価者の生態系」が必要で、フロンティア企業は複数の組織と同時に仕事をすることになる、という書き方だ。1社に全部を託さない形で担保する、という考え方である。実際に何社が加わるかは、これから数週間のうちに分かる。
評価が仕事になると、値札はどこに乗るか
ここまでは提携の話だが、AIを選ぶ側にとっての意味は別のところにある。
これまで「このモデルは安全か」を確かめる作業は、おおむね無償か、細々とした助成金でまかなわれてきた。大学の研究室と少数の非営利が担い、規模は小さかった。評価を専業にするスタートアップVals AIが2026年8月に実施したシリーズAの調達額は4,000万ドルで、これでも同種の会社としては大型の部類に入る。今回の提携は、その世界に年あたり4億ドルという水準の資金を持ち込む。
資金が入れば、検証の量と質は上がる可能性がある。同時に、誰が代金を払ったかという情報が、検証結果を読むうえで欠かせなくなる。そこが、読者の側で実際に変わる点だ。
Claudeの月20ドルのProや上位プランの価格は、今回の発表で何も動いていない。評価体制の費用は事業者側の支出であって、利用者向けの値札の改定は発表されていない。
今後、企業向けの提案資料や製品ページに「第三者評価を受けています」という一文が増える。そのとき確かめるのは、評価者の名前と、その評価者が誰から報酬を受け取っているかの2点である。今回の発表は、後者が必ずしも中立でないことを公式に示した。
「評価結果を公開するか」「評価者は何社入っているか」は、いまなら質問として通る。AI Evaluator Forumの5条件は、そのまま調達時の確認項目に転用できる形になっている。
Anthropicは今年に入ってから、自社の内情を数字で出す発表を続けている。9月17日にはモデル開発の何割をClaude自身が主導しているかを公表し(26%という数字)、7月に起きた不正アクセスの件では非営利のMETRによる独立レビューを予告していた(4件目の侵入が発覚した経緯)。今回の提携も同じ線の上にある。開示を増やし、外の目を入れる。その費用を自分で払う、というところまで含めて。
編集部の見立て
今回の発表で評価すべき点と、留保すべき点は、きれいに分かれていると考えます。評価すべきなのは、資金の出どころを隠さずに書いたことです。「共同基金や公的資金から出るべきだが、どちらも今日は存在しない」「だからAnthropicが直接負担する」という2文は、書かずに済ませることもできました。書いたことで、100人以上の署名が指摘した利益相反の論点が、最初から表に出ています。
留保すべきなのは、Accentureという選択そのものです。すでに合弁事業体を持ち、3万人規模でClaudeの研修を進めている相手に、自社の安全性を検証してもらう。この関係で不利な結論が出せるのかという疑問は、質問として自然だと思います。Anthropicの答えは「複数の評価者を入れる」ですが、それが担保になるかどうかは、次に発表される顔ぶれ次第です。
読者にとっての実用的な変化は、たぶん半年ほど先に来ます。企業向けのAI調達で「第三者評価済み」という表示が増え、その中身に差が出始めるときです。誰が評価したか、誰が払ったか、結論は公開されているか。この3つを並べて比べられる状態になって初めて、今回の20億ドルが読者の役に立ちます。いまはまだ、その体制が作られ始めた段階です。
なお、安全性評価にこれだけの金額が動くこと自体は、AIを選ぶ人にとって悪い知らせではないとも考えています。検証にお金が回らない状態が続くよりは、出どころに注意しながら量が増えるほうがましです。注意の払い方が変わるだけで、注意そのものを外していいという話ではありません。
まとめ
2026年9月18日、AnthropicとAccentureが、Anthropic社内に「埋め込み評価者」のチームを置く提携を発表しました。両社はそれぞれ、5年で10億ドル以上を投じる見込みです。業務はAccentureが買収したFacultyが率い、モデルの評価とレッドチーミング、アラインメント評価、安全装置の試験を行います。
費用はAnthropicがAccentureに直接支払います。Anthropicは発表文で、長期的には共同基金や公的資金が望ましいが現在は存在しない、と説明しています。両社は2025年12月に合弁の事業体を作っており、約3万人のAccenture社員がClaudeの研修対象になっている取引関係にあります。
同じ9月18日、AI Evaluator Forumが「埋め込み評価者の最低条件」を公開し、100人以上が署名しました。ヒントン氏らが名を連ねたこの文書は、評価者が評価対象企業と大きな商売を持つことと、結果に連動した報酬を受け取ることを避けるよう求めています。
Claudeの月額プランの料金は動いていません。変わるのは、これから増える「第三者評価済み」という表示の読み方のほうです。
Anthropicは、今後数週間のうちに別の評価者も発表すると書いている。その顔ぶれに、Anthropicと商売をしていない組織が何社入るか。今回の提携をどう受け取るべきかは、そこまで出てきて初めて数えられる。