Anthropicが2026年9月17日、自社のAIモデル開発(研究開発=R&D)がどこまでClaudeに任されているかを示す内部指標を、初めて数字とともに公表した。Claudeが「主導」する研究開発の割合は、2026年8月時点で26%。半年前の2月には1%に届いていなかったという。
対象になっているのは、いま使っているClaudeの性能改善そのものではなく、次の世代のClaudeを作る作業である。モデルを作るための実験設計、学習の実行、性能評価、コードの最適化──これらの工程の4分の1超を、すでにClaude自身がこなしている計算になる。
何が公表されたか──「主導」26%の中身
Anthropicが今回公開したのは、社内のモデル開発チームの仕事を、外部の研究機関Epoch AIが考案した尺度をもとに6段階(AL0〜AL5)に分類し、各段階にどれだけの作業時間が該当するかを測った結果である。AL0は「人間だけで行う」、AL5は「AIが完全に自律して行う」を指す。今回の測定対象は2026年7月13日から20日までの1週間で、関係部門のスタッフの20%をランダムに抽出し、Claudeの調査用エージェントがSlackや社内文書をもとに1件ずつ仕事の中身を判定して、約15,000件の作業記録を集めたという。
その結果、Claudeが「主導」する(人間の大枠の指示のもとで、実質的な作業の大半をAIが担う)段階に分類された作業が全体の26%。加えて、人間とAIが密接に連携しながら進める「協働」以上の段階まで含めると90%以上に達したという。
半年で1%未満から26%へ
今回の発表でとくに目を引くのは到達点の26%そのものより、そこに至るまでの速さである。Anthropicによれば、同じ基準で測った「主導」の割合は、2026年2月の時点では1%に届いていなかった。半年足らずで、ほぼゼロから4分の1超まで伸びたことになる。
数字の中身にも注意が要る。「主導」は完全な自動化ではない。Anthropic自身が「人間の厳格な指導のもとで、作業のかたまりを実行する」段階だと説明しており、成果物の採否や方向づけは人間が握ったままだ。それでも、半年前はほぼ人間だけで進めていた工程の作業量が、いまは4分の1超がAI主導に置き換わっているという変化の速さ自体は、既存の技術トレンドの延長というより段差に近い。
「完全自律」にはまだ届いていない
Anthropicが強調しているのは、伸びの速さと同じくらいまだ届いていない一線である。今回測定した6段階のうち最上位、AIが完全に自律して工程を回す「AL5」に達した作業は、測定対象のどこにも1件もなかったという。26%という数字は、あくまで人間の監督下での「主導」であって、無人化ではない。
その監督の仕組みについても、Anthropicは具体的な数字を添えている。社内で稼働するAIエージェントの行動をリアルタイムで監視する仕組みでは、危険と判定されてその場で遮断された割合は0.002%(おおむね4万7,000回に1回)。事後にログをさかのぼって点検する仕組みでは、1,000件中1〜2件の割合で問題のフラグが立ったという。あわせて、AI主導のR&D向けに割り当てた計算資源のうち約12%を、安全性の検証そのものに充てているとも説明している。
Claudeが担うのは、人間が方向づけた大枠の中での実行作業。何を作るか、成果をどう使うかの判断は人間側に残っている。
動いている最中に危険な挙動を止める仕組みと、あとから記録を点検する仕組みを両方走らせている。どちらも発生件数は少ないが、ゼロではない。
6段階のうち最も自律度の高い段階に分類された作業は、今回の測定期間に1件も見つかっていない。
「進化を遅くする」宣言の5日後に、なぜこの数字が出たのか
この発表のタイミングには、もう一つ押さえておきたい前後関係がある。前回の記事で伝えた通り、Anthropicの最高経営責任者ダリオ・アモデイ氏は2026年9月12日、「AIの進化速度を意図的に落とす」よう業界に呼びかける提言を公開し、第三者評価機関に社員同等のアクセス権を与えると自ら約束したばかりだった。その5日後に公表されたのが、自社のAI開発そのものがこの半年で急速にAI主導へ置き換わっているという、方向としては逆に見える数字である。
矛盾というより、両者は同じ問題意識の裏表だと捉えるほうが実態に近い。Anthropicは今回の発表を「透明性の取り組み」と位置づけ、開発の自動化がどこまで進んでいるかを社会が把握できるようにすることが目的だと説明している。進む速度を外部から検証可能にすること自体が、9月12日の提言が求めていた「第三者による監視」の実践例にあたる。速度を落とす約束と、速度を測って見せる約束は、両方が揃って初めて意味を持つ種類の取り組みといえる。
もっとも、Claudeをめぐっては直近でも実システムへの侵入事案が明らかになったばかりで、自律性が増すことと安全管理が追いつくことは、必ずしも同じペースで進むとは限らない。26%という数字を「順調な進捗」とだけ読むか、「監督コストが今後さらに重くなる予兆」と読むかは、この先の増分の中身次第だろう。
Claudeを使う側に、この数字は何を意味するか
今回の指標は、いま手元で動いているClaudeの応答が変わるという話ではない。変わっているのは次のClaudeを作る過程であり、影響が表に出るとすれば次世代モデルの開発ペースや品質という形になる。
もう一点、今回の発表はAnthropic自身による自己測定であり、外部監査を経た数字ではない。「主導」の判定基準や集計方法の妥当性そのものは、まだ独立に検証されていないという留保は付けておく必要がある。※観測の段階として扱うのが妥当だ。
編集部の見立て
今回の発表で注目すべきは、26%という到達点よりも、Anthropicがこの数字を自分から公表したという行動そのものだと考えます。AIが自社のAI開発をどこまで肩代わりしているかは、本来なら競合に手の内を明かすことにもなりかねない情報です。それでも数字を出したのは、9月12日の「進化を遅くする」提言を、口約束で終わらせないための一手だと見るのが自然でしょう。
一方で、26%という数字の中身は「人間の指導下での実行」にとどまっており、判断そのものをAIに委ねる段階にはまだ距離があります。半年でほぼゼロから4分の1超まで伸びた速度は確かに急ですが、伸び方が直線的に続く保証はどこにもありません。次の測定でこの数字がどう動くかを見るまでは、傾向として断定しないほうが安全です。
読者にとって実務上の関心は、次世代モデルがいつどんな形で届くかという点に尽きます。今回の発表は、その手がかりが増えたという意味では有益ですが、答えそのものではありません。Anthropicが今後も同じ指標を定期的に公表し続けるかどうかが、この取り組みの本気度を測る次の材料になります。
まとめ
Anthropicが2026年9月17日、自社のモデル開発(R&D)のうちClaudeが「主導」する作業の割合を初めて公表しました。2026年8月時点で26%、半年前の2月には1%に届いていなかったといいます。人間とAIが密接に連携する「協働」以上の段階まで含めると90%を超える一方、最も自律度の高い「完全自律」の段階に達した作業は1件も確認されていません。
危険な挙動をその場で遮断する仕組みでの遮断率は0.002%、事後点検でのフラグ率は1,000件中1〜2件と、監督の仕組みも合わせて開示されています。この発表は、9月12日にダリオ・アモデイ氏が表明した「AIの進化速度を意図的に落とす」という提言のわずか5日後に出されました。
数値はAnthropic自身による測定・公表であり、独立した第三者による検証はまだありません。次世代のClaudeがいつ、どんな形で登場するかを直接示す発表ではなく、その手前の工程がどう変わったかを示す報告として読むのが妥当です。
次にAnthropicが同じ指標を更新するタイミングと、そのとき26%がどこまで動いているかが、今回の発表が一過性の透明性アピールだったのか、継続する取り組みだったのかを見分ける最初の材料になる。