9月21日、Inside AIが「Anthropic: Claude Leads 26% of AI R&D, Up from 1% in February」と題した記事を公開した。この記事では、AnthropicのClaude AIが同社のAI研究開発タスクの26%をリードするまでに急成長し、AI自律研究の進行度を示す透明性レポートが公開されたことについて詳しく紹介されている。
わずか7ヶ月で1%→26%:ClaudeがR&Dへの関与を急速に拡大
Anthropicが月曜日に公開した透明性レポートによれば、自社のAIモデル「Claude」が社内のAI研究開発タスクの26%をリードしているという。これは2025年2月時点の1%未満から、わずか約7ヶ月での急伸だ。
注目すべき数字もある。Anthropic社内のAI R&Dタスクの90%以上が、すでに何らかのAIコラボレーション(人間の監督下)を伴っているという。AIが完全自律でR&Dを担っているわけではないが、研究プロセスへの組み込みは相当深い段階に達している。
この透明性レポートは3つの指標を追跡している:
- AIの自動化率(AI automation)
- AIエージェントへの人間の監督状況(oversight of AI agents)
- 計算リソースの配分(compute allocation)
3万エージェントを監視——人間がレビューするのは0.002%のみ
社内プラットフォームでは現在3万エージェントが稼働しており、そのうち人間のレビューや処理ブロックが発動するのは意思決定全体の**0.002%**に過ぎない。なお、この数字はあくまで「介入が実際に発動した割合」であり、システム全体が無監督で動作しているという意味ではない点には留意が必要だ。
この数字の解釈は二分される。ガードレールが堅牢に機能している証拠とも、摩擦が少なすぎる危険信号とも読める。
安全面では、リアルタイムで危険な操作をブロックする監視システムと、事後的に懸念パターンを検出するオフラインシステムを組み合わせたデュアル監視体制を採用している。Anthropicの安全研究者によれば、現行モデルは研究スタッフの生産性を約4倍向上させているという。
ただし、このAIによる生産性向上は計測上の難問を生む。AIが次世代AIの設計を支援するという状況では、進捗の標準ベンチマーク自体がその測定対象に影響を受けるため、循環論法に陥りやすい。※この解釈は編集部による考察であり、元記事の記述を補足したものである。
安全研究への計算リソースは6%——比率の妥当性に疑問
Anthropicが研究用計算リソースのうち安全研究に割り当てているのは**6%**だ。能力開発の加速ペースに対してこの割合が十分かどうか、批判的な見方もある。Anthropic自身は、この比率が過去や競合他社と比べてどう変化しているかを開示していない。
競合他社との比較では、OpenAIやGoogle DeepMindが安全性フレームワークを公開しているものの、リアルタイムの自動化統計に相当するデータは出していない。今回のAnthropicの開示は業界での先例となる一方、競合他社が追随するかどうかは不透明だ。
2029年には5倍加速も——再帰的改善ループへの懸念
予測研究者によれば、現在AIは開発速度を約1.5倍に高めており、2029年には5倍の加速が起きうると試算されている。
Anthropic社内の研究者は、2026年末までにAIシステムがR&Dの丸一日分を自動化するようになると予測している。その先に懸念されるのが、再帰的な能力加速ループ(recursive capability acceleration loop)と呼ばれる状態だ。これはAIが自身の改善に関与することで能力向上が加速し、その向上がさらなる自己改善を促すというサイクルを指す。その段階では、人間の監督がセーフガードではなくボトルネックになりかねない。
この問題は業界全体の懸念でもある。2025年7月、OpenAI・Anthropic・Google・Metaの従業員1,134名が連名で「Pacing the Frontier」と題した書簡に署名し、自動化されたAI開発を意図的に減速させるツールの整備を米政府に求めた。競争圧力が自発的な安全コミットメントを上回ることへの危機感が背景にある。
匿名を条件に取材に応じたある安全研究者はこう語っている。
「透明性だけでは、競争するラボ間の協調問題は解決できない。指標を公表することは第一歩だ。しかしあるラボが速度を落として別のラボが加速すれば、抜け駆けのインセンティブは消えない。」
エンタープライズセキュリティへの波及
Cloud Security Allianceは、再帰的なAI自己改善が企業セキュリティに新たな攻撃面をもたらすと警告している。AIエージェントが自身のコードや学習データを変更できる状況では、従来型のセキュリティ境界が機能しなくなる。Anthropicの**0.002%**というレビュー率は、エージェントの意思決定の大部分が人間の確認なしに進んでいることを意味しており、監査当局や規制当局の精査を受ける可能性が高い。
AIエージェントのセキュリティリスク全般については、OWASPのLLM Top 10も参考になる。エージェントの自律度が高まる局面で想定すべき脅威を体系的に整理しており、本件の文脈とも関連が深い。
次の透明性レポートは2027年初頭が予定されている。26%という数字が安定するのか、それとも急騰が続くのか——その答えがAI研究の自律化議論に直接影響する。
詳細はAnthropic: Claude Leads 26% of AI R&D, Up from 1% in Februaryを参照していただきたい。