ブログ • AI / Agent
Anthropic の最新開示:Claude は AI 研究開発の 26% を主導。Agent はどう協働してモデル開発するのか?JSON データフローと Agent Workflow 解説
2026 年 9 月 17 日、Anthropic は Institute の記事で内部の測定値を公開した。見出しはこう読まれやすい:Claude はすでにモデル R&D の四分の一を請け負っている。
原文はもっと狭い。2026 年 8 月時点で、Claude は Anthropic の AI R&D の 26% を「主導」し、「協働」以上は 90% 超。測定したどの部分集合でも、全自律には達していない。
この記事では:
- 26% が Epoch AI の自動化等級のどの段を指すか
- タスクツリーが Slack と作業記録からどう育つか
- Agent が孤立して話すのではなく、どう協働してモデル開発するか
- 身元、メッセージ、Tool Calling、monitor 判断からなる JSON データフロー
- JSONNote で監査可能なワークフロー記録をローカルに分解する方法
まずこれだけ:主導は AL4 であり、AL5 ではない。エンジニアが障害アラートを投げ、Claude がログを読み、パッチを書き、回帰を回し、報告を書く。出すかどうかはまだ人が決める。3 万の Agent が同時に動けるのは、各動作に身元、開放メッセージ、実行前 monitor が付くからだ。構造化記録がなければ、この数字は照合できない。
26% が本当に測っているもの
出典は Anthropic Institute の Measurements for understanding the pace of AI development inside frontier labs。彼らは三つの数字を同時に出した。AI 自身がどれだけ AI R&D を担うか、Agent の動作がどれだけ監督されているか、計算資源をどう分けるか。
一つ目が Anthropic R&D Automation Index だ。社内のあらゆる AI R&D を列挙し、種類ごとに自動化等級を付け、人時で重み付けして集計する。
2026 年 8 月時点の公開数字は:
| 数字 | 意味 | 意味しないこと |
|---|---|---|
| 26% | Claude が「主導」する AI R&D の割合(AL4) | 無人運転、自動デプロイ、再帰的自己改善がすでに完了したこと |
| >90% | 「協働」以上(AL3+)の割合 | 90% の仕事にもう人が見ていないこと |
| 0% | 測定部分集合のうち全自律(AL5)の割合 | 「全自動まであと一段」という示唆 |
Reuters は同じ数字を「Claude が次世代モデル建造の四分の一を主導」と書いた。見出しは熱い。定義は変わらない。主導はなお高レベルな指示と人の監督だ。図表では、この帯は 2026 年 2 月の 1% 未満から上がった。上昇は速い。段は飛ばしていない。
自動化等級:支援、協働、主導、自律
評点は Epoch AI の Automation Level を使う。Anthropic は六段に書く:AI なし、ごくわずか、支援、協働、主導、自律。脚注は「夜間データパイプラインが壊れた」で中間三段を固定する:
| 等級 | 誰が始めるか | 誰が不意を扱うか | 誰が出すか決めるか |
|---|---|---|---|
| AL3 協働 | エンジニアがログと仮説を持って Claude に来る | 途中で新しい問題が出ると、Claude は止まり人の判断を待つ | エンジニアが行ごとに読み、自分で再実行し、自分でデプロイする |
| AL4 主導 | エンジニアが障害アラートを投げる | Claude が調べ、直し、試し、報告を書く | エンジニアが報告を読み、diff を流し見し、今夜出すかを決める |
| AL5 自律 | Claude 自身が障害に気づく | 範囲、実装、テストを自分で進める | 自分でデプロイする。人は見てよいが、居なくてもよい |
26% は AL4 で止まる。Claude は「パイプラインを直す」をアラートから振り返りまでできるが、デプロイ権は人の手元だ。日常の Coding Agent と同じ形だ。モデルが Tool Calling を出し、harness が実行し、人は門と高リスク動作に拒否権を残す。ループの回り方は AI Coding Agent はどう動くのか?。JSON から副作用までの一跳を誰が握るかは JSON Tool Calling から見る Agent Harness。
タスクツリー:15,000 件の仕事が一つの指数になるまで
最先端ラボの R&D 動作を手で書き切れる人はいない。Anthropic は下から集めた。2026 年 7 月、毎週モデル R&D 部門の職員 20% を無作為抽出し、Claude の研究 Agent が Slack と内部文書を読んで、その週の仕事を列挙した。四週間で約 15,000 件の細かいタスクになった。
Claude はその一覧を木に畳む。根はモデル R&D 全体、下は訓練、製品、事前学習、強化学習、そして葉。凍結した木は 542 ノード、葉は 378。評価基盤の欠陥診断、RL サンドボックスの外向きとネットワーク方針、配信事故の振り返りなどだ。
各ノードを Claude Agent が掘る。誰がやるか、どのツールか、AI がどれだけ担うか。独立した Claude 判定は、その月以前の証拠だけを見て AL0–AL5 を付ける。重みは上からの勘ではない。人時だ。一人一週一票を、その週触ったタスクに均等割りする。
限界も書いてある。判定モデルと人の完全一致は 59%、人同士は 35%。だが 97% ではモデルと人の差は一段以内。「協働」と「主導」の境界はなお争われる。かごを凍らせたあと指数が上がっても、それが示すのは 2026 年 7 月の仕事が自動化されたことだけだ。人が全く新しい職種へ移ったかどうかは、それだけでは証明できない。1 月のかごと比べ、新規タスク数の上昇は見ず、それでも定期的な再構築を計画している。
{
"index": "anthropic-rd-automation",
"as_of": "2026-08",
"node": {
"id": "rl-sandbox-egress-policy",
"leaf": "RL sandbox egress and network policy",
"automation_level": 4,
"label": "leads",
"weight_person_weeks": 12.4,
"human_gate": ["deploy", "policy_change"]
},
"aggregate": {
"leads_share": 0.26,
"collaborates_or_above": 0.90,
"autonomous_share": 0.0
}
}
parse できるフィールド、等級の列挙、数値の重みがあってこそ、指数は月ごとに再計算できる。散文の週報ではできない。
Agent はどう協働してモデル開発するか
26% は、中央に座った超 Claude が訓練スタック全体を書くことではない。公開記述はオーケストレーション図に近い。人が目標を出し、複数の Agent が長い時間半自律で走り、仕事を別の Agent へ委譲する。
-
1
抽出と目録
研究 Agent が作業記録を読み、その週のタスクを集計できる項目にする。この段がなければ、後の等級に分母がない。
-
2
分岐と委譲
訓練、評価、基盤、事故振り返りが分かれる。一つの Agent は掘り続けてもよいし、独自の身元を持つ別の Agent に子タスクを渡してもよい。
-
3
実行と書き戻し
ログを読み、コードを直し、テストを回し、前回の成功ランと比べる。結果はセッションに戻る。「直した」の一行だけでは足りない。
-
4
互いに校正する
メッセージは開放チャネルを通り、元資料へリンクする。別の Agent は仲間の言葉を「検証すべき主張」として扱い、自分の思考としては扱わない。
-
5
人間の門
AL4 はデプロイの前で止まる。AL3 はもっと早い。不意が出たら人へ戻す。門が失敗したら、ディスクとクラスタで不可逆な動作は起きてはならない。
これは「チャット欄の一人の助手」と同じ製品層ではない。ラボ内の Agent ランタイムに近い。身元は持続し、メッセージは辿れ、ツールは監視される。スタックの層分けは 2026 年の AI Agent 技術スタック。
JSON データフロー:身元、メッセージ、ツール、門
付録は内部足場の二つの設計を具体的に書く。3 万の Agent がなお監査できる理由がそこにある。
身元。利用者は Claude という一つの対象と話すことに慣れている。多 Agent 協働では、各 Agent に独自の身元が要り、それが作るデータはその身元に結びつく。身元は特定のモデル版に溶接されないので、更新後も履歴が残る。監督の側では、各動作を Agent ごとに縦に辿れ、各記録を具体的な実行者へ戻せる。
開放通信。Agent は私的な雑談をしない。各メッセージは送信者の身元を持ち、元の参照へリンクでき、伝話の歪みを減らす。他の Agent が見えるから、訂正と調整ができる。メッセージとセッション転写を交差参照し、行動監視は Agent 間の会話を横断できる。
この二つを日常の Tool Calling に重ねると、監査可能な記録はおおよそこうなる:
{
"agent_id": "agt_4c91",
"model_ref": "claude-internal",
"identity_persists_across_models": true,
"action": {
"type": "tool_call",
"name": "apply_patch",
"arguments": "{\"path\":\"pipelines/nightly_etl.py\",\"intent\":\"fix_schema_drift\"}"
},
"message": {
"channel": "open",
"from": "agt_4c91",
"links": ["transcript://run-8821#step-17"],
"treat_as": "claim_to_verify"
},
"monitor": {
"online": { "coverage": 1.0, "decision": "allow", "latency_s": 1.8 },
"offline": { "ingested": true, "flagged": false }
},
"human_gate": { "required_for": ["deploy"], "status": "pending" }
}
arguments は今も文字列であることが多い。業務層はまず parse し、schema で検証し、それから monitor と権限へ渡す。契約の書き方は AI はなぜ JSON Schema が要るのか?。ツール面が広がったあと、安全を誰が担うかは MCP のセキュリティ脆弱性を徹底解説。
この JSON 層がなければ、monitor は散文しか読めない。3 万の同時 Agent と十億回の判断を、散文では身元ごとに集計できない。「誰がどの葉タスクを主導しているか」にも答えられない。
3 万の Agent、誰が見ているか
2026 年 8 月、Anthropic で最も使われる内部プラットフォームでは、約 30,000 の Agent が同時に研究とエンジニアリングをしていた。測定はこのプラットフォームだけを覆う。動作は二層の monitor に縛られる:
| online monitor | offline monitor | |
|---|---|---|
| 何をするか | 実行前に止め、または軌道修正する。取り消す暇のない危害向け | 事後に活動を読む。遅く、可逆な異常向け |
| 被覆 | 動作の 100% が実行前を通り、通常は数秒以内 | 動作の 100% が事後に取り込まれる |
| 人が入る時 | 止められた動作は一週間以内に人が再確認する | 週約 10 万件の転写が先に分類器を通り、最優先は約 50 件が人へ行く |
| 割合 | 8 月の 10 億回超の判断のうち、0.002%(約 1/47,000)が止められた | 転写 1,000 件あたり約 1–2 件が印を付けられる |
止めが少ないことは、門が不要だという意味ではない。被覆は 100%、遮断は例外だ。実行前の一跳が無ければ、AL4 の「主導」は無人のデプロイへ滑る。JSON が安全境界になる仕方は AI Agent が「インターネットを自分で攻撃し始める」時。
計算資源の帳簿:安全が 6% である意味
三つめは 2026 年 7 月 13–20 日の一週間の計算資源スナップショットだ。AI R&D に入った計算のうち約 6% が安全、AI 駆動の AI R&D に入った計算のうち約 12% が安全と数えられた。分類は意図的に保守的だ。能力と安全を半々に進める token は安全に入れない。
Anthropic 自身が注意する。安全研究は最先端訓練より人時を食い、チップを食わないことが多い。計算の割合は「会社が安全をどれだけ重視するか」の十分な統計ではない。価値は比較可能性だ。ラボを越え、時間を越え、同じ桶で見る。
分類そのものが Agent ワークフローだ。分類器がジョブのメタデータ、コード、セッション転写を読み、桶、理由、確信度を返す。その週の約 10,000 回の実行から約 14% を、計算で重み付けして抽出した。境界はプロンプトに書く。人の再確認と機械の差は一、二ポイント。再現するなら、「何が安全業務か」をスローガンではなく、検証可能な JSON 定義として書け。
JSONNote でワークフロー記録を分解する
Anthropic の内部ツリーは手に入らない。自分のリポジトリには同じ種類の材料がある。tool call、monitor ログ、Agent メッセージ、タスク等級。それらはブラウザでローカルに分解できる。
-
1
まず arguments が parse できるか見る
文字列のエスケープをほどき、JSON 整形 に入れる。欠けたカンマや末尾カンマは、monitor が出る前にすでに壊れている。
-
2
宣言した schema で動作を検証する
ツールの parameters と解析後のオブジェクトを JSON Schema に入れる。等級は列挙、身元は安定 ID、デプロイは human_gate に明示したままにする。
-
3
「承認した時」と「今」を比べる
先週のタスクツリーやツール一覧を JSON Diff に入れ、葉タスク、monitor 判断、schema の静かな変更を探す。
-
4
同僚に見せるなら Hash 共有
データは URL fragment に留まり、サーバを通らない。URL Hash で JSON を共有する。
よくある質問
Claude が AI R&D の 26% を主導するなら、次のモデルはもう無人で作っているのか?
違う。26% は Epoch AI の AL4 だ。Claude は高レベルな指示から大半を仕上げ、人が監督し、出すかどうかを決める。Anthropic は、測定したどの AI R&D 部分集合でも Claude は全自律(AL5)に達していないと書いている。
「90% 超が協働」と「26% が主導」はどうつながるのか?
90% は AL3 以上:Claude は人の密な指示のもとで大きな塊をこなせる。26% はそのうちすでに AL4 へ上がった分だ。主導は「協働以上」の内側にあり、排他的な二山ではない。
30,000 の Agent はどう協働し、誰が見ているのか?
内部プラットフォームで研究とエンジニアリングを半自律で走らせ、互いに委譲もする。各 Agent に独自の身元があり、メッセージは開放チャネルを通る。動作の 100% は実行前に online monitor、実行後に offline monitor を通る。2026 年 8 月、10 億回超の判断のうち約 4.7 万分の 1 が止められた。
このワークフローのどこに JSON が出てくるのか?
タスクツリーのノード、自動化等級、Agent の身元、開放メッセージ、Tool Calling の arguments、monitor の許可/遮断は、ほぼすべて構造化記録だ。parse できる契約がなければ、3 万の Agent は監査できず、「誰がどの区間を主導したか」も再現できない。
開発者がこの開示から持ち帰るべきものは何か?
まず支援、協働、主導、自律を分ける。毎回の tool call と Agent メッセージに、身元、時刻、検証可能な JSON を残す。門は実行前、再現材料は実行後。数字は動く。契約層は古びない。
まとめ
Anthropic が 26%、90%、3 万、0.002%、6% を卓上に出したのは、測れ、照合でき、月ごとに再計算できるからだ。測っているのは「モデルがどれだけ雑談できるか」ではない。次のモデルを作る生産ラインで、人と Agent がどの段に立っているかだ。
26% は主導であり、自律ではない。協働はすでに広がっている。門はまだ人の手元だ。Agent が一緒にモデルを作れるのは、身元、開放メッセージ、Tool Calling、monitor 判断が、同じ parse 可能なデータフローを通るからだ。
見出しはこれからも 26% を大きく読む。原文を見る人は、まず等級の定義を見、その JSON がまだそこにあるかを見るべきだ。
次:Agent ワークフロー記録を JSONNote に貼る