AI × 開発効率化Anthropic / 2026年5月

Anthropic 2026年5月発表まとめ|Claude Opus 4.8・Code with Claude 2026・Claude Mythos Preview・Auto Mode・SpaceX Colossus 提携


2026 年 5 月に Anthropic が発表した内容を、新しい順にまとめます。月末の 5 月 28 日には新モデル Claude Opus 4.8 が公開され、Claude Code に Dynamic Workflows が加わりました。月初は 5 月 6 日の Code with Claude 2026 で、SpaceX Colossus 1 の計算資源契約、Managed Agents の 3 機能、Code Review や Auto Mode、/goal コマンドが発表されています。Claude Mythos Preview や金融サービス展開まで一覧で押さえます。

公開2026.05.09
最終更新2026.06.10
読了 18 分 / 約7,700
この記事をシェアポスト
AI × 開発効率化Anthropic / 2026 年 5 月

Anthropic 2026年5月
発表まとめ

C
本記事の結論
2026 年 5 月は Anthropic にとって計算資源確保とエージェント自走に大きく舵を切った月

5 月は月初のCode with Claude 2026(5/6)で始まり、月末の新モデルClaude Opus 4.8公開(5/28・SWE-bench Verified 88.6%)で締めくくられました。 Code with Claude 2026 では新モデル発表が見送られ、代わりに SpaceX Colossus 1 の計算資源利用契約と、 Managed Agents 向けの Dreaming(research preview)・Outcomes(public beta)・ Multi-agent Orchestration(public beta)、 そしてエンタープライズ向けの Code Review・CI auto-fix・Security Reviews・Remote Agents が発表されました。 Claude Code の Routines は 2026/04/14 に先行リリース済みですが、CwC2026 でも改めて取り上げられました。

前日の 5 月 5 日には金融サービス向けの 10 種のエージェント、Microsoft 365 統合(Excel / PowerPoint / Word / Outlook)、Moody's 提携も発表されており、エンタープライズ展開も同時並行で進んでいます。 API トラフィックは前年比 17 倍と公表され、顧客事例では Harvey の完了率 6 倍、Wisedocs のレビュー 50% 短縮、 Mercado Libre の「2026 年 Q3 までに 90% 自律コーディング」目標、 eve の「Opus を advisor に置くことで frontier モデル品質を 5 倍低コストで実現」など、 実利用の数字も共有されました。

01.結論:2026年5月の Anthropic 動向ハイライト

2026 年 5 月の Anthropic は、計算資源確保とエージェント自走の整備を、 個人開発者向け(Code with Claude 2026)と業界別(金融サービス)の両面で進めた月でした。 Anthropic / Claude Code の進化全体の文脈は、Claude・Claude Code 進化の年表に別記事としてまとめています。

Code with Claude 2026(5/6)で発表された機能は、共通して 「人間が AI を操作する」 から 「AI を自走させ、人間がオーケストレーションする」 への移行を意図しています。Dreamingがメモリ更新を、Outcomesが採点ループを、Multi-agentが役割分担を、Routinesがスケジュール / イベント実行を、 それぞれエージェント側に持たせる構成です。 まず CwC2026 の 4 つの新機能を、一枚で確認できる形にまとめたのが下図です。

図:Code with Claude 2026 で語られた 4 つの自走機能(2026 年 5 月 9 日時点)
1

Dreaming

自動でメモリを整理

過去セッションを走査してパターンを抽出し、ラン間でメモリストアを再構築。CLAUDE.md / Skills の自動チューニングが想定用途。

提供面Managed Agents APIresearch preview
2

Outcomes

rubric 採点で自走

別コンテキストの grader が rubric で採点し、満たすまで worker が修正を返す往復ループ。成果物単位の指示が可能。

提供面Managed Agents APIpublic beta
3

Multi-agent Orchestration

lead × specialist の並列実行

lead エージェントが、ツール一式を持つ specialist に作業を委ね、共有ファイルシステム上で並列実行。Netflix の並列ビルド解析が代表例。

提供面Managed Agents APIpublic beta
4

Routines

4 月から提供
cron / Webhook 駆動

スケジュール実行とイベント駆動を Claude Code 環境内で完結。2026/04/14 に研究プレビューとして先行リリース済みで、CwC2026 でも改めて取り上げられた位置づけ。1 日 15 ジョブの無料枠つき。

提供面Claude Code Web2026/04/14 リリース済

オレンジで強調した Routines は、CwC2026 の前(2026/04/14)にすでに研究プレビューとしてリリース済みで、本イベントでも改めて取り上げられました。残り 3 つは Managed Agents API の研究プレビュー / public beta として CwC2026 で初公開された機能です。

02.SpaceX Colossus 提携と計算資源確保(CwC2026 / 5/6)

最初に発表されたのは新機能ではなく、計算資源確保の話でした。 Anthropic は SpaceX が運用する Colossus 1 データセンター(テネシー州メンフィス)の計算資源 全体を Anthropic が利用する partnership を結び、220,000 基の Nvidia GPU・300 MWの計算資源を確保したと公表しました。Tom’s Hardwareや CNBC の取材によれば、これはデータセンターの所有移転ではなく 計算資源 の購入契約で、財務条件は非開示です。

Elon Musk 氏の xAI が学習基盤を Colossus 2 に移したことが、 Colossus 1 を Anthropic に開放できた背景として説明されています。 AWS / Google との既存契約とは別枠の上乗せで、AWS の OpenAI 解禁(前週)と並ぶ規模の計算資源分散調達として位置づけられます。

220,000 GPU・300MW の計算資源利用契約

項目発表内容
提携対象SpaceX Colossus 1 データセンター(テネシー州メンフィス)の capacity 全体
GPUNvidia GPU 220,000 基(H100 / H200 / GB200 を含む)
電力300 MW 超の計算資源
提供時期発表後 1 か月以内に順次オンライン化(CwC SF 2026 リキャップ)
AWS / Google 契約との関係別枠(既往契約に上乗せ)
所有権 / 財務条件計算資源 の購入契約。条件は非開示
将来計画SpaceX の軌道上 AI 計算資源 共同開発に関心を表明

Claude Code 利用枠 2 倍化と Opus API 上限引き上げ

実利用への影響は明快で、Pro / Max / Team / Enterprise 各プランの Claude Code 5 時間あたり利用上限が2 倍化されました。Pro / Max でのピーク時間帯のレート制限も撤廃され、 Opus API のレート制限も大幅に引き上げられています。 コードを連続して生成する利用者ほど恩恵が大きい変更です。

API トラフィック 17 倍が示す競争軸

前年同期比 17 倍という API トラフィック増も同時に共有されました (会場での発表は Simon Willison 氏の Code w/ Claude 2026 ライブブログが詳しいです)。 新モデルではなく計算資源を最初に話すこと自体が、 各社の差が「モデル品質」 から 「使える計算資源量」に移っていることを示しています。 モデル世代の差で勝ちにいく時代から、 どれだけの計算資源をユーザーに開放できるかで勝ちにいく時代に入った、というメッセージです。

03.Managed Agents の 3 機能:Dreaming / Outcomes / Multi-agent

本体の発表は Managed Agents 向けの 3 機能でした。 いずれも Managed Agents の API 経由で提供され、現時点では Claude Code には未対応です。

機能用途ステータス
Dreaming過去セッションを走査し、メモリストアを再構築research preview
Outcomesrubric ベースの採点ループで成果物単位で自走public beta
Multi-agent Orchestrationlead × specialist の並列実行と共有ファイルシステムpublic beta

Dreaming:自動メモリ整理(research preview)

Dreaming は、過去のエージェントセッション・対話・メモリストアを定期的に走査し、 繰り返し発生したミス・共有可能なワークフロー・パターンを抽出して、 ラン間でメモリストアを再構築する機能です。 睡眠中の記憶整理に喩えて Dreaming と名付けられました。 実行は自動 / レビュー前介在の 2 モードで、dream の内容自体も画面で確認できます。

想定ユースケースは Claude Code の CLAUDE.md、Skills、Claude Desktop 側設定など、 利用者が手で更新し続けてきた運用ドキュメントの自動チューニングです。 手動更新では拾いきれなかった 「同じ修正指示を何度も繰り返している」「特定パターンで同じ失敗を繰り返している」 を 機械的に拾う点が中核です。

E
顧客事例
Harvey:Dreaming で完了率が約6倍に

法律系AI(Legal AI)の Harvey 社は、Managed Agents の事前アクセスで Dreaming を試験導入し、 内部テストでタスク完了率が約 6 倍に伸びたと報告しています。 モデル交代ではなく 「ファイル形式の癖、ツール固有のパターンといった institutional knowledge を セッションをまたいで持ち越せるようになった」 ことが要因と説明されています。

Outcomes:rubric 採点で自走させる(public beta)

Outcomes は、たとえば 「フルスタックの UGC 動画生成アプリを作る」 のような成果物単位の指示を渡すと、 rubric を満たすまでエージェントが自走する仕組みです。 実装する worker エージェントとは別のコンテキストウィンドウで動く grader(採点者)が、rubric に沿って成果物を評価し、失敗箇所を指摘して worker が修正に戻ります。

Anthropic 公開のベンチマークでは、Outcomes 適用時に docx タスクで +8.4%、pptx タスクで +10.1% の成功率改善が報告されています。 実装と評価を同じエージェントが行うと、自分の出力に肯定的な判定を出しやすいため、 評価担当を分けるという発想自体は素直で、出力品質の安定に効きやすい構造です。

OpenAI 側では Codex に /go コマンドが先行して導入されており、 成果物指定の自走という意味では Outcomes と同じ方向性の機能です。 Outcomes が Claude Code に降りてきたタイミングで、/outcome 系のスラッシュコマンドが標準になる可能性は高いと思います。 Claude Code と Codex の併用ワークフローは別記事で詳しく整理しています。あわせてご覧ください。

関連記事

Claude Code と Codex の併用ワークフロー|codex-plugin-cc で始めるコードレビュー連携

Claude Code で実装し、Codex でレビュー・追加調査を回す。codex-plugin-cc を中心に、MCP・Skill・Plugin と進化してきた連携の流れと注意点を整理しています。

続きを読む
!
運用上の注意
自走系の機能は走らせ続けるほどコスト監視が必要

Outcomes は性質上、grader → worker → grader の往復を成果物が満たされるまで続けます。/outcome 相当を一晩走らせて朝には週次の Claude Code 利用枠を使い切る、 というシナリオは現実的に起こりえます。 サンドボックス的に有限の予算で試すか、レート制限と上限アラートを必ず設定してから本格運用に入るのが安全です。

Multi-agent Orchestration:lead × specialist の並列実行

Multi-agent Orchestration は、Claude Code 既存の agent teams とは別物として、 public beta API 経由で提供されます。Claude Code には未対応です。 lead エージェントが、ツール一式を持つ specialist エージェントに作業を委ね、 共有ファイルシステム上で並列実行する構造です。

Anthropic の例として挙げられていた組み合わせは次のとおりです。

  • UX Designer エージェント(Figma MCP を持つ)
  • Code Reviewer エージェント(GitHub MCP を持ち、PR コメントまで行う)
  • Security Reviewer エージェント(社内ダッシュボードへアクセス)

並列実行による完了時間の短縮と、役割固有のツール / コンテキストを与えることでの出力品質向上が狙いです。 lead orchestrator がどの specialist にどう委ねたかのフルトレースも閲覧できる設計になっています。 顧客事例では Netflix が、数百件のビルドログを並列で解析しパターン抽出する用途に使っていると共有されました。

04.Routines:4 月先行リリース、CwC2026 でも改めて取り上げ

Routines は厳密には CwC2026 の新発表ではなく、2026 年 4 月 14 日に研究プレビューとして先行リリースされた機能です。 CwC2026 では Managed Agents 3 機能と並ぶ自走系の代表例として改めて取り上げられました。 スケジュール実行(cron 相当)と、Webhook / アラートをトリガーにしたイベント駆動の両方に対応しています。 ドキュメントは code.claude.com/docs/en/routines にあります。

usage dashboard 上で、無料枠として1 日あたり 15 routinesが割り当てられます。各実行はモデル種別とトークン消費に応じて usage を消費するため、 無料枠内でも実行内容が重ければ通常使用枠を圧迫する点に注意が必要です。

タイプユースケース例
夜間バッチ毎晩 02:00 に Linear から最重要バグを取得し、修正を試行してドラフト PR を作成
アラート連動監視サービスのアラートが発火したらペイロードから対象サービスを特定し、on-call 用 Slack へ初期トリアージを投稿
Webhook 連動GitHub repo の特定モジュール(決済 / 認証など)への変更を要約し、影響範囲の Slack チャンネルへ通知
情報収集自動化日次で AI / 開発系の主要ソースから重要トピックを集約し、編集向けに要約とランク付けを共有

ノーコード AI 自動化サービスで構築していたフローの一部を、 Anthropic の環境内に少ないセットアップで取り込めるのが Routines の強みです。 外部サービスを増やさずに、Claude Code の利用前提で完結させられる点が運用コスト面で効きます。

05.Claude Code 強化:Code Review / CI auto-fix / Security Reviews / Remote Agents / Auto Mode / /goal

Managed Agents とは別に、Claude Code 本体側の機能強化も発表されました。 いずれも単独でハイライトされたリリースではないものの、 日常運用に効く改善が複数含まれています。

機能概要
Code ReviewAnthropic 内で全チームが利用しているコードレビュー機能のエンタープライズ展開
CI auto-fixCI 失敗時に PR の自動修正を試行する仕組み
Security Reviewsセキュリティ観点専用のレビュー機能
Remote Agentsモバイル端末から手元のマシンを操作し、Claude Code セッションを継続
Webhooks(Managed Agents)エージェント完了通知を Webhook で受け取れる
Auto Modeマルチステップの自律実行モード(2026/05/05 公開)。2 段階分類でセーフな操作を自動進行させ、 リスク操作だけ人間承認ゲートに通知。スピナーが赤に変わることで承認待ちを一目で識別できる。--dangerously-skip-permissions を使わずに自律実行の範囲を広げる設計
/goal コマンドCLI 2.1.139 で追加された完了条件ドリブンの自走機能。/goal <条件> でセッションスコープのコンプリーション条件を設定すると、 各ターン終了後に小さく高速なモデル(既定は Haiku)が条件成立をイエス/ノーで判定し、 「ノー」なら Claude が自動的に次のターンを開始、「イエス」になればゴールが自動クリアされる。 対話・-p(headless)・Remote Control いずれでも動作
CLI v2.1.126〜v2.1.139--plugin-url での ZIP 配布、claude project purgeskillOverrides 設定、EnterWorktree の挙動修正など

Code Review については「Anthropic 内のすべてのチームで使われている」と紹介されており、 社内ドッグフーディングが浸透した成熟度を示す位置づけでした。 CI auto-fix と Security Reviews は CI / セキュリティの定常運用に組み込めるため、 既存のレビュー / 監査フローに追加することで効果が見えやすい機能です。 Auto Mode は 5 月 5 日に公開された自律実行機能で、 安全な操作は自動進行しつつ、リスクのある操作(ファイル削除、外部 API 呼び出し、権限変更など)のみ 人間承認ゲートで一時停止する 2 段階分類を採用しています。--dangerously-skip-permissions を使わずに自律実行の範囲を広げられるため、 CI / CD 環境への組み込みや長時間バッチ処理でのリスク制御に有効です。

Auto Mode と相補的に追加されたのが、Claude Code 2.1.139 の /goal コマンドです。/goal <条件> でセッションスコープのコンプリーション条件を設定すると、 Claude は各ターン終了後に制御をユーザーへ返さず、別の評価器が条件成立をチェックし、 満たされるまで次のターンを開始し続けます。 評価には設定済みの small / fast モデル(既定は Haiku)が使われ、判定結果は短い理由付きでトランスクリプトに残ります。 Auto Mode が ツール呼び出しごとの確認 を削減するのに対し、/goalターンごとの確認 を削減する位置づけで、 2 つを組み合わせると無人での連続実行が可能になります。

条件は最大 4,000 文字で、評価器は会話に表示された内容のみを判断材料とするため、Claude 自身の出力で実証できる終了状態を書くのがコツです。条件として書きやすい例は次のとおりです。

  • npm test が exit 0 で完了し、git status がクリーン
  • 指定モジュールの移行 PR がすべてマージされ、CI が green
  • ラベル付き issue のキューが空になるまで(あるいは 20 ターンで停止)

-p(headless)と Remote Control でも動作するため、claude -p "/goal CHANGELOG.md に今週マージされた全 PR のエントリがある"のような起動で、単発の呼び出しからループ完了まで一気通貫させられます。 ゴールは条件成立か /goal clearstop / off / reset / none / cancel をエイリアス)まで動き続けるため、 Outcomes と同様に上限アラートを併用しておくのが安全です。 詳細は 公式ドキュメント(code.claude.com/docs/ja/goal)を参照してください。

06.5 月後半:Claude Opus 4.8 公開(5/28)と Claude Code の更新

Code with Claude 2026 では新モデル発表が見送られましたが、その約 3 週間後の2026 年 5 月 28 日、Anthropic は新モデルClaude Opus 4.8を公開しました。Opus 4.7(4 月 16 日)から約 6 週間での更新で、Anthropic のモデル更新としてはこれまでで最も短い間隔です。 agentic coding 向けの新しい既定モデルにあたります。以下の数値は Anthropic 公式発表(Introducing Claude Opus 4.8)と、Claude Code 公式ドキュメント「What's new」Week 22(code.claude.com)に基づきます。

項目内容
公開日2026 年 5 月 28 日(Opus 4.7 から約 6 週間)
SWE-bench Verified88.6%(Opus 4.7 は 87.6%、+1.0pt)/Anthropic 公式
SWE-bench Pro(より難しい設定)69.2%(Opus 4.7 は 64.3%、+4.9pt)/Anthropic 公式
effort 既定high effort が既定。最難タスクは /effort xhigh
標準料金Opus 4.7 と同額(100 万トークンあたり入力 $5・出力 $25)
fast mode 料金$10 / $50 per MTok(Opus 4.7 の fast mode $30 / $150 から値下げ。約 2 倍の料金で約 2.5 倍速)/Claude Code 公式
信頼性Anthropic は「Honest Reasoning」を掲げ、自分の作業の不確実性を明示しやすく、裏づけのない主張を出しにくくなったと説明
提供面Max / Team Premium / Enterprise(従量課金)/ Anthropic API の既定モデル。Claude Code では v2.1.154 以降(Claude Code 公式

ベンチマーク上の伸びは、すでに飽和しつつある SWE-bench Verified では +1.0pt にとどまりますが、 より難しいSWE-bench Pro では +4.9ptと差が出ています。Anthropic は「Opus 4.7 と同程度のトークン消費でより高い性能」と説明しており、 早期の利用者からは、自分の作業に対する不確実性を明示しやすく、裏づけのない主張をしにくくなったという評価も出ています。

Opus 4.8 と同じ週(第 22 週・5 月 25〜29 日)には Claude Code 側でも新機能が公開されました。 月内の週次更新とあわせて、5 月後半の主な動きは次のとおりです。

時期出来事ハイライト
2026 年 5 月 28 日(第 22 週)Dynamic Workflows(research preview)「workflow」を含む依頼で Claude がオーケストレーション用スクリプトを生成し、 数十〜数百のサブエージェントにタスクを分解してバックグラウンド実行。 コードベース全体の監査や大規模移行など、1 つの会話では調整しきれない大きなタスク向けで、/workflows で実行を管理する
2026 年 5 月 28 日(第 22 週)security-guidance pluginClaude 自身のコード変更を脆弱性観点でレビューし、同一セッション内で修正。 編集ごとの高速パターン検査、ターン終了時のモデルレビュー、commit / push 時の踏み込んだエージェントレビューの 3 段。.claude/claude-security-guidance.md にプロジェクト固有のルールを追加できる
2026 年 5 月 18〜22 日(第 21 週)Auto Mode を Pro プランへ拡大Auto Mode が Pro アカウントでも動作し、Opus に加え Sonnet 4.6 にも対応。/usage がプラン上限の内訳(Skill / Subagent / Plugin / MCP サーバー別)を表示し、 コードの不具合を報告する /code-review コマンドも追加された
2026 年 5 月 11〜15 日(第 20 週)Agent View(claude agentsclaude agents で全 Claude Code セッションを 1 画面に集約し、稼働中・入力待ち・完了を一覧化。 fast mode が Opus 4.7 を既定化し、/goal も同週に追加された
!
運用上の注意
Dynamic Workflows は走らせる範囲とコストを先に決める

Dynamic Workflows は 1 つの依頼を数十〜数百のサブエージェントに分解してバックグラウンドで走らせるため、 Outcomes や /goal と同様にトークン消費が一気に膨らみます。 対象範囲(移行するファイル群、監査するディレクトリ)を絞り、上限アラートと security-guidance plugin のような検査を併用してから本格運用に入るのが安全です。

07.Claude Mythos Preview と Project Glasswing(4/8 Preview 公開)

2026 年 4 月 8 日、Anthropic は新世代モデル Claude Mythos Preview(コードネーム:Capybara)を限定公開しました。 3 月 26 日に CMS の設定ミスで一時公開されて注目を集め、正式な Preview リリースは 4 月 8 日、 5 月 8 日前後には CNBC など主要メディアがサイバーセキュリティ能力を詳報し、改めて話題となっています。

Mythos は Anthropic がこれまでに公開したモデルの中で最も高い能力を持つとされており、 とくにサイバーセキュリティ分野での能力が突出しています。 事前テストでは、主要 OS・主要ブラウザすべてにまたがる数千件の未公開ゼロデイ脆弱性を自律的に発見し、 初回試行での再現・エクスプロイト開発成功率が 83% 超という成績が報告されています。 英国 AI 安全研究所(AISI)も Mythos Preview のサイバー能力を独立評価しており、 セキュリティコミュニティで注目されています。

項目内容
モデル名Claude Mythos Preview(コードネーム:Capybara)
公開日2026 年 4 月 8 日(Preview)。3 月 26 日に CMS ミスで一時公開
主な特徴サイバーセキュリティ分野での突出した能力。ゼロデイ脆弱性の自律発見・連鎖が可能
ベンチマーク主要 OS・ブラウザでのゼロデイ数千件発見、初回エクスプロイト成功率 83% 超
利用可否限定公開(Apple・Amazon・JPMorgan Chase・Palo Alto Networks など)
提供プラットフォームGoogle Cloud Vertex AI 経由でプレビュー提供
Project GlasswingMythos を防衛的(blue team)に活用し、世界の重要ソフトウェアの脆弱性を先行修正する Anthropic 主導プロジェクト
!
リスクと対応方針
Project Glasswing:能力開放の前に防衛整備を優先

Anthropic は Mythos の能力をそのまま広く公開せず、 まず Project Glasswingとして Mythos を防衛側(blue team)に活用し、重要インフラの脆弱性を事前修正する取り組みを進めています。 攻撃側が Mythos を悪用するリスクが顕在化する前に、防衛側が対応できる状態を整備するという方針です。 5 月 8 日の CNBC 報道では「サイバーセキュリティのヒステリー(hysteria)」とも表現され、 業界全体で Mythos 時代の攻守バランスをどう設計するかが議論されています。

08.金融サービス向け展開(5/5):エージェント10種・Microsoft 365・Moody's

Code with Claude 2026 の前日(2026 年 5 月 5 日)には、 Anthropic が金融サービス業界向けの大型展開を発表しました。 ウォール街向けの大手銀行ユースケースを意識した動きで、 Claude Opus 4.7 を金融業務での主力モデルとして打ち出しています。

カテゴリ発表内容
事前構成済みエージェント金融サービスで時間を取られやすい業務向けに 10 種のテンプレートを公開。Claude Cowork / Claude Code のプラグイン、Managed Agents の cookbook として提供
Microsoft 365 統合Excel / PowerPoint / Word / Outlook 向けの Claude アドインを提供。アプリケーション間でコンテキストを自動引き継ぎ
データ提携:Moody'sMoody's MCP アプリで 600 百万社超の企業データにアクセス可能
データ連携パートナー(8 社)Dun & Bradstreet / Fiscal AI / Financial Modeling Prep / Guidepoint / IBISWorld / SS&C IntraLinks / Third Bridge / Verisk
Claude Security(公開ベータ)Opus 4.7 ベースのコード脆弱性スキャンと修正提案。スケジュールスキャン・ターゲットスキャン・トリアージ追跡・エクスポート
ベンチマークClaude Opus 4.7 が Vals AI Finance Agent ベンチマークで 64.37% を記録

金融サービス向け展開は、CwC2026 の開発者向け発表とは別軸の動きですが、 基盤となるモデル(Opus 4.7)と連携プロトコル(MCP)は共通です。 業界別エージェントを Anthropic 自身が出してくる流れは、 他業種への横展開の予兆と見ておく価値があります。

09.顧客事例

今回は機能と並んで、顧客側の実数値が複数共有されました。 いずれも Anthropic 公式が引用した数字ですが、 計測条件・期間・ベースラインは詳細非開示のため、 「同じ数字が自社で再現される」と読まずに、傾向値として扱うのが安全です。

顧客適用機能報告された数値
HarveyDreaming(Managed Agents)内部テストでタスク完了率が約 6 倍に改善
WisedocsOutcomes(Managed Agents)ドキュメントレビューが 50% 短縮、品質はチーム基準を維持
NetflixMulti-agent Orchestration数百件のビルドログを並列で解析し、再発パターンを抽出
Mercado LibreClaude Code(社内 23,000 エンジニア向け)2026 年 Q3 までに 90% 自律コーディングを目標
eveOpus を advisor、Sonnet を実行に置く構成frontier モデル品質を 5 倍低コストで実現
Spiral by EveryOutcomesrubric を編集ガイドラインとユーザートーンに紐付け、並列ドラフトを生成

Anthropic が提示した「advisor 戦略」は、Opus のような大きいモデルを 「助言役」 に置き、 実行は Sonnet などのより小さいモデルに任せる組み方です。 eve のケースは、これにより frontier モデル相当の品質を 5 倍低コストで出せたという報告でした。

10.急成長と自律化の方向:Q1 80 倍成長と SpaceX 提携の背景

4 機能のリリースと SpaceX Colossus 提携が同時期に発表されたのには背景があります。 Anthropic CEO の Dario Amodei 氏が直近のコメントで、Q1 の実績を次のように説明しています。

For a world of 10x growth per year, in the first quarter of this year we saw, if you were to annualize it, 80x growth per year in revenue and usage.

Wolf Financial による Dario Amodei コメントの要約(X / 2026 年 5 月)

Anthropic は事前に「年間 10 倍成長」を上限とするシナリオまでを想定していましたが、 Q1 を年率換算すると80 倍。需要が想定の 8 倍上を行きました。 このギャップが、SpaceX Colossus 1 の計算資源 全体を確保する判断の直接的な引き金になっています。

Amodei 氏は同じ場で次のようにも述べています。

I hope the 80x growth doesn't continue because that's just crazy and it's too hard to handle. I hope for some more normal numbers, maybe a 10x. But we will manage it absolutely as the best we can.

同上

そのうえで Amodei 氏は、確保した計算資源を開発者と顧客にできるだけ早く回す、 というコミットメントを表明しています。 Claude Code の 5 時間枠 2 倍化、Pro / Max のピーク時間レート制限撤廃、Opus API 上限の大幅引き上げは、 その方針の具体化です。

機能面でも同じ方向が見えます。 Managed Agents の 3 機能(Dreaming・Outcomes・Multi-agent)と Routines はいずれも、「人間が AI を 1 操作ごとに動かす」から「AI を自走させ、人間がオーケストレーションする」への移行を進める仕組みです。 増えた需要を限られた開発者の操作時間で処理しきれない以上、 自律性を高める方向への舵切りは、需要側の事情としても理にかなった選択肢になっています。

サービス資料・無料相談

TANTOU ─ AI検索時代のコンテンツ戦略を低コスト高品質で

Google検索はもちろん、ChatGPTやPerplexityにも引用される記事を毎月納品。貴社専用ガイドラインに基づくAI×人間のハイブリッド制作で、SEOとLLMOの両方に効くコンテンツを月額9.8万円(税別)から。

TANTOUの詳細を見る

11.よくある質問(FAQ)

Claude Opus 4.8 はいつ公開され、Opus 4.7 と何が違いますか?

Claude Opus 4.8 は 2026 年 5 月 28 日に公開されました。Opus 4.7(4 月 16 日)から約 6 週間での更新で、 Anthropic 公式発表では SWE-bench Verified が 88.6%(4.7 は 87.6%)、より難しい SWE-bench Pro が 69.2%(同 64.3%)に伸びています。 high effort が既定で、最難タスクは /effort xhigh を使います。 標準料金は Opus 4.7 と同額(100 万トークンあたり入力 $5・出力 $25)に据え置かれ、 fast mode は $10/$50 per MTok へ値下げされました。 Anthropic は「Honest Reasoning」を掲げ、誤りや裏づけのない主張を出しにくくなったとしています(Anthropic 公式発表)。同じ週に Claude Code では Dynamic Workflows と security-guidance plugin も公開されました。

Code with Claude 2026 ではいつ・何が発表されましたか?

2026 年 5 月 6 日、サンフランシスコで開催されました。新モデル発表はなく、 SpaceX Colossus 1 の計算資源 利用契約と、 Managed Agents の Dreaming(research preview)・Outcomes(public beta)・ Multi-agent Orchestration(public beta)、 Code Review / CI auto-fix / Security Reviews / Remote Agents などが発表されました。 Claude Code の Routines は 4 月 14 日に先行リリース済みで、本イベントでも改めて取り上げられた位置づけです。

今すぐ Claude Code で使える機能はどれですか?

Routines は 2026 年 4 月 14 日に研究プレビューとしてリリース済みで、Claude Code Web から利用できます。 Code Review / CI auto-fix / Security Reviews / Remote Agents もエンタープライズ向けに段階展開されています。 Dreaming・Outcomes・Multi-agent は Managed Agents 側で、それぞれ research preview と public beta の段階です。

SpaceX Colossus 提携は Claude Code 利用にどう影響しますか?

Pro / Max / Team / Enterprise 各プランで Claude Code の 5 時間あたり利用上限が2 倍化されました。Pro / Max のピーク時間帯レート制限も撤廃され、 Opus API の利用上限も大幅に引き上げられています。 コードを連続して生成する利用者ほど恩恵が大きい変更です。

Outcomes は Codex の /go と何が違いますか?

成果物単位で自走させる方向性はほぼ同じです。 Outcomes は別コンテキストの grader が rubric で採点する点が特徴で、 評価担当と実装担当を分けることで品質安定を狙う設計です。 Outcomes は Managed Agents API の public beta、Codex /go は既に Codex 側で使えます。

Routines はどのくらい試せますか?

usage dashboard 上で 1 日 15 routinesまでの無料枠が割り当てられます。 各実行はモデルとトークン消費に応じて usage を消費するため、軽いタスクから始めるのがおすすめです。

advisor 戦略とは何ですか?

Opus のような大きいモデルを助言役(advisor)に置き、 実行は Sonnet などのより小さいモデルに任せる組み方です。 eve は、この構成で frontier モデル相当の品質を 5 倍低コストで出せたと報告しています。

Claude Mythos Preview とは何ですか?Project Glasswing との関係は?

Claude Mythos Preview(コードネーム Capybara)は 2026 年 4 月 8 日に Anthropic が限定公開した最高水準のモデルです。 サイバーセキュリティ分野での能力が突出しており、主要 OS・ブラウザ全域で数千件のゼロデイ脆弱性を自律的に発見、 初回エクスプロイト成功率が 83% 超と報告されています。Apple・Amazon・JPMorgan Chase・Palo Alto Networks などに限定公開されており、 Google Cloud Vertex AI 経由でも提供されています。Project Glasswingは Mythos を防衛的(blue team)に活用し、世界の重要ソフトウェアの脆弱性を先行修正する Anthropic 主導プロジェクトです。

Claude Code Auto Mode とは何ですか?

Auto Mode は 2026 年 5 月 5 日に公開された Claude Code の自律実行モードです。 2 段階分類により、安全な操作は自動進行させ、リスクのある操作(ファイル削除・外部 API 呼び出し・権限変更など) だけ人間承認ゲートで一時停止します。 スピナーが赤になることで承認待ち状態を視覚的に確認できます。--dangerously-skip-permissions を使わずに自律実行の範囲を広げられるため、 CI/CD 環境や長時間バッチでのリスク制御に有効です。

/goal コマンドとは何ですか?Auto Mode との違いは?

/goal は Claude Code 2.1.139 で追加された、 コンプリーション条件ドリブンの自走機能です。/goal <条件> でセッションスコープの条件を設定すると、 各ターン終了後に小さく高速なモデル(既定は Haiku)が条件成立をイエス/ノーで判定し、 成立するまで Claude が自動的に次のターンを開始し続けます。 Auto Mode が「ツール呼び出しごとの確認」を削減するのに対し、/goal は「ターンごとの確認」を削減する位置づけで、両者を組み合わせると無人での連続実行が可能になります。-p(headless)と Remote Control でも動作します。

5 月 5 日に発表された金融サービス向けの内容は何ですか?

金融サービス業界向けに、事前構成済みのエージェント 10 種、 Microsoft 365(Excel / PowerPoint / Word / Outlook)統合、 Moody's 提携(600 百万社超のデータ)、 Dun & Bradstreet ほか 8 社のデータ連携、Claude Security の公開ベータが発表されました。 Claude Opus 4.7 が Vals AI Finance Agent ベンチマークで 64.37% を記録したことも公開されています。

12.まとめ

2026 年 5 月の Anthropic は、開発者向け(Code with Claude 2026)と業界別(金融サービス・セキュリティ)の両面で 計算資源確保・エージェント自走・モデル能力の限界拡張を同時進行させた月でした。 Code with Claude 2026 では、新モデル発表を見送る代わりに SpaceX Colossus 1 の計算資源確保、 Managed Agents の Dreaming / Outcomes / Multi-agent Orchestration、 Code Review / CI auto-fix / Security Reviews / Remote Agents、Auto Mode と /goal コマンドが発表されました。 Routines は 4 月 14 日に先行リリース済みで、CwC2026 でも改めて取り上げられた位置づけです。

そして月末の 5 月 28 日には、新モデルClaude Opus 4.8が公開されました。SWE-bench Verified・Pro とも Opus 4.7 を上回り、 high effort を既定にしながら標準料金は据え置き、fast mode は値下げされています。 同じ週には Claude Code 側でも Dynamic Workflows・security-guidance plugin が公開され、 月内には Agent View(claude agents)や Auto Mode の Pro プラン拡大も加わりました。 計算資源確保からモデル更新まで、5 月は自走と大規模化の地ならしが続いた月だったといえます。

4 月 8 日に Preview 公開された Claude Mythos は、5 月 8 日前後に主要メディアで大きく報じられ、 Project Glasswing による防衛的活用と合わせて業界全体の注目を集めています。 前日の 5 月 5 日には金融サービス向けの 10 エージェント、Microsoft 365 統合、Moody's 提携、Claude Security 公開ベータも公開されており、 エンタープライズ展開も着実に進んでいます。

新機能はいずれもトークン消費を押し上げる方向に作用するため、 無料枠と上限アラートを設定してから試すのがおすすめです。 翌月(2026 年 6 月)の発表は、Mythos 級モデル Claude Fable 5 の一般公開を中心にAnthropic 2026年6月発表まとめにまとめています。

AI・AIエージェント活用 基礎知識集

一覧に戻る →
この記事をシェア
澤田 翔太(Shota Sawada)
この記事を書いた人

澤田 翔太

株式会社クリプタル 代表取締役

1988年生まれ、慶應義塾大学卒。創業メンバーとして関わった株式会社セールスサポートを株式会社ネオマーケティング(東証STD 4196)に売却。株式会社クリプタルでも複数の事業立ち上げと売却を経験し、2022年9月には婚活・恋愛メディア「シッテク」「婚活会議」を株式会社ベビーカレンダー(東証GRT 7363)へ売却。現在はAI業務支援事業、TANTOU事業、グロースハック支援事業、メディア事業、SEOコンサルティング事業を手がける。