CLI エージェント入門
2025 年に Claude Code(研究プレビュー)、Codex CLI、Cursor などが本格的に普及し、コード生成 AI の主戦場は「ブラウザ上のチャット」から「ターミナル / IDE 上の常駐エージェント」へ移りました。2026 年 5 月時点の開発現場では、CLI / IDE エージェントを使うことが標準的な選択肢になっています。
CLI / IDE エージェントは、ファイル読み書きとシェル実行をサンドボックス境界の中でこなす AI です。Anthropic / OpenAI などの提供側が、書き込み範囲・コマンド許可・認証情報スコープといった「安全側の枠組み」を年々強化してきており、その土台の上で auto モードを実務に組み込みやすくなってきています。従来のチャット UI と本質的に違うのは、提案・実行・確認を同じセッション内で回せる点です。
01.まず結論:チャットUIから常駐型へ移行
2022〜2024 年は、ChatGPT のチャット欄にコードを貼り付け、回答をコピーして IDE に戻す「コピペ駆動」が主流でした。2025 年以降は、AI が直接プロジェクトのファイルを読み、編集案を出し、テストを走らせる「常駐型エージェント」が主流になっています。
この移行の前提は、(a) 推論モデルでコード品質が大きく上がった、(b) Tool Use / MCP で外部実行が標準化された、(c) Anthropic が Claude Code を契機に CLI エージェントの設計パターンを公開した、の 3 点です。
02.主要 CLI / IDE エージェント比較
| ツール | 形態 | 中心 LLM | 特徴 |
|---|---|---|---|
| Claude Code | CLI(ターミナル常駐)+ IDE 拡張 | Claude 4 系 | Anthropic 純正。Subagents / Hooks / Plugins / Skills の拡張性が高い |
| Codex CLI(OpenAI) | CLI | GPT-5 / o 系 | OpenAI 純正。Codex Cloud との連携でクラウド実行が強い |
| Cursor | IDE 単体(VSCode フォーク) | Claude / GPT 等を切替 | IDE 体験に最適化、auto-complete / agent モード両対応 |
| Windsurf | IDE 単体 | 複数モデル | Cursor の競合。エージェント駆動の UX を重視 |
| GitHub Copilot Workspace / Agent | Web / IDE 拡張 | GPT 系等 | GitHub 内のワークフロー統合が強い |
| Aider | CLI(OSS) | 任意モデル | OSS。シンプル構成、ローカル運用が選びやすい |
03.業務導入での前提と注意点
CLI エージェントは、設定次第でファイル削除・git push・本番反映まで実行可能になります。各社が提供するサンドボックス・権限スコープ機能は年々充実してきているので、導入時は (1) どこまでをサンドボックスの内側に入れるか、(2) 機密ファイル(.env, 鍵、本番設定)の除外、(3) 本番認証情報の切り離し、(4) 監査ログの取得、を最初に設計します。境界の引き方が明確であれば、その内側で auto モードを十分活かせます。
| 設計項目 | やること | 外すと起きる事故 |
|---|---|---|
| ファイル境界 | 対象プロジェクト外を読み書きさせない | 別プロジェクトのコードを誤改変 |
| シェル実行 | destructive コマンドはサンドボックス外で実行する設計にする | rm -rf や本番デプロイの誤実行 |
| 認証情報 | .env や鍵をコンテキストに渡さない | AI 出力やログに鍵が流出 |
| git 操作 | push / force-push / branch -D は本番リモートと切り離して動かす | 履歴破壊、誤マージ |
| 監査ログ | ツール呼び出しと差分を残す | 事後の原因追跡ができない |
04.向く業務・向かない業務
| 業務 | 向き | 理由 |
|---|---|---|
| リファクタ・修正案 | 高い | 全ファイル文脈で一括変更しやすい |
| テスト生成 | 高い | コードと期待挙動を分けて扱える |
| ドキュメント生成 | 高い | コード読解 + Markdown 出力が得意 |
| 原因調査・デバッグ | 中〜高 | ログ・スタックトレース読解は強いが、再現は人間が必要 |
| 新規プロジェクト立ち上げ | 中 | 型定義と全体設計は人間判断が必要 |
| セキュリティ判断 | 低 | 誤判定の影響が大きく、最終判断は人間 |
| 本番デプロイ | 低 | サンドボックスの外で扱い、別経路で実行する |
Claude・Claude Code 進化の年表
Claude Code の登場と Subagents / Hooks / Plugins / Skills の時系列はこちら。
OpenAI Codex 進化の年表
Codex CLI までの OpenAI コード生成 AI の歴史はこちら。
Claude Code と Codex の使い分けワークフロー比較
Claude Code / Codex CLI の使い分け詳細は別記事で整理しています。
05.よくある誤解
| 誤解 | 実際 | 現場での扱い方 |
|---|---|---|
| AI が勝手にコードを書く | サンドボックス境界の中で AI が自走し、人間は方針と境界の設計に集中する形が現実 | 境界の設計次第で auto モードを活かす範囲を段階的に広げる |
| 1 ツールに揃えるべき | プロジェクト・チーム特性で使い分けるのが現実 | ガイドラインを用意し選択肢を残す |
| CLI = 開発者だけのもの | リサーチや事務作業にも応用が進んでいる | 情シス / コーポレートでも検討対象 |
| Cursor と Claude Code は競合 | IDE 体験 vs CLI 体験で住み分け、両方使うチームも | 用途で使い分け、強制統一は避ける |
06.よくある質問(FAQ)
Claude Code と Cursor、どちらを選ぶべきですか?
用途とチーム文化次第です。ターミナル中心の開発 / カスタム拡張(Subagents・Hooks・Skills)重視なら Claude Code、IDE 体験 / 既存 VSCode ワークフロー重視なら Cursor が選びやすい傾向です。両方併用するチームも増えています。
CLI エージェントを auto モードで使って大丈夫ですか?
サンドボックスの内側にあたる範囲では十分活用できます。Anthropic / OpenAI などの提供側が、書き込みディレクトリ・許可コマンド・認証情報スコープといった安全側の機能を継続的に強化してきており、その土台に乗せた上で、本番認証情報や force-push のような影響が外に広がる操作だけは境界の外に置く、という設計が現実的です。境界の引き方を明確にしておくほど、内側では auto モードの恩恵を取り込みやすくなります。
CLI エージェントは非エンジニアでも使えますか?
リサーチ・議事録整理・データ加工・社内ドキュメント整備など、非エンジニア業務にも応用できます。ただし、シェル実行ができる前提なので、権限境界とファイル境界の理解は必須で、IT 部門が運用ガイドを用意するのが安全です。
ローカルだけで動かしたい場合、どれが選択肢になりますか?
Aider(OSS)+ ローカル LLM、または Claude Code / Codex を企業向け(Anthropic / OpenAI のエンタープライズ / Bedrock 等)で運用する選択肢があります。データの取り扱いポリシーやコンプライアンス要件に合わせて選定します。
07.まとめ
CLI / IDE エージェントは、2026 年現在の開発現場で標準的に使われる AI 利用形態です。Claude Code / Codex CLI / Cursor などの選択肢があり、用途やチーム文化で使い分けるのが現実的です。各社がサンドボックス・権限スコープ・監査機能を継続的に強化している流れもあり、導入側は「どこを境界の内側に入れるか」を設計しながら、安全側に倒しすぎず auto モードのメリットを取り込んでいくのが、これからの開発スタイルになりつつあります。
CLI エージェントの組織導入を設計しませんか
AI 活用や AI エージェント導入のご相談、PoC、伴走支援をご検討の方は、お気軽にお問い合わせください。

