コンテンツへスキップ

media AI活用の最前線

ツール比較・実践ガイド

AIコーディングエージェント比較【2026年10月】6製品の料金と選び方

【2026年最新】AIコーディングエージェント比較|6製品を実務で検証 サムネイル

最終更新: 2026年9月6日(初版: 2026年5月13日。6製品の料金・プラン・提供体制を各公式ページで全件再確認済み。参照日2026-09-06)

2026年9月時点の答えを先に言うと——個人開発と小規模チームの「自律的なコーディング自動化」を最重視するならClaude Code、既存IDEワークフローを壊さず段階導入したいならCursor、社内の権限管理とコンプライアンスを最優先するならGitHub Copilot(Business/Enterprise)が第一候補です。タスクを丸ごと委任したいならDevin。ただし最大の変化として、Windsurfが「Devin Desktop」へ改称され、Cognition(Devinの開発元)の製品ラインに統合されました(2026年6月2日・公式発表)。

この記事の要点:

  • 要点1: 比較対象は Claude Code / Cursor / GitHub Copilot / Windsurf(現Devin Desktop) / Codex CLI / Devin の6製品。個人向け有料プランは GitHub Copilot Pro 月10ドル、Claude Pro 月17ドル(年払い時)、Cursor Pro・ChatGPT Plus・Devin Pro 各月20ドルが起点(各公式料金ページ、参照日2026-09-06)。
  • 要点2: ターミナル/CLI で動く「エージェント型」(Claude Code・Codex CLI)と、IDE組み込み型(Cursor・Windsurf=現Devin Desktop・Copilot)、フルマネージドの自律エージェント(Devin)で設計思想がまったく違う。「どれが優れているか」ではなく「どの作業をどこまで任せたいか」で選ぶ。
  • 要点3: 社内導入では「権限境界(ファイル書き込み・コマンド実行の許可制)」「サンドボックス」「監査ログ」「ソースコードの学習利用オプトアウト」の4点を契約・設定レベルで確認してから配る。

対象読者: AIコーディング支援ツールの全社導入・チーム導入を検討中のエンジニアリングマネージャー、情シス・セキュリティ担当者、スタートアップのCTO、そして「自分の開発をどこまで自動化できるか」を見極めたい個人開発者。

読了後にできること: 自社の規模・ワークフロー・セキュリティ要件に合わせて、まず触るべき2製品を絞り込み、今日のうちにトライアル申請まで進められます。

「コード書く時間より、レビューと”このツールどれ入れる?”の議論のほうが長くなってきた…」

これは半分冗談ですが、ここ1年ほど、企業向けのAI研修・導入支援の現場で本当によく聞く声です。先日も、エンジニア20名ほどの受託開発会社から「ClaudeとCursorとCopilot、結局どれを全員に配ればいいんですか。組み合わせるとライセンス費がえらいことになる」と相談を受けました。話を聞くと、すでに3つとも個人で勝手に入れている人がいて、設定もバラバラ、リポジトリへのアクセス権限も誰も把握していない。「便利だから入れた」が積み重なって、気づいたら統制の効かない状態になっていたわけです。

この経験から痛感したのは、AIコーディングエージェントは「個人の生産性ツール」と「組織のインフラ」の境目に立っている、ということです。個人で1本だけ使うなら好みで決めていい。でもチームや全社で配るなら、料金体系、権限の効かせ方、ソースコードの扱い、学習コスト、そして「うちのワークフローに馴染むか」を冷静に並べて比べないと、後で必ず揉めます。

この記事では、Claude Code / Cursor / GitHub Copilot / Windsurf / Codex CLI / Devin の6製品を、料金・対応言語・エージェント自律性・IDE統合・CLI対応・サブエージェント/並列実行・MCP対応・チーム共有・セキュリティ・日本語対応・学習コスト・向いている用途、という軸で横並びに比較します。比較表は3つ(総合スペック、料金、用途別推奨マトリクス)、各製品で実際に使える設定例・プロンプト例も載せました。100社以上のAI研修・導入支援で見てきた「想定シナリオ」を3つ挟みながら、最後に「あなたの組織が今日やること」まで落とし込みます。5月公開の初版からの変化点だけ知りたい方は、次の「主な変化まとめ」からどうぞ。

AIエージェントの基本概念や、社内導入の進め方そのものについてはAIエージェント導入完全ガイドで体系的にまとめているので、前提を整理したい方はそちらも併読してください。

2026年9月時点の主な変化まとめ|5月の初版公開からの差分

初版(2026年5月13日)から約4か月で、6製品すべてに選定判断へ響く変化がありました。各公式リリースノート・公式ドキュメント・公式料金ページで確認できたものだけを挙げます(参照日2026-09-06)。

製品2026年5月→8月の主な変化(公式情報で確認済み)
Claude CodeCLIに加えIDE拡張・デスクトップアプリ・Web版・モバイルへ提供面が拡大。複数エージェント協調やRoutinesが公式ドキュメントに記載
Cursorクラウド実行のCloud Agents強化が8月に連続告知。自社コードホスティング「Origin」を早期ベータ公開
GitHub Copilot課金が「GitHub AI Credits」制へ。個人向けに月100ドルの「Copilot Max」が新設
Windsurf2026年6月2日に「Devin Desktop」へ改称(公式発表)。プラン・料金は引き継ぎ、Cascadeは「Devin Local」へ
Codex CLI8月だけでv0.149〜v0.151をリリース。「codex agents」ダッシュボード等が追加
Devinセルフサーブ料金を公式に明記: Free / Pro 月20ドル / Max 月200ドル / Teams 月80ドル〜

とくにWindsurfの改称で、比較の構図は会社単位(Anysphere vs Cognition)へ変わりました。なおGoogle系ツールでも大きな移行が起きています(Gemini CLIからAntigravityへの移行解説)。

コーディングAIの比較軸|補完型・IDE型・エージェント型の違い

コーディングエージェントとは、自然言語の指示から計画を立て、ファイル編集・コマンド実行・テスト・PR作成までを自律的に進めるAIツールのことです。コーディングAIの比較では補完中心のツールと自律エージェントが同じ土俵に並べられがちですが、まず3階層に分けると整理が速くなります。

コーディングAI比較の実務5軸(自律性の深さ・料金と課金単位・セキュリティと学習利用・既存ワークフロー適合・チーム管理)を中心から放射状に示した図
実務の比較軸は「自律性の深さ・料金と課金単位・セキュリティと学習利用・既存ワークフロー適合・チーム管理」の5つ。本記事の3つの比較表はこの5軸に沿っています。
  • 補完型: カーソル位置の続きを提案。GitHub Copilotの補完機能が代表格
  • IDE型: エディタ内で複数ファイル編集・コマンド実行まで踏み込む。Cursor / Windsurf(現Devin Desktop) / Copilotのエージェント機能
  • エージェント型(自律実行): タスク単位で計画→実装→テスト→PRまで。Claude Code / Codex CLI / Devin

そのうえで実務の比較軸は「自律性の深さ・料金と課金単位(シート/クレジット/ACU)・セキュリティと学習利用・既存ワークフロー適合・チーム管理」の5つ。本記事の3つの比較表はこの5軸に沿っています。

そもそも「AIコーディングエージェント」の3類型を押さえる

比較に入る前に、ここを揃えておかないと議論が噛み合いません。「AIコーディングエージェント」と一括りにされがちですが、実務上は次の3類型に分かれます。

AIコーディングエージェントの3類型(CLI・ターミナル型/IDE組み込み型/フルマネージド自律)を並べ、手放したい工程で選ぶことを示した図
「あなたが手放したい工程はどこか」を先に決めると、候補が一気に2〜3個に絞れます。
  1. CLI / ターミナル型エージェント: ターミナルから対話的に指示を出すと、エージェントがファイルを読み・書き、テストを実行し、コミットまで進める。Claude Code、Codex CLI がここ。エディタに縛られず、CI・スクリプト・他ツールと組み合わせやすい。自律性は設定次第で広くも狭くもできる。
  2. IDE組み込み型: エディタ(VS Codeフォーク or 拡張)に統合され、補完・チャット・エージェントモードを提供。Cursor、Windsurf、GitHub Copilot がここ。既存の開発体験を大きく変えずに導入でき、コードベース全体のコンテキスト把握が強い。
  3. フルマネージド自律エージェント: タスクを投げると、クラウド上の隔離環境で計画→実装→テスト→PR作成まで「人がほぼ触らずに」進める。Devin が代表。並列でタスクを走らせる「AIエンジニアの一員」的な使い方を想定。

この記事の6製品はこの3類型をまたいでいるので、「Devin vs Copilot、どっちがいい?」のような比較はそもそも次元が違います。「あなたが手放したい工程はどこか」——補完だけでいいのか、リファクタや実装も任せたいのか、それともタスク丸ごとPRまで任せたいのか。ここを先に決めると、候補が一気に2〜3個に絞れます。

総合スペック比較表(6製品)

まず全体像です。2026年9月時点の各製品公式情報をもとに整理しました(仕様は更新が速いため、導入前に必ず各公式ドキュメントで最新を確認してください)。

項目Claude CodeCursorGitHub CopilotWindsurfCodex CLIDevin
提供元AnthropicAnysphereGitHub(Microsoft)Cognition(旧Codeium。2026年6月に「Devin Desktop」へ改称)OpenAICognition
形態CLI / ターミナル(VS Code・JetBrains拡張あり)IDE(VS Codeフォーク)IDE拡張(VS Code・JetBrains等)+ CLIIDE(VS Codeフォーク・現Devin Desktop)+ 拡張CLI / ターミナル(オープンソース)クラウド型自律エージェント(Web UI・Slack連携・CLIあり)
主力モデルClaude(Sonnet / Opus 系)複数モデル選択(Claude / GPT 系 等)+自社モデル Composer複数モデル選択(GPT / Claude / Gemini 系 等)複数モデル選択+自社最適化モデルOpenAI モデル(GPT 系)自社オーケストレーション(複数モデル)
エージェント自律性高(許可制で範囲調整、計画モード、複数ステップ実行)中〜高(Agentモードで複数ファイル編集・コマンド実行)中(Copilot エージェント / coding agent でタスク実行)中〜高(Cascade=現Devin Localで複数ステップ実行)中〜高(承認モードで範囲調整、計画モード)非常に高(タスク丸ごとPRまで自律実行)
コードベース全体の把握強(リポジトリ走査・必要ファイル自動取得)非常に強(インデックス+セマンティック検索)強(リポジトリ検索・Copilot context)非常に強(インデックス+Cascade)強(リポジトリ走査)強(クラウド上で全体を取り込んで作業)
ターミナル/CLI ネイティブ◎(本体がCLI)△(IDE内ターミナル経由)○(CLIプレビュー提供)△(IDE内ターミナル経由)◎(本体がCLI、OSS)△(クラウド側で実行)
サブエージェント / 並列実行◎(サブエージェント機能、複数セッション並走しやすい)○(複数チャット/タブ、バックグラウンドエージェント)○(複数タスクをエージェントに割り当て)○(複数Cascadeフロー)○(複数セッション並走可)◎(複数タスクを並列でAIエンジニアに割当)
MCP(Model Context Protocol)対応◎(MCPクライアントとして広く対応、サーバ追加容易)◎(MCPサーバ接続対応)○(MCP対応を拡大中)○(MCP対応)○(MCP対応)○(外部ツール連携、MCP対応を拡大中)
チーム/Enterprise プラン○(Team / Enterprise、組織管理・ポリシー設定)○(Team / Enterprise、SSO・集中管理)◎(Business / Enterprise、組織ポリシー・監査・SSO が成熟)○(Teams / Enterprise、SSO・管理)○(OpenAIアカウント基盤、組織管理)○(Team / Enterprise、組織管理)
権限境界 / サンドボックス◎(ファイル書込・コマンド実行を許可制、危険操作の確認、設定で制限可)○(コマンド実行の確認、許可リスト設定可)○(エージェントの実行範囲を組織ポリシーで制御)○(実行確認・許可設定)◎(承認モード・サンドボックス実行、ネットワーク制限可)◎(隔離されたクラウド環境で実行=ローカルに直接触れない)
ソースコードの学習利用商用利用分はモデル学習に使わない方針(プラン/設定で確認)Privacyモードでコード送信・保持を制限可Business/Enterpriseはコードをモデル学習に使わないEnterpriseはゼロデータ保持オプション等API/商用分はモデル学習に使わない方針(設定で確認)顧客コードの扱いはEnterprise契約で規定
日本語対応◎(指示・出力とも自然な日本語、UIは英語中心)◎(日本語指示OK、UIは英語中心)◎(日本語指示OK、UIは英語/一部日本語)◎(日本語指示OK、UIは英語中心)◎(日本語指示OK、UIは英語中心)○(日本語指示OK、運用は英語前提が無難)
学習コスト(体感)中(CLIに慣れが必要、慣れると速い)低(VS Codeそのままの操作感)低(普段のIDEに足すだけ)低〜中(VS Code風、Cascadeの作法に慣れ)中(CLI+設定ファイル)中〜高(タスク分解の設計力が要る)

※「◎○△」は筆者の実務上の体感であり、各社の公式評価ではありません。仕様・プラン名は各公式ページの最新版を必ず確認してください。

事例区分: 想定シナリオ
以下は100社以上の研修・導入支援で見てきた典型例をもとに構成したシナリオです。特定の実在企業の事例ではありません。数値は「想定」「推計」です。

従業員50名規模のSaaS企業A社(仮)。エンジニア12名。最初は「Cursorが流行ってるらしい」で5名が個人契約。3か月後、別の3名が「Claude Codeのほうがリファクタが速い」と乗り換え、残りはCopilot。マネージャーが「全員どれか1つに統一しよう」と言い出したものの、全員が「自分のは外したくない」と抵抗。結局、「補完中心の人はCopilot、コードベース横断の設計・リファクタを多用する人はCursorかClaude Code、CI/自動化スクリプトを書く人はClaude Code/Codex CLI」という”役割別の棲み分け”に落ち着いた——というのが、実は一番よくあるパターンです。「1社1ツール」は理想ですが、現実は「用途別に2〜3」を許容したほうが摩擦が少ない。これは後の用途別表の前提になります。

1. Claude Code — CLI型エージェントの完成度

Anthropicのターミナルベースエージェント。「コードを書く」より「コードベースに対して作業をさせる」感覚に近い。ファイルの読み書き、テスト実行、複数ステップのリファクタ、コミット、さらにサブエージェントを使った並列作業まで、許可制でコントロールしながら任せられます。研修先の受託開発チームでも「設定ファイル一括変更」「テストの失敗を原因まで遡って修正」のような、エディタでチマチマやると面倒な作業を丸ごと投げる使い方が定着していました。

強みは (1) CLIなのでCI・スクリプト・他ツールと組み合わせやすい (2) 許可制の権限境界が細かく、社内導入時に「どこまで触らせるか」を明示的に決められる (3) MCP対応が広く、社内DBやドキュメント、Slack等を「文脈」として渡しやすい こと。弱みは、IDEのGUIに慣れた人にはターミナル操作の慣れが要ること、対話の往復が増えるとトークン消費(=コスト)が読みにくいこと。

プロジェクト方針をエージェントに守らせる設定例(リポジトリ直下に置く運用ファイル。例として CLAUDE.md 相当):

# プロジェクト運用ルール(AIエージェント向け)

## 必ず守ること
- 変更前に該当ファイルを読んでから編集する
- テストがあるディレクトリは、変更後に必ずテストを実行する
- 破壊的操作(ファイル削除・大量リネーム)は実行前に必ず確認を取る
- 仮定した点は「仮定」と明記する
- 不足している情報があれば、最初に質問してから作業を開始する

## コーディング規約
- 既存のコードスタイルに合わせる(インデント・命名・import順)
- 1ファイル200〜400行を目安、800行を超えたら分割を提案する
- 数字・固有名詞をコードコメントに書くときは根拠(出典/計算式)を添える

## やってはいけないこと
- .env / 認証情報をログやコミットに残さない
- 本番設定ファイルを確認なしで書き換えない

こういう「ルールファイル」を置いておくと、エージェントの暴走をかなり抑えられます。社内導入の最初の一歩としておすすめ。

2026年9月時点の更新: 公式ドキュメントではCLIに加えVS Code / JetBrains拡張、デスクトップアプリ、Web版(claude.ai/code)、モバイルまで同じエンジンで使えると案内され、「ターミナル専用」という位置づけはもう正確ではありません。複数エージェント協調はエージェントチーム機能の解説、Claudeアプリとの違いの整理はClaudeとClaude Codeの違い完全ガイドへ。

この記事の内容を社内で使うなら

要点と手順をまとめた資料を無料で受け取れます。研修4,000名以上・支援100社以上の実績をもとに、自社の業務に当てはめる相談も30分から受け付けています。

AIエージェント導入・安全運用チェックリスト無料で受け取る →AI顧問に相談する(30分・無料)→

2. Cursor — IDE体験を壊さずに最も馴染ませやすい

AnysphereのVS Codeフォーク。インストールした瞬間から「いつものVS Code」なので、学習コストがほぼゼロ。それでいてコードベース全体のインデックス+セマンティック検索が強力で、「この関数の呼び出し元を全部直して」のような横断作業を、エディタの中で完結できます。Agentモードでは複数ファイル編集やコマンド実行まで踏み込めます。

研修現場で配ると、非エンジニアに近いポジション(QA、PdM、デザイナー)の人でも「とりあえずチャットで聞ける」と受け入れが速い。Team/Enterpriseプランでは SSO や集中管理、Privacyモードでのコード送信制限もあるので、組織導入の土台はそろっています。弱みは、VS Codeフォークなので JetBrains 系IDEを主戦場にしている人には合わないこと、モデル選択やAgentの挙動が頻繁にアップデートされるので「設定が安定しない」と感じる人がいること。

Cursor の「プロジェクトルール」(.cursor/rules 相当)に置くと効く指示例:

あなたはこのリポジトリの開発支援エージェントです。

# 文脈
- フレームワーク: (ここに記載)
- テスト: (ここに記載)

# 振る舞い
- 変更を提案する前に、影響を受けるファイルを列挙する
- 大きな変更は「計画」を先に出し、承認を得てから実装する
- コマンド実行は必ず内容を表示し、承認を待つ
- 不明点があれば質問してから作業する

# 禁止
- 認証情報・秘密鍵をコードやログに出力しない
- 本番系の設定ファイルを断りなく変更しない

2026年9月時点の更新: 公式チェンジログでは8月にクラウド側で走る「Cloud Agents」の強化が連続告知され、8月17日には自社コードホスティング「Origin」の早期ベータも発表。料金ページには自社開発モデル「Composer」の記載もあります。選び分けの詳細は(Cursor vs Claude Code徹底比較|料金・機能)。

3. GitHub Copilot — 組織導入の”安全パイ”

GitHub(Microsoft)の老舗。補完エンジンとしての完成度はもちろん、Chat、エージェント(coding agent)と機能が広がり、CLIプレビューも出ています。最大の強みは 組織管理・監査・コンプライアンス周りの成熟度。Business / Enterprise プランでは SSO、組織ポリシー、監査、そして「コードをモデル学習に使わない」という明確な扱い。情シス・法務が首を縦に振りやすい。GitHub / Azure DevOps を既に使っている組織なら、調達も最短です。

研修先の中堅メーカー(情シス主導でAI活用を進めたいケース)では、「まずCopilot Businessを全エンジニアに配って、社内ガイドラインを整備しながら、一部チームでCursor/Claude Codeを試す」という二段構えがよく採用されます。弱みは、CursorやClaude Codeと比べると「コードベース横断の自律的なリファクタ」のような重い作業はやや控えめな印象(ただしエージェント機能で詰めてきている)。とはいえ「最初の1本」としては失敗が一番少ない選択肢です。

Copilot エージェントにタスクを渡すときのプロンプト例(Issue本文やチャットで):

## タスク
(例)ログイン画面のバリデーションエラー時に、入力欄の下に赤字でメッセージを表示する。

## 期待する動作
- メールアドレス未入力 → 「メールアドレスを入力してください」
- パスワード8文字未満 → 「8文字以上で入力してください」

## 制約
- 既存のコンポーネント設計・スタイル規約に合わせる
- テストが存在する場合は更新・追加する
- 変更ファイルをPR説明に列挙する
- 仕様が曖昧な点はPRコメントで質問する

2026年9月時点の更新: 課金が「GitHub AI Credits」制へ移行(1クレジット=0.01ドル。補完は有料プランで無制限・消費なし)。個人向けに月100ドルの「Copilot Max」が新設され4段構成になりました。公式のプラン表では月あたりの付与クレジットがドル建てで表示され、Pro 15ドル分/Pro+ 70ドル分/Max 200ドル分と案内されています。エージェント機能を多用すると消費が伸びるため、超過時の挙動と上限設定はCopilot従量課金の実務ガイドで先に押さえておくと安全です。Copilot CLIも公式ドキュメントに独立の章として整備済みです(一部機能はパブリックプレビュー)。

4. Windsurf — Cascade による”流れ作業”が独特

もとはCodeiumが出していたVS Codeフォーク(拡張版もあり)で、現在はCognition傘下の「Devin Desktop」として提供されています(改称の詳細はこの節の最後で解説)。Cursor と立ち位置は近いですが、「Cascade」という、複数ステップの作業を流れとして組み立てる仕組みが特徴。コードベースのインデックスも強く、「タスクを投げると、関連ファイルを辿りながら順に手を入れていく」体験がスムーズです。自社最適化モデルも持っていて、補完の体感速度に定評があります。

「CursorかWindsurfか」は、正直、好みとチームの相性で決めていいレベルの差です。研修で両方を触ってもらうと、半々で割れます。Windsurf は無料枠やプランの組み立てが導入しやすいケースがあり、Teams/Enterprise では SSO や管理機能もそろっています。弱みは Cursor と同じで JetBrains 主戦場の人には合いにくいこと、エコシステム(拡張・コミュニティ知見)が GitHub Copilot ほどの厚みはまだないこと。

Windsurf(Cascade)に渡すタスク指示の例:

目的: APIレスポンスのエラーハンドリングを統一する

手順案:
1. src/api 配下で生のエラーをそのまま投げている箇所を洗い出す
2. 共通のエラー型・ハンドラに置き換える
3. 影響する呼び出し側を修正する
4. 既存テストを実行し、必要なテストを追加する

ルール:
- 各ステップ完了ごとに変更点を要約する
- 破壊的変更がある場合は実行前に確認する
- 不明点は先に質問する

2026年9月時点の重要な変化: Windsurfは2026年6月2日に「Devin Desktop」へ改称されました。2025年に買収を発表したCognition(Devinの開発元)による統合の仕上げです。公式FAQでは、既存ユーザーのプラン・料金・拡張・設定はそのまま引き継がれ(「Pricing is unchanged」と明記)、Cascadeは「Devin Local」へ改称、windsurf.comはdevin.aiへリダイレクトされます。操作感は従来の延長ですが、選定上は「Cognitionのエコシステムを選ぶか」という判断になりました。

5. Codex CLI — オープンソースのターミナルエージェント

OpenAIが出しているターミナルベースのコーディングエージェント。オープンソースで、ローカルで動かしながらOpenAIのモデルを使う構成。Claude Code と立ち位置がよく似ていて、「CLIで対話 → ファイル編集・コマンド実行・テスト → コミット」という流れ。承認モード(読み取りのみ/編集まで/コマンド実行まで)やサンドボックス実行、ネットワーク制限といった安全装置がそろっています。OSSなので挙動や設定が追いやすいのも、エンジニアには嬉しいポイント。

「OpenAIのモデルを主に使いたい」「Claude Code的な体験をOSSで持ちたい」組織に向きます。研修先のスタートアップでは「ClaudeとOpenAIを両方併用したいので、リファクタはClaude Code、特定の生成タスクはCodex CLI」と使い分けている例もありました。弱みは、Claude Code と同様にCLIの慣れが要ること、エコシステムやドキュメントの厚みはまだ発展途上なこと。とはいえ「ターミナル型エージェントを比較検討に入れるなら、Claude Code と Codex CLI は両方触っておく」のが定石です。

Codex CLI に渡す指示と、安全寄りの設定方針の例:

# 指示の例(ターミナルで対話)
このリポジトリのデッドコード(どこからも参照されていない関数・ファイル)を
洗い出して、削除候補のリストを出して。
- まずリストだけ出す。削除は私の承認後に実行する
- 各候補について「なぜ未参照と判断したか」を1行で添える
- テストが落ちないことを確認してから次に進む

# 設定の方針(社内導入時)
- 承認モード: まずは「編集は提案のみ・コマンド実行は都度承認」から始める
- サンドボックス: 有効化し、ネットワークアクセスは必要時のみ
- 対象ディレクトリ: リポジトリ配下に限定し、ホーム配下や本番設定には触らせない

2026年9月時点の更新: 本体はOSS(Apache-2.0)のまま、公式チェンジログでは8月だけでv0.149〜v0.151がリリースされ、「codex agents」ダッシュボード(複数エージェントの一覧管理)等が追加されました。利用枠はChatGPTプラン同梱(月8ドルのGoから)かAPIキー従量かの二択。プラン別の使いどころはCodex料金の完全ガイド、8月の機能追加はCodex 2026年8月アップデートまとめへ。

6. Devin — “AIエンジニアの一員”という別カテゴリ

Cognition の自律エージェント。これまでの5製品とは毛色が違います。Devin はクラウド上の隔離環境で動き、タスクを投げると計画→実装→テスト→PR作成まで「人がほぼ触らずに」進めます。Slack 連携で「@Devin このバグ直して」と投げる、複数タスクを並列で走らせる、といった「チームメンバーの増員」に近い使い方を想定しています。

フルマネージド自律エージェントの流れ。ゴール・スコープ・受け入れ条件を渡すとクラウド上の隔離環境で計画から実装・テストを行いPRを作成する図
タスクを分解して投げると、隔離環境で計画→実装→テスト→PR作成まで進みます。指示が曖昧だとPRも曖昧になり、レビュー時間が逆に増えます。

向くのは、定型的だが量がある作業(依存関係の更新、繰り返しパターンのリファクタ、テストの追加、小さなバグ修正のバックログ消化)を、人間のレビューを挟みつつ大量に回したい組織。研修・相談の場では「人を採れないので、まず定型タスクをDevinに回して、人間はレビューと設計に集中する」という発想で導入を検討するスタートアップが増えています。一方で、重いタスクを回すほど利用量ベースの費用が伸びやすい体系(Enterprise契約はACU課金)で、「タスクを適切に分解して投げる」設計力がないと空回りします。「賢い丸投げ先」ではなく「分解前提の実装代行」と捉えるのが正解。コードはクラウド側で扱われるため、Enterprise契約でのデータ取り扱い条件の確認は必須です。

Devin にタスクを渡すときの「投げ方」テンプレ(Slack やWeb UIで):

@Devin 次のタスクをお願いします。

## ゴール
(例)プロジェクト内で使っている古いHTTPクライアントライブラリを、
新しい推奨ライブラリに移行する。

## スコープ(重要・限定する)
- 対象は src/services 配下のみ。それ以外は今回触らない
- 1つのPRが大きくなりすぎる場合は、ディレクトリ単位でPRを分ける

## 受け入れ条件
- 既存テストが全て通る
- 新しい依存に対する基本的なテストを追加する
- PR説明に「変更ファイル一覧」「移行で生じた挙動差分」を記載する

## 不明点
- 仕様が曖昧な箇所は、勝手に判断せずPRコメントで質問してください

2026年9月時点の更新: 公式のセルフサーブプランは Free / Pro 月20ドル / Max 月200ドル / Teams 月80ドル〜(Teamsはフルシート1席月40ドルで、月80ドルが最低額)で、「チームプランは月数百ドル規模から」という初版時点の前提はもう古い情報です。使用量クォータはDevinセッション・CLI・Desktop(旧Windsurf)で共用、EnterpriseはACU課金のまま。まず個人のProで分解と投げ方を練習してからチーム展開する段階導入が現実的です。海外では金融大手の活用も報道されています(金融業界でのDevin活用の解説)。

料金比較表

料金は改定が頻繁なので、必ず各公式料金ページで最新を確認してください(下記は2026年8月30日に各公式料金ページで確認した構成。年払い/月払いで単価が変わるプランがあります。為替・含まれる利用量は変動します)。

コーディングAIの課金の考え方5種(サブスク+利用上限、サブスク+従量、クレジット制、プラン同梱かAPI従量、ACU課金)を並べた図
同じ「有料プラン」でも課金の考え方が違います。金額は改定が頻繁なので、必ず各公式料金ページで最新を確認してください。
製品無料枠個人向け有料チーム/BusinessEnterprise課金の考え方
Claude CodeClaude無料プランあり(公式のプラン比較表ではClaude CodeはPro以上。無料プランは対象外)Pro 月17ドル(年払い時。月払い20ドル)/ Max 月100ドルからTeam 標準シート1人月20ドル〜/ Claude Code込みプレミアムシート1人月100ドル〜(年払い時)個別見積サブスク+プラン内利用上限。追加利用の購入あり
Cursorあり(Hobby)Pro 月20ドル(上位にPro+ / Ultra。価格は公式料金ページ参照)Teams 1ユーザー月40ドル個別見積(SSO・監査)サブスク+オンデマンド従量
GitHub Copilotあり(Copilot Free)Pro 月10ドル/ Pro+ 月39ドル/ Max 月100ドル(付与クレジット1,500/7,000/20,000)Business 1席月19ドル(1,900クレジット)1席月39ドル(3,900クレジット)AI Credits制(1クレジット=0.01ドル)。補完は有料プランで無制限
Windsurf(現Devin Desktop)あり(Devinのプラン体系に統合)既存ユーザーの料金は「変更なし」と公式FAQに明記。新規は下段のDevinを参照Devin Teamsに統合個別見積使用量クォータはDevin本体と共用
Codex CLIOSS本体は無料(モデル利用は別)ChatGPT Go 月8ドル/ Plus 月20ドル/ Pro 月100ドルからBusiness 1ユーザー月20ドル(年払い時。月払い25ドル)個別見積ChatGPTプラン同梱 or APIキー従量の二択
Devinあり(Free)Pro 月20ドル/ Max 月200ドルTeams 月80ドル〜個別見積(ACU課金・データ取り扱い条件あり)セッション・CLI・Desktopでクォータ共用

※ 金額は各公式料金ページ記載のドル建て価格です(参照日: 2026-09-06)。キャンペーン・為替・含まれる利用量は変動するため、契約前に必ず公式ページで最新を確認してください。

コスト設計の実務的なコツ: 「全員に一番高いプラン」は無駄が出ます。研修先でよく提案するのは——(1) 補完中心の人はCopilot Pro/Business(安価で十分) (2) コードベース横断の作業を多用する人だけCursor/Claude Codeの上位プラン (3) 定型タスクの大量消化が必要なチームだけDevinを試験導入、という”傾斜配分”。最初から統一せず、3か月の利用ログを見てから本決定するのが結局いちばん安く済みます。

トライアル後の解約手順はツールごとに癖があります(例: Cursorの解約手順ガイド)。検証終了日は先に決めておきましょう。

用途別おすすめ早見表(推奨マトリクス)

あなたの状況 / 用途第一候補第二候補理由
個人開発者・副業エンジニアCursorClaude Code学習コストほぼゼロで即戦力。重い自動化をやりたくなったらClaude Codeを足す
個人で「自動化・スクリプト・CI」を多用する人Claude CodeCodex CLICLIネイティブで他ツールと組みやすい。OpenAI主体ならCodex CLI
スタートアップ(〜10名、スピード最優先)CursorClaude Code全員すぐ使える。コードベース横断作業が増えたらClaude Codeを併用
スタートアップ(人を採れず定型タスクが溜まっている)Devin(試験導入)Claude Code定型タスクをDevinに回し、人はレビューと設計に集中。ただし分解設計が前提
中小企業の情シス主導(統制重視・GitHub利用中)GitHub Copilot(Business)Cursor(Team)調達・監査・SSOが最短。先進チームだけCursorを試す二段構え
大企業(コンプライアンス・監査が厳しい)GitHub Copilot(Enterprise)Cursor / Claude Code(Enterprise)組織ポリシー・監査・データ取り扱いの成熟度。部門別に他製品をPoC
大規模リファクタ・レガシー移行を回したいClaude CodeDevin / Cursorコードベース横断の自律作業に強い。量で押すならDevin、IDEで詰めるならCursor
JetBrains(IntelliJ等)が主戦場GitHub CopilotClaude Code(JetBrains拡張)VS Codeフォーク系(Cursor/Windsurf=現Devin Desktop)は合わない。拡張型を選ぶ
OSS・透明性・ローカル制御を重視Codex CLIClaude Code本体OSSで挙動が追える。安全装置(承認モード・サンドボックス)も明示的

事例区分: 想定シナリオ
以下も実在企業の事例ではなく、研修・導入支援で見た典型をもとにした想定シナリオです。数値は推計です。

従業員30名の受託開発B社(仮)。情シスはおらず、テックリードが導入判断。最初に「全員Cursor Pro」で始めたが、CI・デプロイスクリプト・運用ツールを書く2名から「ターミナルで完結したい」と要望が出て、その2名だけClaude Codeを追加。さらに、依存ライブラリの一括更新が毎四半期の重荷だったので、Devinを1シートだけ試験契約して、その作業を回すように。結果、ツールは「Cursor(全員)+ Claude Code(基盤2名)+ Devin(定型タスク用1枠)」という構成に。”統一”はしなかったけれど、役割と作業内容に紐づいているので、誰も不満を言わない——これが現実的な落としどころとして一番うまくいったパターンでした。

社内導入で必ず確認する4つのチェックポイント

研修・相談で「とりあえず入れちゃいました」の後始末を何度も見てきたので、配る前に必ずこれを確認してください。AIガバナンス全般の考え方はAI導入戦略の体系ガイドも参照してください。

社内導入前に確認する4点(権限境界、サンドボックス・実行範囲、監査ログ・組織ポリシー、学習利用オプトアウト)を通過させる検査の流れ図
配る前にこの4点を確認します。最初は厳しめ(提案のみ)から始めて、慣れたら緩めるのが安全です。
  1. 権限境界(許可制): ファイル書き込み・コマンド実行・外部通信を「都度承認」にできるか。最初は厳しめ(提案のみ)から始めて、慣れたら緩める。Claude Code・Codex CLI は許可制が細かい。Devin は隔離環境で動くのでローカルに直接触れない(=別の意味で安全)。
  2. サンドボックス / 実行範囲: 対象ディレクトリをリポジトリ配下に限定できるか。ホーム配下・本番設定・認証情報に触れない構成にする。
  3. 監査ログ・組織ポリシー: 誰が・いつ・どのリポジトリで使ったかを把握できるか。Business/Enterpriseプランの管理機能を必ず使う。「個人契約の私物ツールが社内コードを読んでいる」状態を放置しない。
  4. ソースコードの学習利用オプトアウト: 自社コードがモデル学習に使われない設定・プランか。GitHub Copilot Business/Enterprise、Cursor Privacyモード、各社のEnterprise契約条件を確認。曖昧なら法務に通す。

この4点の一次情報は、各製品が公開している公式のセキュリティ/データ取り扱いページです(参照日2026-08-30)。

【要注意】ツール選びでよくある失敗パターンと回避策

失敗1:「人気だから」で1製品に全社統一しようとする

❌ 「Cursorが流行ってるから全員Cursorで統一」
⭕ 「補完中心の人・横断作業の人・自動化の人で必要なものが違う。3か月はトライアルで併用させ、利用ログを見てから傾斜配分する」

なぜ重要か: AIコーディングエージェントは”個人の作業スタイル”に強く依存します。無理に統一すると、合わない人の生産性が落ちて、結局シャドーIT(私物ツールの隠れ利用)に逆戻りします。研修先で「統一を強行→3か月後に半数が私物Claude Codeを使っていた」という例を実際に見ました。

失敗2:エージェントの権限を最初から全開にする

❌ いきなり「ファイル編集もコマンド実行も自動承認」で配る
⭕ 「最初は提案のみ+コマンドは都度承認。1〜2週間運用して問題なければ段階的に緩める」

なぜ重要か: 自律性が高いほど便利ですが、慣れていないチームがいきなり全開で使うと「テスト全部消された」「設定ファイル壊された」が起きます。事故が1回起きると組織全体が萎縮して導入が止まる。最初の保守的設定が、結果的に普及を早めます。

失敗3:Devinに「丸投げ」して空回りする

❌ 「曖昧な要件をそのまま投げて、賢く解決してくれることを期待する」
⭕ 「ゴール・スコープ・受け入れ条件・不明点の扱いを明記したタスクに分解してから投げる」

なぜ重要か: フルマネージド自律エージェントは「優秀だが文脈を持たない新人」に近い。指示が曖昧だとPRも曖昧になり、レビュー時間が逆に増えます。料金も高めなので、空回りはそのままコスト増。「分解力がチームにあるか」を導入前に見極めてください。

失敗4:日本語UIの有無で判断してしまう

❌ 「UIが英語だからうちのメンバーには無理」
⭕ 「指示も出力も日本語で問題なく通る。UIの英語はメニュー数語レベルなので、最初の30分のレクチャーで吸収できる」

なぜ重要か: 6製品とも日本語での指示・回答は実用十分です。UIが英語というだけで候補から外すと、本当に必要な機能(権限制御・MCP・チーム管理)で妥協することになります。判断軸を「UIの言語」ではなく「ワークフローとセキュリティ」に置いてください。

結局どう決めるか — 3ステップの意思決定フロー

  1. 「手放したい工程」を決める: 補完だけ → Copilot。コードベース横断の編集・リファクタも → Cursor / Windsurf(現Devin Desktop) / Claude Code。CI・自動化スクリプトも → Claude Code / Codex CLI。タスク丸ごとPRまで → Devin。
  2. 制約条件でフィルタする: GitHub中心&統制重視 → Copilot。JetBrains主戦場 → Copilot or Claude Code拡張。OSS・透明性重視 → Codex CLI。情シスが法務通過を最優先 → Copilot Business/Enterprise。
  3. 2製品に絞ってトライアル: 個人なら Cursor+Claude Code。スタートアップなら Cursor+(必要なら)Devin。中小企業なら Copilot Business+(先進チームで)Cursor。3か月、利用ログとレビュー時間の変化を見て本決定。

よくある質問(FAQ)

無料で使えるAIコーディングエージェントはありますか?

あります。2026年9月時点で、GitHub Copilot Free、Cursor Hobby、Devin Free、ChatGPTの無料プラン、OSSのCodex CLI本体が無料で始められます。Claudeの無料プランはチャット向けで、公式のプラン比較表ではClaude CodeはProプラン以上の機能として案内されています。ただし無料枠は実行量制限が厳しく、確認できるのは「操作感」まで。個人向け有料は月10〜20ドルに集中しており、実務評価はこの価格帯で1か月行うのが現実的です。

非エンジニアでもコーディングエージェントは使えますか?

使えます。Cursorの節でも触れたとおり、研修ではQA・PdMなど非エンジニア寄りの職種でも受け入れが速く、資料作成やデータ集計の自動化に使う例も増えています。権限は読み取り中心+変更は都度承認から。始め方は非エンジニアのためのClaude Code完全ガイドにまとめています。

法人導入で最初に試すべきコーディングエージェントはどれですか?

GitHub利用中で統制重視ならGitHub Copilot Business、生産性の伸びしろを測る実験ならCursor+Claude Codeの2本併用トライアルが定石です(判断手順は上の意思決定フロー参照)。ツール選定と同じくらい効くのが使い方の共通言語化で、教育・ガイドライン整備を含む進め方はClaude Code企業研修の完全ガイドで解説しています。

ローカルLLMでコーディングエージェントを動かせますか?

構成上は可能です。ただしローカル規模のモデルとクラウド最上位モデルでは自律実行の安定性に差が出やすく、「補完・下書きはローカル、重い作業はクラウド」の併用が2026年9月時点では現実的です(構成例: Ollamaとは?使い方・モデル選び・Claude Code連携)。

まとめ:今日から始める3つのアクション

  1. 今日やること: この記事の「総合スペック比較表」と「用途別早見表」を見ながら、自社の状況に当てはまる行を3つマークし、第一候補・第二候補をメモする。そのうち1つは今日のうちにトライアル/無料枠の申請まで進める。
  2. 今週中: チームの2〜3名で2製品を1週間使い分け、「どの工程が楽になったか」「どこで詰まったか」を共有メモに書き出す。同時に、社内導入の4チェックポイント(権限境界・サンドボックス・監査ログ・学習利用オプトアウト)を情シス/法務と確認開始。
  3. 今月中: 利用ログをもとに「傾斜配分案」(誰にどのプランを配るか)をドラフト化。3か月後に本決定するスケジュールと、効果測定の指標(PRレビュー時間、リードタイム、満足度アンケート)を決めておく。

あわせて読みたい:


著者: 佐藤傑(さとう・すぐる)
株式会社Uravation代表取締役。X(@SuguruKun_ai)フォロワー約10万人。100社以上の企業向けAI研修・導入支援。著書『AIエージェント仕事術』(SBクリエイティブ)。SoftBank IT連載7回執筆(NewsPicks最大1,125ピックス)。

ご質問・ご相談は お問い合わせフォーム からお気軽にどうぞ。

参考・出典

この記事の内容を社内展開する方へ: AIエージェント導入・安全運用チェックリスト(無料・PDF 30ページ+Excel) をダウンロードできます。

佐藤傑
この記事を書いた人 佐藤傑

株式会社Uravation 代表取締役CEO/生成AIエバンジェリスト。法人向けAI研修・コンサルティングを手がけ、日経・SBクリエイティブ・GMO等のメディアで生成AIについて執筆。

執筆・監修:佐藤傑/下書き・図版・機械検査:当社のAI社員(人が確認してから公開しています)。記事の作り方と検査の方針

この記事をシェア

Contact お問い合わせ

30分の無料相談では、いま時間を取られている業務を伺い、稼働中のAI社員62体の事例の画面と一緒に近い進め方をお見せします。
売り込みはしません。

Claude Code 個別指導(1対1・12セッション)をご希望の方はこちら、Codex 個別指導はこちらから別途お申し込みください

Claude Code 個別指導 無料相談