2026年のおすすめAIコーディングエージェント:自律度と適合性で選ぶ14ツール

Turn this article into takeaways for your work.
Each assistant summarizes the article only for you and suggests best practices for your work.
既存のワークフローの中でターミナルネイティブのエージェントを使いたいチームには Claude Code と OpenAI Codex が最有力です。すでに GitHub を使い込んでいるなら、GitHub Copilot のコーディングエージェントが最短ルートになります。Devin は、会議中でも作業を進めてくれる、完全自律型のエンジニアに最も近い存在です。そして Cursor は、IDE 内で動く監督付きエージェントとして最も洗練されています。このガイドでは、14のAIコーディングエージェント(計画、編集、実行、そして多くの場合はコードの出荷までを、定期的な監督だけで複数ステップにわたって進めるツールです。関連ガイドで扱っているインライン補完とは別物です)を、自律レベル、実行環境、コンテキスト戦略、検証済みのベンチマーク性能、レビューワークフロー、実際の料金で順位付けしました。料金は2026年8月にベンダーの料金ページで確認しています。
「おすすめAIコーディングエージェント」をうたう記事の多くは、2つの異なる製品カテゴリを混同しています。文の続きを補完するオートコンプリートのプラグインと、チケットを最後まで片付ける自律型エージェントです。ベンチマークのスコアや機能チェックリストよりも、この区別こそが候補選びの軸になるべきです。エンジニアリングの時間をどれだけ取り戻せるか、そしてコードベースにどれだけの無監督アクセスを与えるかが、この区別で決まるからです。
2026年8月更新:変更点
- Windsurf は2026年6月2日に正式に Devin Desktop となりました。 Cognition は買収した IDE を Devin ファミリーに統合し、Cascade は Devin Local になりました。windsurf.com/pricing は Devin の料金ページにリダイレクトされます。従来の Cascade は2026年7月1日まで稼働していました。
- Roo Code は2026年5月15日にサービスを終了しました。 VS Code 拡張機能、クラウド、ルーターはすべて終了し、Slack ファーストのクラウドエージェント Roomote に移行しましたが、まだ開発の初期段階です。このためリストから外しています。
- Sweep は動きが止まっています。 2026年2月5日のバージョン 1.29.3 以降、リリースがありません。開発が再開されるまでリストには含めていません。
- Cognition は2026年4月14日に Devin のセルフサーブ料金を刷新しました。 旧 Core プランと Team プランを廃止し、Free、Pro、Max、Teams、Enterprise というシンプルな体系になりました。
- GitHub Copilot は2026年6月1日に、使用量ベースの「GitHub AI Credits」課金へ移行しました。 プレミアムリクエストの割り当て方式に代わるものです。インライン補完は引き続き無制限で、エージェント機能はクレジットを消費します。
- OpenAI は2026年4月2日に、メッセージ単位の Codex 料金を廃止し、トークンベースのクレジットに切り替えました。また2026年6月24日から、ChatGPT Business ワークスペースへの新規 Codex シートの提供を停止しました。
- Google Jules は2026年5月19日の Google I/O で一般提供(GA)に達しました。 2026年3月の公開ベータを経てのことです。
重要なポイント
- AIエージェントの「タスクホライズン」、つまりモデルが50%の信頼性で自律的に完了できる作業の長さは、2023年後半以降、およそ4.3か月ごとに倍増しています(METR の time horizon 研究による)。
- 実際のソフトウェアエンジニアリング修正の標準ベンチマークである SWE-bench Verified では、トップモデルのスコアが1年で約60%からほぼ100%に上昇しました(Stanford HAI の 2026 AI Index Reportによる)。
- コーディングエージェントの採用率は、2025年8月以降に作成された新規 GitHub プロジェクトの71.8%から76.2%に達し、それ以前のプロジェクトの26.5%の2倍以上でした。14万を超えるリポジトリを対象とした大規模調査で、arXiv 経由で公開されています。
- CLI ベースのコーディングエージェントを導入したエンジニアは、導入しなかった場合と比べて、マージしたプルリクエストが約24%多くなりました。Claude Code と GitHub Copilot CLI を使う数万人の Microsoft エンジニアを対象にした4か月間の調査で、arXiv で公開された研究によるものです。
- これほど能力が向上しても、エージェントが実際のコンピュータ操作ベンチマークで66%の成功率を超えているにもかかわらず、企業でのエージェント導入は、ほとんどの業務部門で依然として一桁台にとどまっています(同じ Stanford AI Index による)。
エージェント型コーディングとAIコーディングアシスタント:このリストが違う理由
AIコーディングアシスタントは、文の続きを補完します。AIコーディングエージェントは、チケットを片付けます。この違いは、想定外のクレジット請求や、誰もレビューしなかったプルリクエストに初めて直面する前には、多くの購入者が思う以上に重要です。

インライン補完、Tab オートコンプリート、サイドパネルのチャットは、入力中の数行先を予測します。確かに便利で、2026年のおすすめAIコーディングツールでは14製品を取り上げています。このガイドが扱うのは別のクラスです。タスクを受け取り、計画を立て、複数のファイルを編集し、テストやコマンドを実行し、場合によっては誰もキー入力を見ていなくてもプルリクエストを開くエージェントです。正式な定義については、AIエージェントとは?をご覧ください。以下のツールはいずれも、定期的な人の入力だけで複数ステップを計画し実行するという基準を満たす必要がありました。そのため、実際にはエージェントの看板を掲げたアシスタントにすぎない、よく知られた名前がいくつも除外されています。
比較早見表
| ツール | 最適な用途 | 自律レベル | 実行環境 | 開始価格 |
|---|---|---|---|---|
| Claude Code | 長時間のターミナルセッション、リポジトリの深い作業 | 長時間の自律セッション | ターミナル、IDE 拡張機能 | 無料(閲覧のみ)、エージェント利用は月額$20 |
| GitHub Copilot | すでに GitHub を使い込んでいるチーム | 監督付きから完全非同期まで | IDE、GitHub クラウド(Actions) | 無料(エージェントなし)、月額$10で利用可能 |
| Cursor | 監督付きマルチファイル IDE エージェントの最高峰 | 監督付き、非同期クラウドエージェントあり | スタンドアロン IDE | 無料(Hobby、制限あり)、月額$20 |
| OpenAI Codex | OpenAI スタック、CLI からクラウドタスクまで | 長時間セッションから完全非同期まで | CLI、IDE、ChatGPT クラウド | 無料(ChatGPT Free)、月額$20(Plus) |
| Devin | 完全自律で任せきりの作業 | 完全非同期 | クラウド(専用のサンドボックス VM) | 無料(制限あり)、月額$20(Pro) |
| Windsurf (Devin Desktop) | Devin チームの IDE エージェント | 監督付き | スタンドアロン IDE | 無料、月額$20(Devin Pro) |
| Google Jules | Gemini と連携する無料の非同期エージェント | 完全非同期 | クラウド VM | 無料(1日15タスク)、月額$19.99(Pro) |
| Replit Agent | アプリ全体の構築と公開 | 完全非同期(Replit 内) | クラウド IDE | 無料(Starter)、月額$25(Core) |
| Factory | コーディングを超えたエンタープライズ SDLC のカバー | 監督付きから完全非同期まで | CLI、IDE、クラウド | 無料プランなし、月額$20(Pro) |
| Amp | 個人開発者向け、Sourcegraph の系譜 | 長時間の自律セッション | CLI、IDE 拡張機能 | 無料プランあり、月額$20(Megawatt) |
| Cline | 無料で最高峰の、自前キー持ち込み型エージェント | 監督付き(Plan/Act) | IDE 拡張機能 | 無料(オープンソース) |
| Aider | 元祖ターミナルエージェント、完全無料 | 監督付き、git ネイティブ | ターミナル | 無料(オープンソース) |
| OpenHands | オープンソースでセルフホスト可能なフレームワーク | 長時間セッションから完全非同期まで | ローカルサンドボックス、クラウド | 無料(オープンソースまたはクラウド) |
| Warp | インフラ中心の作業向けのエージェント型ターミナル | 監督付き | スタンドアロンターミナル | 無料、月額$20(Build) |
自律レベル:実際にどこまで任せられるか
「最高のAIコーディングエージェント」という言葉には、実は幅広い違いが隠れています。編集のたびに目を配る必要があるツールもあれば、チケットを受け取って1時間無人で作業し、完成したプルリクエストを渡してくれるツールもあります。まず自律レベルで分類してください。エンジニアリングの時間をどれだけ取り戻せるかを実際に決めるのは、そこだからです。
| 段階 | 意味 | 人の役割 | 代表的なツール |
|---|---|---|---|
| 監督付き、対話型 | 承認ゲートを挟みながらステップごとに編集 | 各ステップを承認する | Cursor、Copilot エージェントモード、Windsurf/Devin Desktop、Cline、Aider、Warp |
| 長時間の自律セッション | 自分で開始した1回のセッションで、多くのステップを無人で実行 | 良いプロンプトを書き、途中で確認する | Claude Code、Codex(CLI/IDE)、Amp、Factory(CLI/IDE)、OpenHands(ローカル) |
| 完全非同期、任せきり | クラウドのサンドボックスで、PR を開くまで無人で実行 | 完成した PR をレビューする | Devin、Jules、Copilot コーディングエージェント、Codex クラウドタスク、Replit Agent、Factory(クラウド)、OpenHands Cloud |
複数の行にまたがる製品があるのは意図的です。Copilot、Codex、Factory はいずれも、エディタ内の監督付きモードと、独立した非同期クラウドモードを1つのサブスクリプションで提供しています。つまり自律性は固定された特性ではなく、どのモードを有効にするかの問題です。
これらのエージェントの実行場所とコードベースの扱い方
エージェントがどこで実行されるかによって、大規模で見慣れないコードベースをどこまで任せられるかが変わります。作業ツリーを読み込むターミナルエージェントは、新しいクローンで作業するクラウドエージェントや、セマンティックインデックスに頼る IDE エージェントとは振る舞いが異なります。
| ツール | 主な利用環境 | コンテキストとリポジトリ規模への対応 |
|---|---|---|
| Claude Code | ターミナル / CLI | エージェント検索(grep、glob、read)、事前構築のインデックスなし |
| GitHub Copilot | IDE(VS Code、JetBrains、Visual Studio) | リポジトリのインデックス化とコード検索、コーディングエージェントはライブのチェックアウトを探索 |
| Cursor | スタンドアロン IDE | 埋め込みベースのセマンティックインデックス、ファイルの変更に合わせて更新 |
| OpenAI Codex | CLI、IDE 拡張機能、ChatGPT クラウド | クラウドタスクはリポジトリをサンドボックスにクローン、CLI はツリーを直接読み込み |
| Devin | クラウド(専用 Web アプリ) | 永続的な DeepWiki インデックスと、モノレポ向けの Devin Search |
| Windsurf (Devin Desktop) | スタンドアロン IDE | 元の Cascade エンジンによる深いローカルインデックス |
| Google Jules | クラウド VM | リポジトリを VM にクローンし、Gemini の長いコンテキストを活用 |
| Replit Agent | クラウド IDE(Replit ワークスペース) | Replit ワークスペース内に限定、外部のモノレポは対象外 |
| Factory | CLI、IDE、デスクトップ、クラウド | 専用の Knowledge Droid がコードベースのコンテキストを維持 |
| Amp | CLI、IDE 拡張機能 | 「制限のないコンテキスト」に加え、難問向けの Oracle サブエージェント |
| Cline | IDE 拡張機能 | 開いているファイルと MCP ツール、独自のインデックスなし |
| Aider | ターミナル / CLI | Tree-sitter によるリポジトリマップ、ファイルを読み込む前のシンボルレベルの俯瞰 |
| OpenHands | ローカルサンドボックス、クラウド | サンドボックス内のシェルとファイルツール、Claude Code の手法と同様 |
| Warp | スタンドアロンターミナル | ターミナルとファイル履歴の把握、インデックスはプランに応じて拡大 |
検証済みのベンチマーク性能
Cursor や GitHub Copilot のようなツールに単一のベンチマークスコアを割り当てている記事には、懐疑的になってください。IDE や CLI のエージェントの多くはモデル非依存のハーネスです。Claude、GPT、Gemini のいずれを接続しても、その上限は選んだフロンティアモデルで決まり、製品自体が獲得した数字ではありません。独自の専用モデルを持ち、独立して報告されたスコアがあるのは、ごく一部です。
| ツール | ベンチマークの指標 | 出典と日付 |
|---|---|---|
| Claude Code | Opus 5/Sonnet 5 を実行、フロンティア層で SWE-bench Verified 96〜97% | SWE-bench Verified リーダーボード、2026年8月中旬 |
| GitHub Copilot | モデル非依存(GPT、Claude、Gemini)、上限は選択したモデルに連動 | 上記と同じフロンティアの範囲 |
| Cursor | モデル非依存、Cursor 独自のハーネスの独立スコアなし | 該当なし |
| OpenAI Codex | GPT-5.x-Codex を実行、OpenAI は現在より難しい SWE-bench Pro を参照 | OpenAI、2026年 |
| Devin | 独自の SWE-1.7:Terminal-Bench 2.1 で 81.5%、SWE-bench Multilingual で 77.8% | Cognition のレポート、2026年7月8日 |
| Windsurf (Devin Desktop) | サードパーティモデルと並んで同じ SWE-1.7 を選択可能 | 上記の Devin を参照 |
| Google Jules | Gemini 3 Pro を実行、上限は Google のフロンティアの結果に連動 | 該当なし |
| Replit Agent | 独立したスコアなし、アプリ構築タスクで社内ベンチマークを実施 | 該当なし |
| Factory | 独立して公表されたスコアなし | 該当なし |
| Amp | モデル非依存、独立スコアなし | 該当なし |
| Cline | モデル非依存、独立スコアなし | 該当なし |
| Aider | 代わりに独自の公開 polyglot コーディングベンチマークを運営 | Aider polyglot ベンチマーク |
| OpenHands | Claude Opus 4.5 使用時:SWE-bench Verified で 77.6%(pass@3) | OpenHands プロジェクトの結果、2026年 |
| Warp | モデル非依存、独立スコアなし | 該当なし |
料金モデル:チームが驚きやすいポイント
上記の「月額料金」の裏には、3つの料金の考え方が隠れています。これらを混同すると、予算が見込みを大きく超えてしまいます。シート単位の課金は、1人あたりのコストに上限を設けます。使用量またはクレジットベースの課金は、エージェントがどれだけ働くかに応じて増えます。1回の長い実行が1週間分の割り当てを午後だけで使い切るまでは問題ありません。自前キー持ち込み型のツールは、推論コストのすべてをモデルプロバイダーに回します。

| ツール | 料金モデル | チームが驚く点 |
|---|---|---|
| Claude Code | サブスクリプション(共有のトークン予算)または API 従量課金 | 通常のチャット利用と同じ枠を共有する |
| GitHub Copilot | シート単位に加え、2026年6月から使用量クレジット | エージェントモードとコーディングエージェントはクレジットを急速に消費する |
| Cursor | シート単位に加え、ドル建てのクレジットプール | 上位プランは新機能ではなく、より大きなクレジットプール |
| OpenAI Codex | ChatGPT のプランに含まれ、2026年4月からトークンクレジット | 1回の長い実行で多くのクレジットを一度に消費することがある |
| Devin | サブスクリプションに加え ACU による従量計測 | 大きなタスクでは1 ACU(約15分)がすぐになくなる |
| Windsurf (Devin Desktop) | 同じ Devin のサブスクリプション体系 | ローカル IDE の利用もクラウドエージェント同様に課金される |
| Google Jules | Google AI Pro または Ultra のサブスクリプションに含まれる | エージェント専用のシートではなく、Gemini のプランを購入することになる |
| Replit Agent | 月額のプリペイドクレジット | クレジットはコンピュートとエージェント呼び出しの両方に使われる |
| Factory | シート単位に使用量倍率のプラン | SSO とオンプレミスは Business/Enterprise のみ |
| Amp | サブスクリプションのクレジットプールまたは従量課金 | サードパーティのサブスクリプション連携は1人2件まで |
| Cline | プラットフォームは無料、推論は自前キー持ち込み | Sonnet クラスを多用すると1日$5〜$30かかる |
| Aider | 完全に自前キー持ち込み | プラットフォーム料金はゼロだが、推論コストは自己負担 |
| OpenHands | 無料のセルフホストまたはクラウド、推論は原価 | エンタープライズ機能(RBAC、SSO)は見積もり制 |
| Warp | シート単位にクレジット | 1回の長いセッションで月間クレジットの大部分を消費することがある |
人を関与させ続ける:レビューと安全のワークフロー
自律レベルが高いほど、レビューワークフローは重要になります。何かがプルリクエストを無人で開く前に、最初の編集から本番ブランチまでの間に何が立ちはだかっているのかを把握しておきましょう。
| ツール | 人が主導権を保つ方法 |
|---|---|
| Claude Code | プランモードでアプローチを事前に確認、ファイル書き込み、コマンド、ネットワークアクセスは権限プロンプトで制御 |
| GitHub Copilot | コーディングエージェントは GitHub Actions 内でサンドボックス化され、リポジトリは読み取り専用、CI/CD の実行前に承認が必要 |
| Cursor | 編集はレビュー可能な diff としてストリーミングされ、バックグラウンドエージェントは直接プッシュせず PR を開く |
| OpenAI Codex | クラウドタスクは隔離されたネットワーク制限付きコンテナで実行、すべての変更は diff または PR として届く |
| Devin | セッションごとに専用のサンドボックス VM、人が見る前に Devin Review が PR を批評 |
| Windsurf (Devin Desktop) | エディタ内でのステップごとの承認、Cursor と同じ操作モデル |
| Google Jules | 隔離されたクラウド VM、PR を開く前に完全な diff と推論ログを表示 |
| Replit Agent | マイルストーンごとのチェックポイントにより、次のステップを承認する前にロールバック可能 |
| Factory | Droid は破壊的な操作の前に確認し、Reliability Droid は本番環境への変更をエスカレーション |
| Amp | スレッドは共有・監査可能、Smart Mode ではゼロデータ保持を追加 |
| Cline | Plan/Act の分離により、Act モードが何かに触れる前に明示的な承認ステップが必須 |
| Aider | すべての変更がメッセージ付きの個別の git コミット、取り消しは単純な git revert |
| OpenHands | 使い捨ての Docker サンドボックス内で実行、ホストマシンには直接何も触れない |
| Warp | Agent Mode は複数ステップの計画で、各コマンドの前に承認を求める |
1. Claude Code:リポジトリへの理解が最も深いターミナルネイティブのエージェント
Claude Code は Anthropic のターミナルネイティブなコーディングエージェントです。事前構築のインデックスではなくエージェント検索でリポジトリを読み込むため、インデックス化されたことのないコードベースでも問題なく動作します。プランモードではファイルに触れる前にアプローチを示し、コードの作成、テストの実行、失敗の修正、結果の報告までを、ほぼ無人の長時間セッションで進めます。
VS Code と JetBrains にはサイドパネルとして統合できますが、設計上ターミナルが主役です。サブエージェントは、テストの作成などのサブタスクを別のコンテキストに委任します。トレードオフは、Devin や Jules のようにプルリクエストを非同期で開くことはないため、ある程度は常に作業に関わる必要がある点です。
| 得られるもの | 得られないもの |
|---|---|
| インデックス化の手順なしで、git とリポジトリを深く理解 | 完全非同期の、放置できるクラウドモードは標準では未搭載 |
| 実際の制御を可能にするプランモードと権限プロンプト | 利用量が通常の Claude チャット利用と同じ予算を共有する |
| 普段使っているターミナルの中で動作し、IDE サイドパネルにも対応 | CLI 中心のワークフローに慣れている必要がある |
| サブタスクを並列化するサブエージェント | Team/Enterprise のシート料金は、大きな組織では高額になる |
料金: Free には Claude Code は含まれません。Pro は年払いで月額$17、月払いで月額$20です。Max プランは月額$100から(5倍の利用量)で、その上にさらに利用量の多い20倍のプランがあります。Team は請求方法に応じて1シートあたり月額$20〜$25で、1シートあたり月額$100のプレミアムシートも選べます。Enterprise はカスタムで、シート料金に加えて利用量に応じて課金されます。出典:claude.com/pricing。
最適な用途: ターミナルを中心に作業し、長く複雑なセッションのために git とコードベースへの最も深い理解を求めるエンジニアリングチーム。
2. GitHub Copilot(エージェントモードとコーディングエージェント):GitHub を使い込んでいるならデフォルトの選択肢
GitHub Copilot のエージェント機能は、1つのブランドの下で2つの製品として提供されます。エージェントモードは VS Code、JetBrains、Visual Studio の中で動作します。変更内容を説明すると、複数のファイルを編集し、あなたが見ている間に、承認を得てコマンドを実行します。コーディングエージェントは別物です。GitHub の Issue を割り当てると、GitHub Actions のサンドボックス内で非同期に作業を進め、コードの作成、テストの実行、レビュー用タグ付きのプルリクエストのオープンまでを、手元のエディタを開かずに行います。

どちらのモードも、このリストの中で最も深い GitHub ネイティブの統合の恩恵を受けられます。チームがすでに GitHub で標準化しているなら、これは強力な利点です。エージェントの深さとプライバシーで順位付けしたその他の選択肢は、GitHub Copilot の代替ツールをご覧ください。注意点は、2026年6月以降、チャット、エージェントモード、コードレビュー、コーディングエージェント、CLI の利用がすべて、共有の月間 AI Credits の割り当てから差し引かれることです。インライン補完は引き続き無制限です。
| 得られるもの | 得られないもの |
|---|---|
| 監督付きのエディタ内エージェントと、完全非同期で PR を開くクラウドエージェントの両方 | エージェント機能は、上限のある共有クレジットの割り当てを消費する |
| コーディングエージェントはサンドボックス化され、デフォルトで読み取り専用の実行 | Free プランではエージェントを一切利用できない |
| ここにあるツールの中で最も深い、GitHub ネイティブの Issue から PR までのワークフロー | クレジット制(2026年6月)は新しく、利用量の予測は試行錯誤になる |
| 人が見る前に Copilot が PR を自動レビュー | Business/Enterprise の料金は、細かい条件について営業との相談が必要 |
料金: Free は$0でエージェントは利用できません。Pro は月額$10で、コーディングエージェントを利用できます。Pro+ は月額$39で、プレミアムモデルを利用できます。Max は月額$100で、継続的な重いエージェントワークフロー向けです。Business は1シートあたり月額$19、Enterprise は1シートあたり月額$39です。すべての有料プランに AI Credits の割り当て(1クレジットあたり$0.01)が含まれ、インライン補完がクレジットを消費することはありません。出典:github.com/features/copilot/plans および GitHub Docs。
最適な用途: すでに GitHub で標準化しており、監督付きのエディタ内エージェントと、完全自律の Issue から PR までのクラウドエージェントの両方を、同じベンダーから利用したいチーム。
3. Cursor:IDE 内で最高の監督付きマルチファイルエージェント
Cursor は、AI ファーストの VS Code フォークとして評価を築き、そのエージェントモードは今でも他の IDE エージェントが比較される基準になっています。変更内容を平易な言葉で説明すると、複数のファイルにわたって計画を立て、編集し、承認を得てターミナルコマンドを実行し、反映する前に diff を表示します。クラウドのバックグラウンドエージェントはさらに進んでいます。タスクを開始して別の作業を続けると、完了時に PR を開きます。Devin の完全非同期モデルに最も近い、Cursor の手段です。
コードベースのインデックスは埋め込みベースで、作業に合わせて更新されます。Bugbot は、使用量課金の自動レビューを加えます。IDE ファーストのその他の選択肢は、Cursor の代替ツールをご覧ください。料金には注意してください。すべての有料プランはドル建てのクレジットプールで、Pro+ の「3倍」と Ultra の「20倍」は新機能ではなく、利用量の余裕を表しています。
| 得られるもの | 得られないもの |
|---|---|
| IDE 内で最も成熟した、監督付きマルチファイルエージェントの体験 | すべての機能を使うには、既存のエディタを離れて Cursor のフォークに移る必要がある |
| 大規模リポジトリにも対応する、埋め込みベースのコードベースインデックス | 上位プランが加えるのは新機能ではなく、利用量の余裕 |
| より軽量な非同期モードとしてのクラウドバックグラウンドエージェント | 使用量ベースの超過分が、定額の月間予算を上回ることがある |
| Teams と Enterprise での SAML/OIDC SSO と監査ログ | Enterprise の料金は営業との相談が必要 |
料金: Hobby は無料で、エージェントのリクエストは制限付きです。Pro は月額$20、Pro+ は月額$60(Pro の3倍のエージェント上限)、Ultra は月額$200(20倍)です。Teams Standard は1ユーザーあたり月額$40で、その上に5倍の Premium プランがあります。Enterprise はカスタムです。出典:cursor.com/pricing。
最適な用途: 専用 IDE の中で最も洗練された監督付きエージェントの体験を求め、必要なときには非同期のクラウドオプションも使いたい開発者とチーム。
4. OpenAI Codex:ローカル CLI から完全非同期のクラウドタスクまで
OpenAI の Codex は、単一の製品というより、ChatGPT の中にある自律度のダイヤルです。CLI や IDE 拡張機能では、Claude Code と同じように、ほぼ無人のローカルの長時間セッションとして動作します。クラウドでは、chatgpt.com やモバイルアプリからタスクを割り当てると、Codex がリポジトリをクローンした隔離コンテナを起動し、独立して作業を進め、diff またはプルリクエストを返します。ローカルセッションは不要です。
すでに ChatGPT のシートに支払っているチームにとっては、この幅の広さが魅力です。1つのサブスクリプションで、素早いローカル修正から、GPT-5.x-Codex モデルファミリーによる無人のクラウドタスクまでを賄えます。料金は2026年に2回変わりました。メッセージ単位の課金は廃止され、4月2日にトークンベースのクレジットに置き換わり、6月24日からは新規の ChatGPT Business ワークスペースへの Codex シートの提供が停止しました。
| 得られるもの | 得られないもの |
|---|---|
| 1つのサブスクリプションで、ローカル CLI セッションから完全非同期のクラウドタスクまでをカバー | トークンベースのクレジット(2026年4月以降)により、定額制よりコストの予測が難しい |
| 長時間のツール利用セッション向けに作られた GPT-5.x-Codex モデル | 2026年6月24日以降、新規の ChatGPT Business ワークスペースは Codex シートを追加できない |
| クラウドタスクはデフォルトでネットワークアクセスなしの隔離環境で実行 | OpenAI はこのモデルファミリーの SWE-bench Verified スコアを公表しなくなった |
| Web、CLI、IDE 拡張機能、iOS で利用可能 | Enterprise/Edu の料金は見積もりのみ |
料金: Free は$0です。Go は月額$8です。Plus は月額$20で、含まれる利用量を使い切った後は柔軟にクレジットを購入できます。Pro は月額$100(Plus の5倍の上限)または月額$200(20倍)です。Business は1ユーザーあたり年払いで月額$20、月払いで月額$25、最低2シートです。Enterprise と Edu はカスタムです。出典:learn.chatgpt.com/docs/pricing。
最適な用途: すでに ChatGPT で標準化しており、素早いローカル修正と完全自律のクラウドタスクの両方を1つのサブスクリプションでカバーしたいチーム。
5. Devin:完全自律型エンジニアに最も近い存在
Devin は「AIソフトウェアエンジニア」という言葉を真剣に受け止められるものにした製品で、今でも完全非同期レベルの最も明確な例です。Slack、Linear、または専用の Web アプリからタスクを渡すと、専用のサンドボックス VM を起動し、作業を計画し、コードを書いてテストし、あなたがノートパソコンを閉じている間にプルリクエストを開きます。

Cognition は、実際のインフラでこれを支えています。DeepWiki はコードベースの永続的なインデックスを維持し、Devin Search は大規模なモノレポでの探索を助け、Devin Review は人が見る前に PR を批評する第2のエージェントです。料金は2026年4月14日に刷新されましたが、含まれる枠を超えた利用は、引き続き Agent Compute Units(それぞれ約15分の作業)で管理され、大きなタスクではすぐに使い切ってしまうことがあります。
| 得られるもの | 得られないもの |
|---|---|
| このリストで最も明確な、完全自律で任せきりのワークフロー | ACU ベースの超過分で、$20のプランが実際にはるかに大きな請求額になりうる |
| 大規模で見慣れないコードベース向けの DeepWiki と Devin Search | 最良の結果には、曖昧な依頼ではなく範囲の明確なチケットが前提となる |
| 人のレビューの前に第2のエージェントによる確認を加える Devin Review | 独自の SWE-1.7 モデルは、難しいベンチマークでフロンティアのリーダーに数ポイント届かない |
| 任せて立ち去るワークフローのための Slack と Linear の連携 | 新たに再構築された料金(2026年4月)は、従来のプランに比べて実績が少ない |
料金: Free は$0で、利用は制限付きです。Pro は月額$20、Max は月額$200で、どちらも1シート用です。Teams は月額$80に加えて、フルシートごとに月額$40からで、共有のオンデマンドクレジットが付きます。Enterprise はカスタムで、引き続き ACU で課金されます。出典:Cognition の料金発表、2026年4月14日。
最適な用途: 範囲の明確なチケットを完全に任せ、編集セッションに付き添うのではなく、完成したプルリクエストをレビューしたいチーム。
6. Windsurf (Devin Desktop):Cognition の IDE、現在は Devin の料金体系に
Windsurf は2025年、主に Cascade エージェントの力で、最も愛された AI ファースト IDE の1つでした。Cognition による買収後、その歴史は Devin ファミリーに統合されました。Windsurf は2026年6月2日に正式に Devin Desktop となり、既存ユーザーは自動的に移行されました。Cascade のブランドはなくなり、その下にあるエージェントは今では Devin Local です。
機能面では、今でも Cursor 型の監督付き IDE エージェントとして動作します。複数ファイルの編集、ターミナルでの実行、深いローカルのコードベースインデックスに加え、独自の VS Code フォーク内でステップごとの承認を行います。変わったのはビジネス上の関係です。windsurf.com/pricing は Devin の料金ページにリダイレクトされるようになり、Devin Local はクラウド版 Devin を利用できるのと同じ月額$20の Pro プランで利用できます。従来の Cascade は2026年7月1日まで利用できました。
| 得られるもの | 得られないもの |
|---|---|
| 成熟した、Cursor クラスの監督付きエージェント IDE(旧 Cascade) | ブランドと料金が1年で2回変わり、調達の履歴が複雑になる |
| SWE-1.7 を含む Devin のモデル選択肢を共有 | Cursor と同じトレードオフとして、エディタの乗り換えが必要 |
| 他のエージェントを内部で使うための Agent Client Protocol のサポート | Devin Local の料金は、クラウド版 Devin と同じ ACU に近い構造に紐づく |
| 1つの Pro プランで、デスクトップエージェントとクラウド版 Devin の両方を利用可能 | 従来の Cascade ユーザーには、切り替えの厳格な期限(2026年7月1日)があった |
料金: Devin のセルフサーブ体系を共有します。Free が$0、Pro が月額$20、Max が月額$200、Teams が月額$80に加えて1シートあたり$40から、Enterprise はカスタムです。出典:devin.ai/pricing(リブランド時点で windsurf.com/pricing はここにリダイレクトされます)。
最適な用途: Cursor のような監督付き IDE エージェントを求めつつ、クラウド版 Devin と並んで Cognition の製品ファミリー内にとどまりたいチーム。
7. Google Jules:無料で非同期、Gemini の長いコンテキストを背景に
Jules は完全非同期レベルにおける Google の製品で、ここにあるものの中で最も気軽に無料で試せます。GitHub のリポジトリを指定してバグや小さな機能を説明すると、コードを隔離されたクラウド VM にクローンし、アプローチを計画し、変更を加え、完全な推論と diff を示しながらプルリクエストを開きます。2026年3月の公開ベータを経て、2026年5月19日の Google I/O で一般提供に達しました。

Jules は Gemini 3 Pro(無料プランでは 2.5 Pro)で動作し、別のインデックス層ではなく長いコンテキストウィンドウに頼っています。また、スクリーンショットや画面録画といったマルチモーダルのバグ報告を、タスクの説明として受け取れます。料金モデルは独特です。Jules には単体のサブスクリプションがなく、有料アクセスはすべて Google AI Pro または Ultra プランに含まれます。
| 得られるもの | 得られないもの |
|---|---|
| クレジットカード不要で、実際に使える無料プラン(1日15タスク) | 単体の Jules サブスクリプションはなく、有料プランには Google AI Pro/Ultra プランが必要 |
| リポジトリ全体を把握するための Gemini 3 Pro の長いコンテキストウィンドウ | このリストの多くのツールより、一般提供が新しい(2026年5月) |
| マルチモーダルのタスク入力(スクリーンショット、画面録画) | 有料プランは現在、Workspace ではなく個人の @gmail.com アカウントに限定 |
| PR を開く前に完全な diff と推論ログを表示 | Cursor や Copilot に比べて、サードパーティの IDE 連携が少ない |
料金: 無料プランには、Gemini 2.5 Pro で1日15タスクと3件の同時タスクが含まれます。Jules in Pro は、月額$19.99の Google AI Pro サブスクリプション経由で、1日100タスクと Gemini 3 Pro へのアクセスに引き上げます。Jules in Ultra は、月額$99.99からの Google AI Ultra 経由で、1日300タスクが可能です。出典:jules.google/docs/usage-limits。
最適な用途: すでに Google のエコシステムを利用しており、新たなベンダーとの関係を築かずに、無料または低コストの完全非同期エージェントを使いたいチーム。
8. Replit Agent:既存アプリの修正ではなく、アプリ全体の出荷に最適
Replit Agent は、このリストの多くとは異なる前提から始まります。修正すべき既存のリポジトリがあると仮定するのではなく、ゼロから始めるかもしれないと考えます。アプリを説明すると、アーキテクチャを計画し、コードを書き、データベースを用意し、Replit 独自のクラウドワークスペース内で公開します。マイルストーンごとにチェックポイントを作るので、次のステップに進む前にロールバックできます。
そのため、大規模なモノレポを保守するエンタープライズチームにはあまり向きませんが、1回のセッションでアイデアからデプロイ済みのアプリまで進めたい創業者や社内ツールの開発者には、より役立ちます。Pro プランでは最大10のエージェントを並列で実行できます。料金は、コンピュートとエージェント呼び出しの両方をカバーする月額のプリペイドクレジットで決まるため、忙しいビルドセッションでは、表示価格から想像するより早く月間の割り当てを使い切ることがあります。
| 得られるもの | 得られないもの |
|---|---|
| アプリの全ライフサイクル:計画、構築、用意、公開を1つの流れで | Replit 独自のワークスペース内に限定され、任意の外部モノレポは対象外 |
| エージェントのステップ間で安全にロールバックできるチェックポイント | クレジットがコンピュートとエージェント呼び出しの両方に使われ、定額より予測しにくい |
| Pro プランで最大10の並列エージェント | 既存の大規模なエンタープライズコードベースの修正にはあまり向かない |
| 1日あたりのエージェントクレジット付きの、本当に無料の Starter プラン | 独立して公表された SWE-bench スコアなし |
料金: Starter は無料で、毎日のエージェントクレジットが付きます。Core は月額$25(年払いで月額$20)で、月間$25分のクレジットと最大2つの並列エージェントが付きます。Pro は月額$100(年払いで月額$95)で、月間$100分のクレジットと最大10の並列エージェントが付きます。Enterprise はカスタムです。出典:replit.com/pricing。
最適な用途: 既存の大規模コードベースの修正が主目的ではなく、新しいアプリを最初から最後まで構築して公開する創業者や社内ツールのチーム。
9. Factory:コーディング以外もカバーするエンタープライズ向け Droid
Factory は、通常「コーディングエージェント」という言葉が意味するよりも、ソフトウェアライフサイクルの広い範囲をカバーします。Droid にはいくつかの種類があります。実装のための Code Droid、オンコールとインシデント対応のための Reliability Droid、コードベースとドキュメントのコンテキストのための Knowledge Droid、計画のための Product Droid です。CLI、IDE 拡張機能、デスクトップアプリ、またはバックグラウンド作業用に Factory が管理する「Droid Computers」上のクラウドから実行できます。
この幅広さは、コーディング、運用、計画にまたがる1つのエージェントプラットフォームを求めるエンタープライズ組織を狙っています。Reliability Droid は本物の差別化要因です。本番環境のインシデントを調査し、根本原因の報告書の下書きを作成します。ここにある純粋なコーディングエージェントは、どれもこの仕事を試みていません。このカテゴリ全体については、2026年のおすすめエンタープライズ AI エージェントプラットフォームをご覧ください。無料プランはなく、Business/Enterprise(SSO、SAML/SCIM、Zero Data Retention、オンプレミス)は見積もりのみです。
| 得られるもの | 得られないもの |
|---|---|
| Droid は実装だけでなく、コーディング、オンコール/インシデント対応、コードベースの知識をカバー | 契約前に試せる無料プランがない |
| CLI、IDE、デスクトップ、クラウドのバックグラウンドコンピュートにまたがって動作 | 独立して公表された SWE-bench スコアなし |
| Reliability Droid は本番環境に触れる変更を人にエスカレーション | Business プランは150シートが上限で、それを超えると Enterprise/カスタム料金 |
| Enterprise で Zero Data Retention とオンプレミスのオプション | SSO/SAML/オンプレミスはいずれも営業との相談が必要 |
料金: Pro は月額$20です。Plus は月額$100(Pro の約5倍の利用量に加え、クラウドの Droid Computers)です。Max は月額$200(Pro の約10倍の利用量、新機能への早期アクセス)です。Business(最大150シート)と Enterprise はカスタムです。出典:factory.ai/pricing。
最適な用途: 実装だけでなく、コーディング、インシデント対応、コードベースの知識をカバーする1つのエージェントプラットフォームを求める、エンタープライズのエンジニアリング組織。
10. Amp:個人開発者向けの Sourcegraph 単体エージェント
Amp は、個人開発者向けエージェント市場に対する Sourcegraph の答えで、Sourcegraph が2025年半ばに Cody をエンタープライズ専用の1シートあたり月額$59のプランに移行した後に独立しました。Cody が大規模でインデックス化されたエンタープライズのコードベースを対象とするのに対し、Amp は、エンタープライズ契約なしで制限のないコンテキストのエージェントを求める個人の開発者向けに作られています。
その「Oracle」サブエージェントは知っておく価値があります。見慣れないコードベースの本当に難しい問題のための、別の推論パスです。スレッド(Amp でのセッションの呼び方)は共有できるため、チームは diff だけでなく、エージェントがどう推論したかをレビューできます。料金は、サブスクリプションのクレジットプール(月間$20または$200分の利用)または従量課金で決まります。有料プランの Smart Mode は、ゼロデータ共有を加えます。
| 得られるもの | 得られないもの |
|---|---|
| 見慣れないコードベースの難問を深く推論する「Oracle」サブエージェント | Sourcegraph のエンタープライズ向け Cody ラインに比べて新しい単体製品 |
| 有料の Smart Mode プランでのゼロデータ保持 | サードパーティのサブスクリプション連携は1人2件まで |
| エージェントの推論をチームで確認できる共有スレッド | 独立した SWE-bench スコアは公表されていない |
| クレジットカード不要の、本当の無料プラン | 高度なモード(high、ultra)は月額$200の Gigawatt プランの下に制限されている |
料金: 無料プランがあります。Megawatt は月額$20で、750時間の small-orb コンピュートと$20分のエージェント利用クレジットが付きます。Gigawatt は月額$200で、1,000時間の大型コンピュートと$200分のクレジットが付き、high と ultra のモードを利用できます。Unconstrained(従量課金)は、チームやエンタープライズ向けです。出典:ampcode.com/pricing。
最適な用途: Sourcegraph のエンタープライズ向け Cody 契約に縛られずに、強力なプライバシー保証付きで制限のないコンテキストのエージェントを求める個人開発者。
11. Cline:無料で最高峰の、自前キー持ち込み型エージェント
Cline は、自前キー持ち込みの開発者が最初にたどり着くエージェントです。完全なオープンソースで無料、VS Code や JetBrains の中でファイル編集とターミナルコマンドを完全に自律的に実行でき、Plan/Act の分離によって、実行前にアプローチを承認します。MCP マーケットプレイスにより、データベース、社内 API、チケット管理システムなど、カスタムの統合コードなしで到達できる範囲が広がります。
Cline はプラットフォームに料金がかからないため、すべてのトークンについてモデルプロバイダーに直接支払います。軽い利用なら安く、重い利用なら高くなります。Claude Sonnet クラスのモデルを激しく使う開発者は、1日$5〜$30を費やすことがあります。Cline は、このコストを定額の中に隠さず、透明に示しています。Enterprise は、調達部門が求めるガバナンス層(SSO/OIDC、RBAC、チームダッシュボード、一元化された請求、監査ログ)を、カスタム料金で加えます。
| 得られるもの | 得られないもの |
|---|---|
| 完全なオープンソースで無料、推論にプラットフォームの上乗せなし | モデルプロバイダーへの請求のすべてを自分で所有し、監視する必要がある |
| Plan/Act の分離により、実行前に明示的な承認ステップが必須 | Cline 自身の料金ページに、定額の Teams プランの料金は掲載されていない |
| 社内システムへの到達範囲を広げる MCP マーケットプレイス | 独自の大規模リポジトリ向けインデックス層はない |
| Enterprise では SSO、RBAC、一元化された請求が加わる | Enterprise の料金はすべて見積もり制 |
料金: オープンソースのコアは無料です。自前の API キーを持ち込み、モデルプロバイダーに直接支払います(積極的に使う場合は通常1日$5〜$30)。Enterprise はカスタムで、SSO、SLA、JetBrains 拡張機能が加わります。出典:cline.bot/pricing。
最適な用途: どのモデルを実行するかを完全に制御し、推論コストを完全に透明化したい、プラットフォーム料金なしの開発者とチーム。
12. Aider:元祖ターミナルエージェント、今も無料で git ネイティブ
Aider は、ターミナルベースの元祖 AI ペアプログラマーです。「エージェント型コーディング」がカテゴリ名になる前からオープンソースで、今でもここにあるツールの中で最も git ネイティブなものの1つです。すべての変更が、本物のメッセージ付きの個別のコミットとして記録されるため、セッションのレビューは git log を読むことであり、悪い変更を取り消すのは単純な git revert です。
そのコンテキスト戦略は独特です。tree-sitter によるリポジトリマップが、どのファイルを全体として読み込むかを決める前に、コードベースのコンパクトでシンボルレベルの俯瞰を Aider に与えます。シンプルでありながら大規模なリポジトリでも通用する理由の一部です。商用 API でも Ollama 経由のローカルでも、ほぼあらゆるモデルで動作します。サブスクリプションはなく、プラットフォームのプランを売る会社もありません。無料で、使った推論分だけを支払います。
| 得られるもの | 得られないもの |
|---|---|
| 完全に無料のオープンソースで、ローカルモデルを含むあらゆるモデルで動作 | GUI はなく、純粋にターミナルツール |
| 設計上 git ネイティブ:すべての変更がレビュー可能で取り消し可能なコミット | 完全非同期やクラウドホスト型のモードはない |
| 有料のインデックス製品なしで大規模コードベースに対応する Tree-sitter リポジトリマップ | エンタープライズ向けの SSO/RBAC 層はなく、管理型プラットフォームではなく CLI |
| 特定のモデルプロバイダーへのベンダーロックインなし | サポートはコミュニティ主導で、ベンダーの SLA ではない |
料金: 無料のオープンソース(Apache 2.0)で、選んだモデルプロバイダーに自前の API キーで従量課金、または Ollama 経由で完全ローカル実行すればトークン単位の費用はかかりません。出典:aider.chat。
最適な用途: どのモデルを実行するかについてベンダーロックインのない、無料で git ネイティブなターミナルエージェントを求める開発者。
13. OpenHands:研究者がベンチマークの基準にするオープンソースフレームワーク
OpenHands(旧 OpenDevin)は、研究者やその他のエージェント開発者がベンチマークの基準にするオープンソースのフレームワークで、All Hands AI が保守しています。シェルコマンドの実行、ファイルの編集、ページの閲覧など、すべての操作は使い捨ての Docker サンドボックスの中で行われるため、ホストマシンには何も触れません。このデフォルトでサンドボックス化された設計は、学術的なエージェント評価に頻繁に登場する理由でもあります。
MIT ライセンスの下で無料でセルフホストするか、無料のホスト型 Individual クラウドプラン(1日10会話まで)を利用でき、自前のキーを持ち込むか、OpenHands のモデルを原価で利用します。Enterprise は、RBAC、SAML/SSO、Agent Control Plane、Large Codebase SDK を、カスタム料金で加えます。このカテゴリ全体については、2026年のおすすめオープンソース AI エージェントフレームワークをご覧ください。Claude Opus 4.5 と組み合わせた場合、SWE-bench Verified で77.6%(pass@3)を記録し、公表されているオープンソースの結果の中でも上位に入ります。
| 得られるもの | 得られないもの |
|---|---|
| 完全なオープンソース(MIT)でセルフホスト可能、または無料のホスト型クラウドプラン | 無料クラウドプランは1日10会話が上限 |
| デフォルトで Docker のサンドボックス実行、ホストには何も触れない | UI は Cursor や Windsurf より実用本位 |
| 公表されているオープンソースの SWE-bench Verified の結果の中でも上位 | Enterprise の料金(RBAC、SSO)はすべて見積もり制 |
| モデル非依存で、上乗せなしの原価での推論 | ベンチャー支援の参入者に比べて、商用エコシステムが小さい |
料金: オープンソースのセルフホストは、MIT ライセンスの下で無料です。Individual クラウドプランは無料(1日10会話の上限)で、自前のキーを持ち込むか、OpenHands のモデルを原価で利用します。Enterprise(SaaS または VPC 内のセルフホスト)はカスタムです。出典:openhands.dev/pricing。
最適な用途: 透明で再現可能なベンチマーク結果を持つ、完全なオープンソースでセルフホスト可能なエージェントフレームワークを求めるチームと研究者。
14. Warp:インフラ中心の作業向けのエージェント型ターミナル
Warp は、問いを「どの IDE が最高のエージェントを持っているか」から「なぜこの作業に IDE が必要なのか」へと組み替えます。シェルプラグインではなく、一から作られたターミナルアプリケーションで、Agent Mode が組み込まれています。複数ステップのタスク(プロジェクトのセットアップ、lint の設定、git の初期化など)を平易な英語で説明すると、OpenAI、Anthropic などから接続したモデルを使い、承認を得ながら各ステップを実行します。
このターミナル優先の姿勢は、インフラや DevOps に近い作業に向いています。サーバーのセットアップ、デプロイスクリプト、失敗するビルドのデバッグなどです。Warp Drive は、エージェントの上にチームでの知識共有を加えます。用途に特化したエージェントを自分たちで構築したいチームは、AI DevOps エージェントのブループリントから始められます。ターミナルは永久に無料で、課金されるのは AI の部分だけです。込み入った Agent Mode のセッションを1回行うと、月間のクレジット割り当ての大きな割合を消費することがあります。
| 得られるもの | 得られないもの |
|---|---|
| 後付けではなく、Agent Mode を組み込んだ高速でモダンなターミナル | IDE ではなく、Cursor や Copilot に比べて深いマルチファイルのリファクタリングには向かない |
| マルチモデル対応(OpenAI、Anthropic など) | 独立した SWE-bench スコアは公表されていない |
| エージェントと並んでチームの知識共有(Warp Drive) | 1回の長い Agent Mode セッションで、月間クレジットの大部分を消費することがある |
| ターミナル自体は永久に無料 | Business プランは25シートが上限で、それを超えると Enterprise/カスタム料金 |
料金: Free には、ターミナルと限られた月間クレジットの割り当てが含まれます。Build は月額$20(年払いで月額$18)で、1,500クレジットです。Max は月額$200(年払いで月額$180)で、18,000クレジットです。Business は1ユーザーあたり月額$50(年払いで月額$45、最大25シート)です。Enterprise はカスタムです。出典:warp.dev/pricing。
最適な用途: IDE を完全に置き換えるのではなく、インフラやシェル中心の作業向けにエージェント型ターミナルを求める開発者と DevOps に近いチーム。
選び方:意思決定フレームワーク
最適なコーディングエージェントは、チームが必要とする自律レベル、環境、レビューモデルから出発し、その運用パターンに合うツールへと絞り込んでいくことで見つかります。

| 必要なもの | 選ぶべき製品 | 理由 |
|---|---|---|
| 自ら PR を開く、完全自律で任せきりの作業 | Devin | 専用のサンドボックス VM、DeepWiki によるインデックス化、そして先に作業を確認する Devin Review |
| 最も深い GitHub ネイティブの、Issue から PR までのワークフロー | GitHub Copilot コーディングエージェント | GitHub Actions 内でサンドボックス化され、レビュー用にタグ付けされ、Copilot のコードレビューが支える |
| 専用 IDE 内で最も洗練された監督付きエージェント | Cursor | 埋め込みベースのリポジトリインデックスに、任意の非同期クラウドエージェント |
| git とリポジトリを最も深く理解するターミナルネイティブのエージェント | Claude Code | エージェント検索は、インデックス化の手順なしで巨大なリポジトリにも対応し、プランモードと権限プロンプトがある |
| 無料でオープンソースの、自前キー持ち込み型エージェント | Cline または Aider | プラットフォーム料金ゼロで、モデルと推論コストを自分で管理できる |
| 既存アプリの修正ではなく、アプリ全体を構築して公開する | Replit Agent | 1つのクラウドワークスペース内で、計画、構築、用意、公開を行う |
| コーディングを超えたエンタープライズ向けのカバー:インシデント対応、計画 | Factory | Code Droid に加えて、Reliability、Knowledge、Product の各 Droid |
| 新たなベンダーとの関係なしに使える、Google 連携の無料の非同期エージェント | Google Jules | 既存の Google AI サブスクリプションに含まれ、実際に使える無料プラン |
| インフラやシェル中心の作業で、マルチファイルのリファクタリングではない | Warp | IDE の後付けではなく、目的に特化したエージェント型ターミナル |
| 公開ベンチマークを持つ、完全なオープンソースでセルフホスト可能なフレームワーク | OpenHands | MIT ライセンスで、デフォルトでサンドボックス化され、Claude Opus 4.5 と組み合わせて SWE-bench Verified で77.6% |
次のステップ
ツールを選ぶ前に、自律レベルを選んでください。会議中にも作業を進めてくれるエージェントが欲しいなら、Devin、Google Jules、GitHub Copilot のコーディングエージェントを、範囲の明確な実際のチケット1件で試し、プルリクエストが実際にどうなるかを確かめてみてください。エディタから自分で操作する監督付きエージェントが欲しいなら、Cursor、Claude Code、Windsurf (Devin Desktop) が、並べて試す価値のある最も成熟した3つの選択肢です。そして予算が制約なら、Cline と Aider は使ったトークン以外の費用がかからず、シート単位の契約を結ぶ前に、エージェント型コーディングがワークフローに居場所を得るかどうかを確かめる最も安い方法です。
自前で構築する側のこのカテゴリについては、AIエージェントの作り方から始めてください。ノーコードのビルダーとコードフレームワークを比較検討しているなら、ノーコード vs コードのAIエージェントをご覧ください。コーディングエージェントが、より広いエージェント展開への入口にすぎないなら、2026年のおすすめAIエージェントプラットフォームが、このカテゴリの残りの部分に向けた総合ガイドです。

On this page
- 2026年8月更新:変更点
- 重要なポイント
- エージェント型コーディングとAIコーディングアシスタント:このリストが違う理由
- 比較早見表
- 自律レベル:実際にどこまで任せられるか
- これらのエージェントの実行場所とコードベースの扱い方
- 検証済みのベンチマーク性能
- 料金モデル:チームが驚きやすいポイント
- 人を関与させ続ける:レビューと安全のワークフロー
- 1. Claude Code:リポジトリへの理解が最も深いターミナルネイティブのエージェント
- 2. GitHub Copilot(エージェントモードとコーディングエージェント):GitHub を使い込んでいるならデフォルトの選択肢
- 3. Cursor:IDE 内で最高の監督付きマルチファイルエージェント
- 4. OpenAI Codex:ローカル CLI から完全非同期のクラウドタスクまで
- 5. Devin:完全自律型エンジニアに最も近い存在
- 6. Windsurf (Devin Desktop):Cognition の IDE、現在は Devin の料金体系に
- 7. Google Jules:無料で非同期、Gemini の長いコンテキストを背景に
- 8. Replit Agent:既存アプリの修正ではなく、アプリ全体の出荷に最適
- 9. Factory:コーディング以外もカバーするエンタープライズ向け Droid
- 10. Amp:個人開発者向けの Sourcegraph 単体エージェント
- 11. Cline:無料で最高峰の、自前キー持ち込み型エージェント
- 12. Aider:元祖ターミナルエージェント、今も無料で git ネイティブ
- 13. OpenHands:研究者がベンチマークの基準にするオープンソースフレームワーク
- 14. Warp:インフラ中心の作業向けのエージェント型ターミナル
- 選び方:意思決定フレームワーク
- 次のステップ