過去のバトル · 2026-06-20 UTC
Coding Agent 対決 — 2026年6月20日
Coding Agentカテゴリーから。 6名の参戦者に14票が投じられました。 Devraが王座に。
最終結果
ラインナップ
参戦ツール
このバトルに参戦したすべてのツールの紹介。最終スコア順。

Devraは、開発タスクを受け取り、端-to-端で完了できるAIソフトウェアエンジニアです。チケットまたは指示を受け取ったとしても、リポジトリ全体のコードを変更し、関連するドキュメントを更新し、プロジェクトが整合的であるようにユニットテストを書き直すことができます。 これは、非同期で協力的なジュニアパートナーとして機能し、タスクがきちんと範囲内であれば引き受け、人間によるレビューのために変更を開くことを目的としています。これにより、エンジニアリングチームはルーティンのメンテナンス、リファクタリング、およびインクレメンタルな機能作業をオフロードすることができ、標準のコードレビュー ワークフローを通じてコントロールを保持することができます。
評価基準の詳細
- タスクの完全な実行
- 複数ファイルコードの更新
- ドキュメントの自動アップデート
- 単位テストの生成とアップデート
- 開発者ワークフローの統合
- 非同期タスクの取り扱い


Shipper owは、ユーザーの入力された単一の提示文字列を単一のパスで、生成することができるAIパワードアプリケーションビルダーです。プロジェクトのスケルトンを手作業で作るのではなく、このツールを使用して、ユーザーは自分が何が必要としているかを記述します。つまり、コードベース、UI、主なロジックが一から生まれます。 創業者、インディーハッカー、製品チームがアイデアからプロトタイプまで早く動き出すには Shipper.nowを活用できます。設定、Boilerplate、初期実装を単一のステップに統合することで、Shipper.nowはコンセプトから実稼働可能な製品までのパスを短縮します。
評価基準の詳細
- 1つのインプットからアプリ生成機能
- フルスタックコード出力
- 内蔵されたUI作成機能
- クイックプロトタイピングフロー
- 自然言語プロジェクト指定

devlo AIは、エンジニアリングワークフローに埋め込まれたAIのチームメイトとしてのソフトウェア開発プラットフォームです。ソースコントロールや問題追跡ツールと接続して、チームの作業を簡素化し、ビグなどのバグの解決、テストの作成、プルリクエストのレビュー、コンテキストの切り替えなしで小さなタスクのリリースなどをサポートする。 既存ツールのGitHubなどに組み込めるように設計された、devloはissueやPRを課すことができる人間と同じように操作することができます。リポジトリのコンテキストを分析することでコードの修正を提案し、レビューのためにプルリクエストを開き、手作業で行う必要があるルーティンメンテナンスの時間を最小限に抑えようとしています。 開発チームに焦点を当てたプラットフォームは、人間が最終のマージを制御し続けることができる再帰的なタスクのオフロード、コードレビューの加速、日本語ではテストカバレッジの向上を実現させることを目指しています。
評価基準の詳細
- 自動バグ修正やコード変更
- プルリクエストレビュー支援
- テスト生成とカバー率向上
- GitHubと問題トラッカー統合
- リポジトリにわたるコードの理解
- 指示可能なAIパートナーworkflow

Flootは、自然言語で目的の内容を説明し、プラットフォームが機能する製品を生成できるAIアプリケーションとウェブサイト作成ツールです。 ターゲットは、製作者、起業家、および手作りコーディングの必要が無いクリエイター向けに設計されています。 ユーザーはFlootに応答して、アプリケーション全体を生成、設計を繰り返し、機能を調整することができます。 ツールはUIの生成、基本ロジック、デプロイメントのステップのハンドリングを行い、アイディアから実際のアプリケーションまでのパスを縮めることを目指しています。 早期阶段のプロトタイピング、インナートゥールズ、ランディングページ、MVPは高速性よりもカスタムな設計を優先するものです
評価基準の詳細
- 自然言語のアプリ生成
- コーディングなしのビジュアル編集
- サイトとウェブアプリのサポート
- 設計を対話を通じて反復設計
- 組み込みのデプロイ
- 共通用途のテンプレート

JulesはGoogleによって設計された非同期のコードエージェントで、アクティブな開発者監視なしに定期的なソフトウェアエンジニアリングタスクを行うように構築されています。 JulesはGitHubレポジトリに接続し、コードベースを読み取って、バックグラウンドで割り当てられた問題であるバグ修正、リファクタリング、依存関係の更新、テスト生成を手掛けることができます。 Julesはチャットベースのペアプログラマーよりもリモートの仲間として機能します。トスクを渡して、プロセス設計、環境分離で実行して、人間の確認のためにプルリクエストを返します。このため、マイナントリスのオフロードに適しており、開発者はハイインパクトな問題に焦点を当てることができます。 "Julesはアシンクロナスに動作し、既存のレビュープロセスと統合しているため、チームは、標準PRワークフローを通じて人間の管理を維持することができるように、複数のイシュー横断する作業の並列化をJulesを使って実行できる。"
評価基準の詳細
- 孤立された環境でのタスクの自動実行
- プルリクエストベースの変更提供
- 自動的なバグ修正とパッチング
- ユニットテストの生成とアップデート
- 依存関係とバージョンのアップグレード
- GitHub リポジトリの統合

K Gは、既存のコードベースのコンテキストを維持しながら、フルスタックに活用できるAIコードエージェントです。 代わりに、アプリケーションの構造、依存関係、慣習に対して論理を展開し、コードにフィットした変更を生成するため、単に孤立したスニペットを生成するのではなく、プロジェクトの整体的理解を活用します。 前後端およびインフラストラクチャレイヤーをカバーするさまざまなタスクを実行することを目指しており、開発者はチャットウィンドウへのコンテキストを手動で入力せずに、機能を実装、コードをリファクタリング、問題点をデバッグできます。リポジトリをインデックス化することで、このツールは実際にプロジェクトがどのように構築されているかに沿ったコードをナビゲート、アップデート、および説明できます。
評価基準の詳細
- リポジトリのインデックスおよびコンテキストの認識
- フルスタックのコード生成
- 複数ファイルの編集およびリファクタリング
- 統合されたデバッグアシスト
- フロントエンドとバックエンドで実行
- natural languageでのタスク入力










