こんにちは、レナです。
最高の AI エージェントは、開いたり、検査したり、修正したり、拒否したりできる結果を残し、何を触ったのかを確認できるようにします。ここで中断したのは、「エージェント」にはクラウド研究者、デスクトップ オペレーター、AI コーディング エージェントが含まれるためです。同じ権限、証拠、または回復パスを持たなくても、複数のステップを計画できます。
これは、個々の専門家、小規模チームのリーダー、および技術的な意思決定者を対象とした商業調査の最終候補リストです。 2026 年 9 月 20 日の現在の公開状況、プラットフォーム、プラン、価格設定ページ、権限、データ処理ステートメント、ログ、エクスポート、および地域メモを確認しました。
最高の AI エージェントの概要
ChatGPT Work は、長時間実行されるアプリとファイルの成果物用のクラウド エージェントです。 Manus はクラウドで調整された研究とアーティファクトの作成を行っています。デスクトップ アプリでは計画をローカルにできません。 Open Interpreter は、OS 権限に基づいてローカル ファイル、アプリ、シェル コマンドを操作できます。 EvoX ベータ版は、端末、ブラウザ、Lark、IDE にまたがる macOS デスクトップの候補です。
Devin CLI/Desktop および Claude Code は、AI エージェント ツールと AI コーディング エージェントに焦点を当てたものです。 Devin は、ツール/パスごとのルールとオプションのクラウド ハンドオフを使用したターミナルの実行を文書化します。 Claude Code は、計画、質問、編集承諾、およびその他のモードを提供します。どちらも、ただ手順を踏むだけで一般事務代理人になれるわけではありません。
Manus は無料 ($0/月)、Pro は $20/月、Team は $20/シート/月からリストされています。 Devin Desktop には、無料、月額 20 ドルのプロ、月額最大 200 ドルが記載されています。 Claude Code には、対象となる有料アカウントまたはコンソール アカウント、または Amazon Bedrock、Google Vertex AI、Microsoft Foundry などのサポートされているサードパーティ プロバイダーが必要です。購入者のアカウントフローでプラン、クレジット、地域条件を確認します。
候補リストの作成とテストの方法
単独でチャットするのではなく、複数のステップの作業を完了する必要がある
計画、作業面でのアクション、およびチェック可能な出力を公的に説明する製品のみを含めました。純粋なチャット、API、開発フレームワークはリリースされました。自律型 AI エージェントには依然として同じ証拠が必要です。制限付きタスクは次のとおりです。承認された 3 つのファイルと 1 つのスプレッドシートを読み取ります。プロジェクト フォルダーに 1 ページの概要とタスク リストを作成します。出典を引用する。次に、外部アクションまたは保護されたアクションの前に確認を要求します。優れたエージェントは、リクエストが拒否された後はきちんと停止し、レビュー用の証拠を残します。
これは私が購入前に実行する非センシティブなフィクスチャであり、私がここで実行したという主張ではありません。完了とは、サイレント スコープの拡張を行わずに、指定された場所に検査可能なアーティファクトが存在することを意味します。
1 つのタスクと共有スコアリング ルールを使用する
目に見える計画、範囲制限、タイムリーな承認、追跡可能な成果物、拒否されたステップ後のリカバリ、および独立したレビューに関して最終候補者を採点します。目的は、最大限の自律性ではなく、制御されたタスクの完了です。
このアプローチは、エッジ AI を安全に展開するためのカナダの現在のガイダンス の実践的な焦点に似ています。つまり、構成は使用中のシステム、リソース、インフラストラクチャと一致する必要があります。これはガイダンスであり、法的認定や製品の推奨ではありません。
1 つの意思決定マトリックスで候補リストを比較する
| 製品 | 最高の作業面 | 文書化された許可/レビューシグナル | アーティファクトと回収の証拠 | 重要な境界線 |
|---|---|---|---|---|
| ChatGPT Work | クラウド アプリ、ファイル、Web、デスクトップのワークフロー | 確認とアプリの制御はプランによって異なります | 完了したファイル/タスクのコンテキスト | クラウド履歴とアプリへのアクセスを確認する必要があります |
| マヌス | クラウド調査、成果物、スケジュールされた作業 | コネクタ、タスク、プロジェクト、スケジュール コントロール | タスクビューと実行ビュー | デスクトップではオーケストレーションがローカルにならない |
| オープンインタープリタ | ローカル ファイル、アプリ、シェル | ワークスペースと OS の権限 | ワークスペース/可逆コピーを検査する | モデル プロファイルはローカルまたはホストされることができます。 |
| EvoX ベータ版 | macOS のクロスアプリデスクトップ作業 | 提供された資料には、レビュー/停止コントロールについて説明されています。ベータ版を検証する | 活動の証拠を検証する | テレメトリ、保持、価格、地域は公表されていません |
| Devin CLI/デスクトップ | リポジトリ、ターミナル、IDE | ツール/パスによる許可、確認、または拒否 | 差分、テスト、シェル、ハンドオフ | クラウド パスはローカル シェルから分離されています |
| Claude Code | リポジトリとコードのセッション | 計画、質問、自動編集、バイパス モード | 差分、テスト、設定 | ホスト型モデルのパスは別途評価が必要 |
この表は、速度や信頼性ではなく、開示されている制御を比較しています。 「正式に指定されていない」は有効な調達結果です。製品デモからデータ ポリシー、ログ保持ルール、または輸出保証を推測するよりも優れています。影響の大きい状況では、現在統合された 人間の監視に関する EU AI 法のテキスト は、レビューが有意義でリスクに見合ったものでなければならないことを思い出させるのに役立ちます。この記事は法的なアドバイスではありません。
作業パターン別のベスト AI エージェント
クロスアプリのデスクトップ作業用
Open Interpreter は、タスクが選択したワークスペースと OS 権限の下でローカル アプリケーション、ファイル、コマンドを操作する必要がある場合に最も適しています。受信箱や広範なホーム ディレクトリではなく、使い捨てフォルダー内の読み取り専用インベントリまたは下書きから始めます。 EvoX は、ジョブがブラウザーの作業、ファイル、IM、端末、コードにまたがる場合に関連します。これらのデスクトップ AI エージェントには、狭い最初のタスクが必要です。 EvoX のパブリック ベータ ページでは、ターミナル、ブラウザ、Lark、IDE の継続性について説明しており、提供された資料ではローカル アセットとレビュー可能なコントロールについて説明しています。モデルまたはゲートウェイ パスを確認します。
ChatGPT Work はアプリとデスクトップのワークフローを横断することもできますが、仮想ブラウザー、アプリ、クラウド データ パスにより、異なる決定が行われます。これは、接続されたビジネス コンテキストと完成した成果物がローカルでの実行よりも重要な場合に役立ちます。タスクに必要なアプリのみを有効にして、チャットの外で最終ファイルを確認します。
研究および成果物の作成のため
Manus と ChatGPT Work は、特に結果をレポート、シート、スライド デッキ、またはその他の共有可能な成果物にする必要がある場合に、調査から成果物までの幅広いジョブに適合します。彼らの利点は、ソースを収集してタスクを継続できるクラウド作業面です。制限は、引用の存在は、選択された情報源が結論を支持していることを証明しないことです。証拠の付録を要求し、リンクのサンプルを開いて、承認された入力セットを完成したファイルとともに保持します。
どちらの製品も、指定されたレビュー担当者なしで送信、公開、購入、または専門的な決定を下すことはできません。スケジュールを立てると、これがさらに重要になります。繰り返しタスクでは、最初のプロンプトが安全な指示でなくなった後も、古いコンテキスト、コネクタ、および出力標準を再利用できます。
開発者の仕事の場合
完成が洗練された散文的な回答ではなく、リポジトリ内のテスト済みの変更を意味する場合、Devin と Claude Code はより良い選択肢です。 Devin の権限ルール、バックグラウンド シェル、ハンドオフ オプションは、パスとツールを明示的に制御したいチームに適しています。 Claude Code のプラン モードは、リポジトリを読み取り、変更を提案し、その後でのみ編集を許可するという賢明な最初のパスを提供します。どちらの場合でも、開発者は差分を検査し、受け入れテストを実行し、プル リクエストまたはデプロイメントが適切かどうかを判断する必要があります。
これは、エージェントが最も説得力があると感じながらも、静かに失敗する可能性がある場所です。意図した動作をカバーせずにテストが合格したり、移行が不完全であったり、外部ツールがリポジトリとは異なる権限を持っていたりする可能性があります。保存された差分とテストの証拠は、タスクが「完了した」という主張よりも重要です。
各エージェントが停止するか承認が必要な場合
健全な停止点は製品によって異なります。 ChatGPT Work ではブラウザの引き継ぎまたは確認が必要な場合があります。 Manus はタスク、コネクタ、スケジュールのコントロールを公開します。オープンインタープリターには OS 権限が必要です。 Devin と Claude Code は、ツールの使用を尋ねたり、拒否したり、制限したりするように構成できます。 EvoX は、購入者が利用できる正確なベータ確認と停止動作を確認する必要があります。これらのメカニズムのいずれも、機密性の高い認証、外部通信、支払い、破壊的な変更、または規制されたアドバイスを監視する必要性を排除するものではありません。
より広範なセキュリティ原則はシンプルです。アカウント、データ、ツール、実行環境をまとめて制御します。 ENISA の 2025 年 AI サイバーセキュリティ勧告 は、関連する点を指摘しています。安全な AI 導入には、1 つの安心できる機能ラベルではなく、リスクベースのアプローチが必要です。
エージェントを自分の作業領域に合わせてニーズを確認する
デスクトップへのアクセスが必要で、結果と同時に権限を検査できる場合にのみ、Open Interpreter または EvoX を選択してください。クラウド エージェントがリサーチと接続されたコンテキストを成果物に変換し、ソースと外部アクションを検証する必要がある場合は、Manus または ChatGPT Work を選択してください。成果物がコード変更であり、レビュー基準が diff とテストである場合は、Devin または Claude Code を選択します。
リスクの低いドラフトの場合は、タスク履歴と最終ファイルのレビューが表示されるだけで十分な場合があります。クライアント作業の場合は、ソースの保持、指定された所有権、バージョン管理、および承認ゲートを追加します。財務、法律、医療、雇用、セキュリティ、または生産システムに関する決定については、適切な資格のあるレビュー担当者を追加してください。この候補リストには、意思決定者の代わりとなるエージェントはいません。
よくある質問
2 人で 1 つの AI エージェント ワークスペースを共有できますか?
個人アカウントを共有するのではなく、製品の文書化されたチームまたはプロジェクト管理を使用します。マナスは、共有チームのプロジェクト、指示、アクセス管理について説明します。コード エージェントは、個々の資格情報を分離したまま、バージョン管理を通じてリポジトリ レベルの設定を共有できます。他の製品、特にデスクトップ ベータ版については、最新計画のドキュメントに別の記載があるまで、共有ワークスペースの動作は未検証として扱う必要があります。
AI エージェントの履歴は製品間で移行できますか?
信頼できる普遍的な移行はありません。代わりに、ソース ファイル、最終ドキュメント、要件メモ、タスク ログ、承認されたプロンプト、コードの差分、テスト、およびシークレットを含まない設定などの耐久性のある成果物をエクスポートします。宛先製品で権限とコネクタを再作成します。コピーされたチャット履歴にツールの状態や同意が保存されるとは想定しないでください。
AI エージェントはスクリーン リーダーとキーボード ナビゲーションをサポートしていますか?
デスクトップ アプリや Web エージェントからアクセシビリティを推測しないでください。最終候補に残ったすべての製品について、現在の公式スクリーン リーダーのコミットメントは見つかりませんでした。調達前に、対象のスクリーン リーダー、キーボードのみのワークフロー、権限ダイアログ、進行状況ビュー、リカバリ コントロールを使用して正確なビルドをテストします。
AI エージェントはコメントを保存し、編集されたドキュメントの変更を追跡できますか?
ターゲット ファイル形式とエディタをテストした後でのみ、これをサポートされているものとして扱います。エージェントは、表示された結果が正しく見える場合でも、新しいドキュメントを生成したり、コピーを編集したり、コメントを統合したりする場合があります。追跡された編集とコメントを含む機密性のないドキュメントを使用し、バージョン管理された出力を必要とし、クライアント ファイルを許可する前にネイティブ エディターで比較します。
サブスクリプションがキャンセルされた後、スケジュールされたタスクはどうなりますか?
計画の変更後も、スケジュールが実行され続ける、同じコネクタが保持される、またはタスク履歴が保存されると想定しないでください。パブリックキャンセルの影響は、検討された資料に統一的に明記されていませんでした。キャンセルする前に、アクティブなスケジュールを一時停止または削除し、必要な結果をエクスポートし、不要なコネクタを削除し、正確なプランに対するベンダーの現在の保持条件とクレジット条件を確認してください。
以前の投稿:
- 製品を選択する前にエージェント カテゴリを決定している場合は、AI コワーカー vs デスクトップ エージェント で、作業面、メモリ、接続ツール、コンピューター アクセス、およびユーザー コントロールがどのように異なるかを説明しています。
- デスクトップ エージェントが実際にアプリ間の作業を完了できるかどうかを詳しく調べるために、GPT-6 Astra デスクトップ エージェント では、アクセス許可、アプリケーション ステップ、リカバリ、オペレーターの介入、および承認された成果物を調べます。
- 定期的な作業またはバックグラウンド作業が 1 回限りのプロンプトよりも重要な場合、Gemini Spark vs AI アシスタント は、タスクの継続性、接続されているソース、スケジュールされたアクション、承認、および中断ポイントを比較します。




