AIエージェントを試すなら、まず「何を終わらせたいか」を決めると選びやすくなります。相談相手がほしいのか、資料を仕上げたいのか、コードを修正したいのか。同じAIという名前でも、任せられる範囲は違います。
この記事では、ChatGPT Work・Codex、Claude、Gemini、Microsoft Copilot Studio、Manus、Hermes Agentを用途別に比較します。モデルの候補としてKimi K3も取り上げます。以前の製品一覧やモデル名をそのまま使わず、公式資料を2026年10月9日に確認し直しました。比較は検索量や実測性能のランキングではありません。
AIエージェントとチャットAIの違い
AIエージェントは、目標に合わせて次の作業を判断し、必要なツールを使って進める仕組みです。Anthropicの説明では、あらかじめ決めた手順を進む「ワークフロー」と、モデルが作業手順やツールの使い方を判断する「エージェント」を区別しています。[1]
例えば「この記事を改善して」という依頼でも、文章だけを返す使い方と、資料を調べ、下書きを作り、ファイルへ保存する使い方は別です。後者を実際に使うには、AIの回答能力に加えて、ツール、データへのアクセス、実行を止める条件を考える必要があります。
会社名・製品名・モデル名を分ける
比較の入口では、次の区別を押さえてください。
- OpenAI、Anthropicは提供元です。ChatGPTやClaudeは、利用する製品・サービスの名前です。[7][9]
- ChatGPT Work、Codex、Claudeのタスク実行機能、Claude Codeなどは、仕事を進めるための機能や実行環境として比べます。[14][13]
- GPT-6.1 Sol、Claude Fable 5.1、Claude Haiku 5.5はモデル名です。モデルの発表と、利用中のアプリでそのモデルを選べることは同じではありません。[12][11][10]
Kimi K3も、ここではモデルの候補として扱います。[3] モデルを選ぶ話と、仕事を任せる仕組みを選ぶ話を、同じ用途の中で整理します。
現在のAIを用途別に比較
料金欄は、公式資料で確認できた利用方式を中心にしています。ドル表示は確認した公式ページの表示であり、日本円への換算や税、地域別の請求額を保証するものではありません。金額を確定できていない製品は、そのまま明記しました。
| 比較対象 | まず検討したい用途 | 確認した特徴 | 費用・利用条件で見る点 |
|---|---|---|---|
| ChatGPT Work(OpenAI) | 調査から文書・資料などの提出物まで進めたい | ChatGPT内で複数ステップの仕事を進めるエージェント。通常のChatや開発向けCodexとは役割が異なる。[14] | WorkとCodexは利用枠を共有するという公式料金説明がある。Plusは20ドル/月、Proは100ドル/月からの表示。対象プランと展開状況は、利用するアカウントで確認する。[7][14] |
| Codex(OpenAI) | コードの実装・修正などの技術作業 | ソフトウェア開発と技術作業に特化した実行環境。[14] | ChatGPTプランで使う方式と、APIキーで従量課金する方式を区別する。API単価を、そのままサブスク内の作業回数に換算しない。[7] |
| Claudeのタスク実行機能(旧Cowork) | フォルダーや接続したツールを使って成果物を作りたい | 公式サイトは「CoworkはClaudeに統合」と案内。古い名称や切り替え画面を前提にしない。[13] | 公式料金ページはPro・Maxからの展開を案内。Proは月払い20ドル、Maxは100ドル/月から。利用上限や追加利用は別に確認する。[9] |
| Claude Code(Anthropic) | 開発作業やデバッグを任せたい | ソフトウェア開発向けのツール。タスク実行機能とは用途を分けて考える。[13] | Proなどの契約内利用と、API認証での利用を区別する。追加クレジットの設定や利用枠も確認する。[4][9] |
| GeminiのGems(Google) | 決まった条件で相談や下書きを繰り返したい | 指示を保存・再利用して、用途に合わせた応答を得る機能。これだけで外部作業を自律実行できるとは扱わない。[5] | 本稿では最新の月額を確定していない。利用するGeminiのプランと機能を確認する。 |
| Microsoft Copilot Studio | 組織の業務用エージェントを作成したい | エージェントの作成、テスト、公開に関するライセンスを確認する必要がある。[8] | Copilot Creditsの消費と公開できる契約を確認する。無料試用では作成・テストができるが、公開はできないと公式資料にある。[8] |
| Manus | スライドやWebサイトなどの制作を検討したい | 公式サイトはManus 2.0を案内し、スライド、Webサイト、デザインなどの制作メニューを掲載している。[6] | 本稿では最新の月額と利用量の消費条件を確定していない。契約画面で確認してから試す。 |
| Hermes Agent(Nous Research) | 継続する仕事で、記憶や作業手順を生かしたい | 記憶、スキル、ブラウザーなどのツールを備えるエージェント。[2] | 本体はMITライセンスのオープンソースで無料。モデル提供元や任意のホスティング・サービスの料金は別に確認する。[2] |
同じ仕事を任せてみると、操作のしやすさや、どこで人の確認が必要かを比べられます。上の表は比較の入口です。このサイトが全製品を同じ条件で実測して、完成品質や速度の順位を付けた表ではありません。

モデル名も更新する。ただし、用途を飛ばして選ばない
OpenAIのAPI変更履歴には、2026年9月29日のGPT-6.1 Sol公開が掲載されています。APIでのモデル公開を、そのまま全ChatGPT画面の選択肢だと考えないようにします。[12][14]
AnthropicはClaude Fable 5.1を2026年9月1日、Claude Haiku 5.5を10月7日に案内しています。新しいモデルでも、重い仕事と小さく限定した仕事で選び方は変わります。Haiku 5.5の発表でも、その用途の違いが説明されています。[11][10]
Kimiの公式技術記事はKimi K3を案内し、画像を扱う能力と100万トークンの文脈長をモデル仕様として示しています。長い資料や画像を使う仕事のモデル候補になりますが、アプリの契約内で利用できる量や、外部ツールを操作できる範囲とは別の話です。[3]
また、OpenAIの料金資料にはGPT-5.5がChatGPT、ChatGPT Work、Codexから2026年10月14日に退役する予定と記載されています。古いモデル名を前提にした操作説明は、公開前に見直す必要があります。[7]
無料・月額・API料金を混同しない
「無料のエージェント」でも、呼び出すモデルや外部サービスまで無料とは限りません。Hermes Agentの公式説明は、無料の本体と、モデル提供元・任意のサービスの料金を分けています。[2]
Codexも、ChatGPTでサインインして契約内の枠を使う場合と、APIキーを使う場合で請求の読み方が変わります。公式資料は、API単価で契約内の作業量を見積もらないよう注意しています。[7]
Claude Codeの公式資料は、Pro・Maxの契約内利用とAPI利用を区別し、利用上限後に追加クレジットで続ける設定も説明しています。「月額を払っているから、どの接続方式でも追加費用はない」とは考えないでください。[4]
試す前に確認するのは、使っている認証方式、契約に含まれる枠、追加利用を許可しているかの三点です。別の接続方式へ切り替える場合は、費用の前提も見直します。
AIエージェントの始め方

1. 最初の仕事を一つ決める
「仕事を全部自動化して」ではなく、終わりが分かる仕事を選びます。例えば「既存記事の改善案を一つ作り、変更理由と一緒に下書きへ保存する」です。
完成条件は、出来上がるファイル、使ってよい資料、してはいけない操作まで決めると確認しやすくなります。初回から送信や公開まで任せる必要はありません。
2. 権限と費用を絞る
最初は必要な資料だけを渡し、実データを書き換えない範囲で試す方法を勧めます。費用の上限に加えて、公開や送信を人が確認する位置も決めておきます。
例えばMicrosoft Copilot Studioは、無料試用でのテストと実際の公開を契約上も区別しています。操作できることと、公開できることを分けて確認する具体例です。[8]
3. 下書きの品質を確かめる
文章なら出典と変更理由、コードなら変更箇所と実行結果を確認します。途中で止まった作業や、確認していない情報を、AIが完成したものとして報告していないかも見てください。
AIが「できました」と答えたことと、目的のファイルや画面で結果を確認できたことを分けて考えると、次に任せる範囲を決めやすくなります。
4. 人の確認を含めて運用を判断する
実際に導入する前に、作業時間だけでなく、確認や修正にかかった手間も記録します。記事改善なら、公開後の検索流入の変化を別に測定します。下書きが速くできたことを、アクセス増加の証拠にはしません。
当サイトの制作例:SEO・LLMO修正ループ
当サイトでも、既存記事の改善案・変更履歴・公開前の承認・公開後の計測をつなぐ「SEO・LLMO修正ループ」を制作しています。ローカル環境での実装・検証では、下書きの作成と実際の公開を分け、途中で止まった作業を完了扱いにしない設計を重視しました。公開後のアクセス増加は、まだ検証していません。
よくある疑問
チャットAIだけでは足りないのですか?
一度の相談や、返された下書きを自分で使う仕事なら、まずはその使い方で試してください。Anthropicも、毎回複雑なエージェントを組む必要はなく、単純なモデル呼び出しで足りる用途があると説明しています。[1]
GemsはAIエージェントと同じですか?
Googleの公式説明で確認したGemsの役割は、指示を保存して再利用することです。この記事では、外部の仕事を自律実行するエージェントと同じものだとは扱っていません。定型の相談に向く候補として比較しています。[5]
一番人気のAIを選べばよいですか?
人気だけでは、必要な作業、権限、契約の条件までは決まりません。この比較は人気順位ではなく、用途を絞るための整理です。検索量を測っていない候補を「検索数が一番多い」とは紹介しません。
すべて自動で公開させてもよいですか?
初めての導入では、下書きを作る段階と、送信・公開する段階を分ける方法を勧めます。結果を見てから権限を広げると、誤送信や意図しない上書きを避ける範囲を決めやすくなります。
最初は、今ある仕事に合う一つから
資料づくり、コード修正、継続する仕事、組織の業務では、比べる候補が違います。モデル名や料金を確認したうえで、同じ小さな仕事を任せ、人が確認する手間まで含めて判断してください。
「どのAIが最新か」だけでなく、「自分の仕事をどこまで任せ、何を自分で確認するか」が決まると、導入の一歩を選びやすくなります。
よくある質問
チャットAIだけでは足りないのですか?
一度の相談や、返された下書きを自分で使う仕事なら、まずはその使い方で試してください。Anthropicも、毎回複雑なエージェントを組む必要はなく、単純なモデル呼び出しで足りる用途があると説明しています。[1]
GemsはAIエージェントと同じですか?
Googleの公式説明で確認したGemsの役割は、指示を保存して再利用することです。この記事では、外部の仕事を自律実行するエージェントと同じものだとは扱っていません。定型の相談に向く候補として比較しています。[5]
一番人気のAIを選べばよいですか?
人気だけでは、必要な作業、権限、契約の条件までは決まりません。この比較は人気順位ではなく、用途を絞るための整理です。検索量を測っていない候補を「検索数が一番多い」とは紹介しません。
すべて自動で公開させてもよいですか?
初めての導入では、下書きを作る段階と、送信・公開する段階を分ける方法を勧めます。結果を見てから権限を広げると、誤送信や意図しない上書きを避ける範囲を決めやすくなります。
参照資料
[1] https://www.anthropic.com/engineering/building-effective-agents — Building effective agents
[2] https://hermes-agent.nousresearch.com — Hermes Agent official overview
[3] https://www.kimi.com/en/blog/kimi-k3 — Kimi K3 official technical announcement
[4] https://code.claude.com/docs/en/costs.md — Claude Code cost documentation
[5] https://support.google.com/gemini/answer/15236405?hl=en — Google Gemini: How to use Gems
[6] https://manus.im — Manus official product overview
[7] https://learn.chatgpt.com/docs/pricing — ChatGPT Work and Codex pricing
[8] https://learn.microsoft.com/en-us/microsoft-copilot-studio/requirements-licensing-subscriptions — Microsoft Copilot Studio licensing
[9] https://claude.com/pricing — Claude current plans and pricing
[10] https://www.anthropic.com/claude-haiku-5-5 — Anthropic Claude Haiku 5.5 announcement
[11] https://www.anthropic.com/claude/fable — Anthropic Claude Fable 5.1
[12] https://developers.openai.com/api/docs/changelog — OpenAI API changelog
[13] https://claude.com/product/cowork — Claude task execution: former Cowork
[14] https://help.openai.com/en/articles/20001275-chatgpt-work-and-codex — OpenAI: ChatGPT, Work, and Codex













