生成AI比較2026|ChatGPT・Claude・Geminiなど42サービスTier表
生成AIを比べるとき、「最新モデルはどれが一番賢いのか」だけを見ても、実際の選びやすさは分かりません。検索には強いけれどファイル作業は苦手、無料では使える範囲が狭い、逆にAIの頭脳にあたる部分だけを見ると目立たなくても、WordやGmailと一緒に使うと便利――そんな違いがあるからです。
この記事では、2026年10月4日時点で日本から利用できる主要な生成AI・AIアシスタント42サービスを、「サービスとして何ができるか」で比べました。難しいモデル名の比較ではなく、一般ユーザーが実際に選ぶときに関係する機能、料金、使いやすさ、データの扱いを中心に見ています。
ここでいう「Tier」は、総合点をもとにS〜Eへ分けたグループです。また「モデル」はAIの頭脳にあたる部分を指します。新しいモデルが発表されても、一般向けサービスですぐ使えるとは限らないため、この記事では別々に考えます。
Tier分布
評価方法|7項目・24点満点
点数は、一般ユーザーが今日使えるサービスとしての使いやすさを見るためのものです。研究用の最新モデルが発表されていても、一般向けの画面で使えなければ点数には入れません。
Tierは満点に対する割合で固定しています。Sは90%以上、Aは80%以上、Bは70%以上、Cは60%以上、Dは50%以上、Eは50%未満です。境目の1点未満でサービスの価値が急に変わるわけではないため、各Tierの最後で境目についても説明します。
「運用実績・成熟度」2点は、サービスがどの程度こなれているか、利用環境が整っているか、外部から確認できる規模や速度の情報があるかを見ています。筆者の体感速度を点数にしたものではありません。なお、日本から利用できること自体は42サービスを選ぶ前提条件で、2点の採点項目ではありません。
S Tier
90%以上|7サービス
検索・ファイル・料金など、全体に大きな弱点が少ないグループです。
Gemini
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Geminiの強みは、Googleのサービスと自然につながることです。インターネット検索や詳しい調査に加え、Gmail、Googleドキュメント、スプレッドシートなど普段使っている情報をもとに作業を進めやすくなっています。日本のGoogle AI Proでは、指示した仕事を画面を開き続けなくても進める「Gemini Spark」も提供対象です。
Googleのサービスを仕事や日常で多く使っているほど便利さを感じやすい一方、Googleとの連携をほとんど使わない人では、優位性は小さくなります。また、Googleが発表した最新AIモデルを、すべて現在のGeminiで使えるとは限りません。本記事では、一般ユーザーが実際に利用できる機能だけを評価しています。
7項目の点数を見る
ChatGPT
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
ChatGPTは、調べもの、文章作成、PDFや表計算の確認、画像、データ分析まで、かなり広い作業を一つの画面で進められるのが強みです。特定のOffice製品やSNSに依存しなくても使いやすいため、「どれか1つだけ選ぶなら」という場面で候補にしやすいサービスです。
ただし、OpenAIが発表した最新機能をすべて同じ料金で使えるわけではありません。通常のチャット、まとまった作業を任せる機能、開発向け機能などは、プランによって使える範囲が違います。この記事では、上位プランだけの機能を一般的な有料プランへ混ぜずに評価しています。
7項目の点数を見る
Microsoft Copilot
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Microsoft Copilotの魅力は、Word、Excel、PowerPoint、Outlookなど、普段のOffice作業の中へAIを入れられることです。個人向けのMicrosoft 365 Premiumは月額3,200円で、Officeアプリやクラウド保存とAI機能をまとめて使えます。AIだけの料金ではなく、Microsoft 365全体の料金として見ると分かりやすいでしょう。
一方で、ネット上には企業向けCopilotの情報も多く、個人向けで同じことができるとは限りません。会社向けの管理機能や高度な連携機能まで、個人版に含まれると考えない方が安全です。WordやExcelをほとんど使わない人では、S Tierの強みを活かし切れない可能性があります。
7項目の点数を見る
Tabbit
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Tabbitは、AIに質問するだけでなく、ブラウザ上の作業そのものを進めてもらいたい人向けです。検索やページの読み取りに加え、Webサイトの操作、資料や画像の作成、深い調査まで同じ環境でつなげられます。Standardは既定ブラウザに設定すると無料で使える仕組みもあり、試しやすさも強みです。
もう一つの特徴は、クラウドAIへ送るデータを保存や学習へ使わせない方針を明確にしていることです。ただし、2026年に本格展開が進んだ新しいサービスなので、成熟度や長期的な安定性はChatGPTやGeminiほど積み上がっていません。機能とデータ保護を両立した新興候補として、今回の基準ではSに入ります。
7項目の点数を見る
Genspark
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Gensparkは、検索して答えるだけでなく、調査した内容をレポート、表計算、スライドなどへ落とし込むところまで進めやすいAIです。複数の工程をAgentがつないで処理するため、「調べる→整理する→成果物にする」を一つのサービス内で完結させたい場面に向いています。
無料版もありますが、重い処理を何度も使う場合はクレジット制限を意識する必要があります。一方、現在の公式方針では各プランでユーザーデータをモデル学習に使わないことが明示されています。無料枠の制約を差し引いても、サービス全体の幅は非常に広く、今回の基準ではS相当です。
7項目の点数を見る
Mistral Vibe
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Mistral Vibeは、AI単体の賢さより「仕事をどこまでつなげられるか」が目立つサービスです。Gmail、Outlook、Slack、Notion、GitHub、Google Driveなど多くのサービスとつなぎ、情報を集めて整理し、資料へまとめる流れを一つの作業として進められます。
こうした連携の広さが、S Tierになった大きな理由です。ただし、これはMistralのAIそのものがChatGPTやClaudeより賢いという意味ではありません。ほかのサービスとの連携が必要な人には強い一方、文章の自然さや難しい問題への回答力は別の比較が必要です。
7項目の点数を見る
Venice AI
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Venice AIは、プライバシーを重視しながら、一般的な総合AIに近い幅広い作業をこなせるサービスです。標準のチャット自体が複数工程を分けて進めるAgentとして動き、Web検索、ファイル分析、画像や動画の生成まで同じ会話の中で扱えます。
特に会話履歴やデータの扱いを製品の中心に置いている点は大きな強みです。その一方、メールや業務SaaSを多数つないで仕事を横断する用途では、連携を前面に出す上位サービスほど広くありません。このデータ保護と総合力の組み合わせを高く評価しました。
7項目の点数を見る
S Tierは7サービス、それぞれ強みの方向が違う
既存のGemini、ChatGPT、Microsoft Copilot、Mistral Vibeに、Tabbit、Genspark、Venice AIが加わりました。GoogleやOfficeとの連携、総合力、外部サービス連携、ブラウザ操作、成果物作成、Privacyと、Sになった理由は同じではありません。共通しているのは、検索・ファイル・複数手順・料金・データの扱いまで見たときに大きな穴が少ないことです。
SとAの境目は21.7点と21.3点
42サービスへ増やしても、SとAの境目に大きな断絶はありません。S最下位はMistral VibeとVenice AIの21.7点、A最上位はGrokの21.3点です。差は0.4点しかなく、速報性を重視する人ならGrokをS Tierより先に選ぶ場面も十分あります。Tabbit 22.2点、Genspark 21.9点がSへ加わりましたが、Tierの基準そのものは動かしていません。
A Tier
80〜89.9%|18サービス
得意分野がはっきりしており、使い方によってはS Tierより合うサービスがあります。
Grok
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
GrokはXとの結び付きが強く、インターネット上の情報だけでなく、いまXで何が話題になっているかを追いやすいAIです。メールやカレンダーなどほかのサービスとの連携も広がっており、単なる「X用のAI」よりかなり幅のあるサービスになっています。
特に速報性を重視する人には魅力があります。ただし、Grokはモデルや新機能の更新が非常に速く、発表された機能がすぐ一般向けサービスで使えるようになるとは限りません。本記事では、発表だけの機能ではなく、一般ユーザーが使える状態になったものを中心に評価しています。
7項目の点数を見る
Claude
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Claudeは、インターネット検索、ファイルの読み書き、プログラムの実行、長い作業の整理など、文章や資料を扱う仕事で使いやすいAIです。有料版では、まとまった仕事を任せたり、決まった時間に作業させたりする機能も増えています。
A Tierなのは「Claudeの回答が弱い」からではありません。今回の点数は、サービスとして使える機能、料金、データの扱いなどを比べたものです。文章の自然さや長文作成の実力まで含めると評価が変わる可能性があるため、そこは別の実測比較に分けています。
7項目の点数を見る
Z.ai
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Z.aiは、無料で使えるチャットに加えて、複数工程を進めるAgentモードやファイル処理を持つ総合AIです。調査や分析だけで終わらず、PDF、Word、Excelなどの形へまとめる作業まで進められるため、無料中心で幅広く試したい人には有力です。
機能面はかなり充実していますが、個人ユーザーが入力した内容について、サービス改善やAI開発へ利用できる規約がある点は確認しておきたいところです。無料・多機能という強みは大きいものの、データの扱いを最優先する人には別候補もあります。この点がSとの差になりました。
7項目の点数を見る
Sider
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Siderは、ブラウザで見ているページ、PDF、YouTubeなどをAIに読ませながら作業を進めるタイプのサービスです。単なるサイドバーAIではなく、Handがページを開き、リンクをたどり、複数ソースを比較し、表やレポートへまとめるところまで動けるため、薄いモデル切替サービスとは分けて評価しています。
利用規模も大きく、普段のWeb作業へAIを組み込みやすいのが強みです。一方で、ブラウザ外まで広くSaaSを動かす自動化や、Privacyを最優先した専用サービスほどの明快さでは一歩譲ります。ブラウザ中心の実務AIとして、総合点20.8は十分に高い水準です。
7項目の点数を見る
Manus
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Manusは、通常のチャットと、自律的に作業を進めるAgentを分けて使えるサービスです。Chatでは検索やPDF・画像・テキストを扱い、Agentでは依頼を分解して、Webサイト、スライド、動画などの成果物まで作る流れをまとめて進められます。
無料で使えるチャット部分は入りやすい一方、Agentを頻繁に動かすと利用枠やクレジットの影響を受けます。また、Team向けに明示されるデータ学習オプトアウトを個人向けProへそのまま当てはめることはできません。機能はS級に近いものの、料金とデータ面を含めると一段下に落ち着きます。
7項目の点数を見る
Skywork
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Skyworkは、調査結果を読むだけでなく、文書、表、スライド、Webサイトなどへ変換して使いたい人向けです。Super AgentとDeep Researchを中心に、複数の情報源を調べ、引用付きで整理し、そのまま成果物を作るところまで一つのサービスで進められます。
無料でも一定量を試せますが、複雑な生成や継続利用ではクレジットを意識する必要があります。検索、ファイル、Agent、成果物作成の幅は非常に広く、使い方が合えば上位サービスに近い便利さがあります。無料枠とクレジット制まで含めると、総合点は20.6です。
7項目の点数を見る
MiniMax Agent
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
MiniMax Agentは、Web検索やファイル分析だけでなく、Office系の成果物やコンピューター操作まで含めた広い作業をAgentへ任せられるサービスです。無料クレジットが用意されており、まず試したうえで必要なら個人向け有料プランへ移れる構成です。
複数工程を任せる力は強いものの、重い作業を続けると無料枠だけでは足りません。また、ユーザーコンテンツに関する規約はPrivacyを最優先したサービスほど限定的ではありません。Agentの総合力は高い一方、料金とデータ面が上限を抑えています。
7項目の点数を見る
You.com
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
You.comは、AI検索サービスとして出発しながら、現在はファイル、画像、複数のAgentを扱える総合的なAI環境へ広がっています。調べものだけでなく、目的に応じたAgentを選び、情報整理や成果物作成まで進めたい人に向いています。
検索を軸にした使いやすさは強い一方、無料版だけですべての高度な機能を十分に使えるわけではありません。有料版を含めればかなり万能ですが、料金と利用枠が、Sへ一歩届かなかった主な理由です。
7項目の点数を見る
Merlin
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Merlinは、複数の主要AIモデルを一つにまとめながら、Web検索、文書分析、画像・動画生成など多数のツールを使えるAIアシスタントです。ブラウザ拡張、Web、モバイルなどから使え、調査や資料作成を日常の作業へ組み込みやすいのが特徴です。
無料版もありますが、高度なモデルや各種ツールをしっかり使うならProが中心になります。幅広い機能は魅力ですが、サイトを横断して自律的に操作する専用Agentほど自動化は強くありません。自動化の差はあるものの、総合力では20点台を確保しました。
7項目の点数を見る
Monica
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Monicaは、複数のAIモデルをまとめて使えるだけでなく、検索、PDF読解、文章作成、画像・動画生成まで揃えたオールインワン型です。現在はMonica Agentも用意され、Deep Researchで調査し、Browser OperatorでWebを操作し、スライドへ仕上げるところまで一つの流れで進められます。
ブラウザ拡張だけでなく、デスクトップやモバイルでも使えるため利用環境は広めです。一方、2026年のデータ移行問題やPrivacy文書の更新状況を踏まえ、データの扱いは強気に評価していません。機能の広さは明確な強みですが、データ面は慎重に見る位置付けです。
Flowith
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Flowithは、単純なチャット画面ではなく、複数の生成処理やAgentを作業空間の中で組み合わせるサービスです。Agent Neo、Deep Research、スライド、Webサイト、画像・動画生成などが用意され、調査と制作を行き来する仕事に向いています。
Starterは無料ですが、現在の無料クレジットは小さく、重い処理を続けるにはPro以上が現実的です。有料版は機能量が多い一方、クレジット制なので使い方によって消費差も大きくなります。無料枠とクレジット制まで含めると、総合点は20.0です。
7項目の点数を見る
Proton Lumo
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Proton Lumoは、便利さより先に「入力した内容をどう守るか」を重視したAIです。保存した会話を暗号化し、入力内容をAIの学習に使わない方針を明確にしています。無料版があり、ファイルの確認や画像生成なども利用できます。
その代わり、メールや業務アプリを次々につないで自動で仕事を進める方向は、ChatGPTやGeminiほど広くありません。仕事の自動化より「AIへ渡すデータをできるだけ慎重に扱いたい」という人に向いたサービスです。
7項目の点数を見る
Kimi
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Kimiは、調べるだけでなく、その結果を文書、表計算、スライドなどへまとめるところまで進めやすいAIです。資料を作る仕事が多い人にとっては、AIとの会話で終わらず、成果物まで持っていけるのが大きな魅力です。
一方で、高度な調査や資料作成などは、同じ利用枠(使える量)から差し引かれます。たくさんの機能があるからといって無制限に使えるわけではありません。日常的に重い作業を何度も任せたい場合は、料金だけでなく利用枠も確認しておく必要があります。
7項目の点数を見る
HIX AI
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
HIX AIは、複数モデルを切り替えるだけのサービスではなく、Agent Workspaceとして調査、ファイル、文書、スライド、画像や動画の生成までまとめています。質問への回答だけで終わらず、調べた内容をそのまま成果物へ移したい場面で使いやすい構成です。
無料で試せる範囲はありますが、継続して高度な作業を行うなら有料版が中心になります。Agent機能と制作機能の幅は広いものの、無料版の実用性とPrivacyを保守的に見た結果、19.6点となりました。
7項目の点数を見る
Nova
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Novaは、無料版の時点でWeb検索、ファイル、画像、PDF、Excel、Deep Research、Projects、Memoryなどを広く扱えるAIアシスタントです。まず費用をかけずに総合AIの使い方を試したい人には、入口がかなり広いサービスです。
一方、Web版の個人向けProは月額29.99ドルで、低価格の多モデルサービスより高めです。モバイルでは別の週払い・年払い体系も案内されているため、契約経路ごとの価格確認が必要です。データ処理に関する開示もPrivacy特化型ほど単純ではありません。無料版の幅が高評価の中心ですが、料金とデータ面には注意が残ります。
7項目の点数を見る
Opera AI
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Opera AIはブラウザそのものにAIが入っているため、いま開いているページや複数のタブを見ながら質問できるのが便利です。別のAIサイトへ文章をコピーして移動する手間が少なく、ウェブを見ながら要約や確認をする使い方に向いています。
一方、WordやExcelを含む仕事全体をまとめて動かしたり、多数のサービスをまたいで作業したりする機能は上位勢ほど広くありません。Operaを普段のブラウザとして使う人には便利ですが、仕事全体を一つのAIにまとめたいなら、別のサービスも比較した方がよいでしょう。
7項目の点数を見る
Qwen
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Qwenは、無料で使える範囲が広く、文章だけでなく画像、動画、音声なども扱えるのが特徴です。まず費用をかけずに、いろいろな生成AIの使い方を試してみたい人には入りやすいサービスです。
ただし、研究段階の最新AIモデルの性能は、そのまま一般向けQwenの評価には加えていません。また、入力したデータの扱いを最優先するなら、LumoやBrave Leo、Duck.aiのように入力データの保護を前面に出すサービスも比較した方が安心です。
7項目の点数を見る
ChatLLM
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
ChatLLMは、Abacus.AIが提供する多モデル型のサービスですが、単なるモデル一覧ではありません。General Purpose Agent、Deep Research、ファイル分析、コード実行、画像・動画、Projectsなどを一つの作業環境にまとめており、調査や制作を幅広く進められます。
機能だけを見れば上位候補ですが、アプリを無料でダウンロードできることと、恒久的な無料プランがあることは別です。現在は継続利用に有料契約が必要な設計として評価しています。無料版の弱さが響き、Aの下限となる19.2点です。
7項目の点数を見る
A Tierは「Sに少し足りない」だけの集まりではない
A Tierには、速報性、文章・資料作業、Privacy、資料生成、ブラウザ一体型、無料・多機能、Agent Workspaceなど、違う方向の強みが集まりました。総合点ではSに届かなくても、使い方が合えばAの方が便利です。
AとBは19.2点と19.0点でほぼ隣り合う
A最下位はQwenとChatLLMの19.2点、B最上位はPoeとChat Smithの19.0点です。差は0.2点だけです。Qwenは無料で使える範囲、ChatLLMは作業環境の広さ、PoeとChat Smithは複数モデルをまとめて扱える点に強みがあり、Tierの文字だけで優劣を決めるより、自分の使い方に合うかを見る方が実態に合います。
B Tier
70〜79.9%|10サービス
十分実用的ですが、向いている人や使い方がはっきり分かれるグループです。
Poe
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Poeは、一つのAIだけに決めず、複数社のAIや、用途別に用意されたAIを同じ画面から使えるサービスです。文章はこのAI、画像は別のAIというように、用途ごとに切り替えたい人には独自の便利さがあります。
ただし、定額料金を払えば何でも無制限という仕組みではありません。使うモデルによって消費するポイントが変わるため、利用量を意識する必要があります。また、Poe上でユーザーが公開しているAIでは、データの扱いが公式提供のAIと同じとは限らない点にも注意が必要です。
7項目の点数を見る
Chat Smith
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Chat Smithは、複数モデル、ライブWeb検索、ファイル、Deep Researchなどを比較的低い料金でまとめて使えるサービスです。無料版にも検索や画像生成などがあり、まず試してからProへ移る導線が分かりやすいのが強みです。
公式には学習利用を抑える説明がありますが、アプリストアのデータ安全表示には慎重に見るべき点もあります。また、Agentと呼べる機能はあるものの、ブラウザやコンピューターを長時間自律操作する上位勢ほど強くありません。この差でAの基準には0.2点届きませんでした。
7項目の点数を見る
Meta AI
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Meta AIは、Facebook、Instagram、Messenger、WhatsAppなど、Metaのサービスを使っている人がその流れの中でAIへ質問したり、画像を作ったりできるのが特徴です。わざわざ別のAIサイトへ移動しなくても使える手軽さがあります。
ただし、Metaが発表する機能の中には、国によって提供時期が違うものがあります。本記事では、日本でまだ使えない機能を点数へ足していません。SNSの中で気軽に使うには便利ですが、仕事用のファイル処理や、ほかのサービスとの連携を重視するなら、上位の総合AIの方が向いています。
7項目の点数を見る
Comet
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Cometは、Perplexityの検索をブラウザに組み込むだけでなく、開いている複数タブの内容を理解しながら作業を進めるAIブラウザです。ページの要約や調査に加え、フォーム入力、買い物、メール、カレンダーなど、実際のWeb操作までAgentへ任せられます。
ブラウザとしての入口は広い一方、Agentを本格的に使う場合はPerplexityの利用プランや上限を確認する必要があります。自動操作の強さは明確ですが、無料AIとしての評価を抑えた結果18.3点です。
7項目の点数を見る
Opera Neon
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Opera Neonは、従来のブラウザにAIチャットを足しただけではなく、AI Agentがページを操作し、調査や作業を進めることを前提にしたブラウザです。Chat、Do、Makeなどを使い分け、自律ブラウジングやDeep Research、Skillsといった機能を利用できます。
ブラウザ自体は無料で入手できますが、Neon自身のAI機能を使うにはStandard契約が必要です。そのため「無料ブラウザ=無料でAgentも使える」とは評価していません。Agent性能は強いものの、無料版の弱さが総合点を大きく押し下げています。
7項目の点数を見る
MaxAI
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
MaxAIは、ブラウザのサイドバーから複数のAIモデルを使い、Web検索、PDF要約、スクリーンショットの理解、翻訳、文章作成などをすぐ呼び出せるサービスです。日常のWeb作業をAIで補助する用途では扱いやすく、無料版も用意されています。
一方で、強みはあくまで「ブラウザ作業を助ける」方向で、複数サイトやアプリをまたいで長い仕事を自律的に完了させるAgentとは性格が違います。幅広い便利ツールとしては優秀ですが、この自動化の差がAへ届かない主因です。
7項目の点数を見る
Brave Leo
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Brave Leoは、Braveブラウザで開いているウェブページやPDFをそのまま読みながら使えるAIです。無料版はアカウントなしでも使え、会話内容をAIの学習に使わない方針が明確です。
ウェブページの要約、翻訳、文章作成などには向いていますが、複数の業務アプリをまたいで作業する機能は大手の総合AIほど広くありません。便利さとデータの扱いの両方を取りたい人に合うサービスです。
7項目の点数を見る
Fellou
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Fellouは、検索や要約だけでなく、Browser UseとComputer Useを使って実際の操作を進めるAgentic Browserです。画像、音楽、コードなどのAgentも用意され、複数の作業を一つのブラウザから動かしたい人には面白い選択肢です。
ただし無料の新規ボーナスは目安で約4タスク分と小さく、Plusでも月の作業回数は複雑さによって大きく変わります。Agentそのものは強いのに、利用量の制約が総合点を17.8まで押し下げています。
7項目の点数を見る
Rakuten AI
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Rakuten AIは、楽天の各種サービスとつながることに意味があるAIです。たとえば買い物では、会話しながら条件を伝えて商品候補を絞り込むといった使い方ができます。楽天市場など、普段の買い物の流れの中で使えるのが特徴です。
逆に、楽天のサービスをほとんど使わない人では優位性が下がります。また、楽天が開発しているAIモデルそのものと、一般ユーザー向けのRakuten AIサービスは別です。本記事では、研究段階のAI性能ではなく、実際のサービスとして何ができるかを評価しています。
7項目の点数を見る
Duck.ai
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Duck.aiは、無料で複数のAIを選んで使いながら、会話データの扱いを慎重にしたい人向けです。DuckDuckGoは、通常のチャットを保存せず、会話をAIの学習に使わない契約を結んでいると説明しています。
その代わり、ほかのサービスとつないで仕事を自動で進める機能はほとんどありません。AIへ入力する内容の扱いを優先するなら魅力がありますが、ファイル整理から資料作成まで全部任せたい人には物足りないでしょう。
7項目の点数を見る
B Tierは「弱いAI」ではなく、得意な使い方がはっきりする
複数AIの使い分け、SNS、ブラウザとデータ保護、楽天サービス、AIブラウザ、自動操作など、選ぶ理由がはっきりしたサービスが並びます。何でも一つで済ませる総合力では上位に及ばなくても、目的が一致すれば十分に有力です。
BとCの境目も0.3点
B最下位のDuck.aiは17.0点、C最上位のChatOnは16.7点です。Duck.aiは入力データ保護、ChatOnは検索・ファイル・低価格の有料プランが強く、得意分野はかなり違います。Cだから実用性が低いという意味ではなく、総合AIとして足りない部分がどこにあるかを確認するための区分です。
C Tier
60〜69.9%|5サービス
強い得意分野はある一方、何でも任せるには足りない部分が複数あります。
ChatOn
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
ChatOnは、リアルタイムWeb検索、PDFや文書の読み取り、画像・動画生成などをまとめたモバイル向けAIです。日本向けの有料価格も比較的入りやすく、検索とファイルを中心に使うなら機能不足を感じにくい構成です。
一方で、複数工程を自動で進める独自Agentは上位勢ほど確認できません。また、アプリのデータ収集やトラッキングに関する開示もあり、Privacyは控えめに評価しています。便利な多機能AIですが、Agentとデータ面の弱さが総合点を抑えています。
7項目の点数を見る
Agent i
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Agent iは、質問したときだけ答えるAIではありません。登録したキーワードのニュース、商品の値下がり、イベント情報などを継続して確認し、Yahoo! JAPANアプリやLINEへ知らせることができます。「毎日調べる作業」を代わりに続けてもらえるのが特徴です。
一方で、PDFを詳しく読んだり、表計算を分析して資料を作ったりする仕事は、総合AIほど得意ではありません。買い物や生活情報の見守りには面白いサービスですが、何でもできるAIとして見るとC Tierになります。
7項目の点数を見る
Dia Browser
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Dia Browserは、見ているページだけでなく、タブや接続した仕事ツールの文脈を使ってAIへ質問できるブラウザです。上位プランでは日次ブリーフ、レポート、デッキ、会議の準備やフォローまで扱え、通常のサイドバーAIより深く仕事へ入り込みます。
ただし現在の無料プランはブラウザ部分が中心で、AI機能は試用終了後に有料契約が必要です。AIを常用する入口としては無料勢より重く、Agent性能も最上位ブラウザほど強くありません。AI機能の有料化が、総合点を大きく下げる要因になりました。
7項目の点数を見る
Dola
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Dolaは、旧Ciciから名称変更された大規模なモバイルAIアシスタントです。検索、Webページやファイルの要約、画像生成など、普段使いのAI機能を無料中心で広く試せます。長い運用実績と利用規模は、新興サービスにはない強みです。
ただし、Webサイトを横断して複数工程を完了するような自律Agentは弱めです。さらに、質問や回答をモデル学習へ使う設定はオプトアウト方式で、アプリ側のトラッキング開示もあります。日常用途には便利ですが、AgentとPrivacyが上位へ届かない主因です。
7項目の点数を見る
DeepSeek
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
DeepSeekは、無料で高性能なAIを使いたい人にとって非常に分かりやすい選択肢です。ウェブやアプリから利用でき、費用をかけずに高性能なAIへ触れられることが大きな強みです。
それでもC Tierなのは、今回が「AIの賢さランキング」ではないからです。検索、ファイル、ほかのサービスとの連携、仕事を任せるといった機能の広さでは、ChatGPTやGeminiなどに差があります。回答性能だけを比べれば、位置が変わる可能性があります。
7項目の点数を見る
C Tierは「得意分野はあるが、万能ではない」
Agent iの継続チェック、DeepSeekの無料性能、ChatOnの検索・ファイル、Dia Browserのタブ文脈、Dolaのモバイル中心の使いやすさなど、それぞれ明確な魅力があります。一方で、Agent、無料枠、Privacyなど複数の軸に弱点が残るため、総合点ではCに収まりました。
CとDの境目は1.7点
C最下位のDeepSeekは15.8点、D最上位のHuggingChat Omniは14.1点です。ここは上の境界より差がありますが、Dが「回答品質の低さ」を意味するわけではありません。今回の基準では、日常のメインAIとして使えるサービス機能の幅が点差に表れています。
D Tier
50〜59.9%|2サービス
独自の価値はありますが、毎日使うメインAIとしては人を選びます。
HuggingChat Omni
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
HuggingChat Omniは、OpenAIやGoogleのような一つの会社へ固定されず、さまざまな公開AIモデルを試せるサービスです。AIの中身となるモデルを比較したい人や、新しい公開AIモデルを追いたい人には面白い場所です。
ただし、日常のメインAIとして見ると、無料利用枠や使えるモデルが変わりやすく、料金体系や、自動で仕事を進める仕組みも、上位サービスほど分かりやすくありません。新しいAIモデルを試す場所としては価値がありますが、毎日使うメインAIとして見るとD Tierという判断です。
7項目の点数を見る
Pi
※ AIの賢さではなく、使える機能・料金・ほかのサービスとの連携・入力データの扱いなど7項目の合計です。
Piは、資料作成や複雑な調査より、継続的な会話や日常のサポートに軸足を置くAIです。Memory、Reminder、計画やタスク整理、音声などがあり、前の会話を踏まえて付き合うパーソナルアシスタントとして独自の立ち位置があります。
一方、PDFや表計算を読み込んで成果物を作る仕事、複数サービスをまたぐ自動化、幅広いWeb調査では総合AIに大きく及びません。D評価は会話品質が低いという意味ではありません。今回の「サービスとしてできること」の幅では13.9点に留まりました。
7項目の点数を見る
D TierはHuggingChat OmniとPiの2サービス
HuggingChat Omniは公開AIモデルを試す場所、Piは会話・Memory・Reminderを中心とする個人アシスタントとして独自の価値があります。ただし、ファイル、検索、成果物作成、自動化まで含めた総合AIとして見ると用途が限られます。
E Tier
50%未満|該当なし
下位を埋めるために無理にサービスをEへ押し下げてはいません。
用途別に見ると、Tier以上に差が分かりやすい
| 重視すること | 候補 | 理由 |
|---|---|---|
| 1つで幅広く使いたい | ChatGPT / Gemini | 調べもの、ファイル、画像、データなどを広く扱える |
| Word・Excel中心 | Microsoft Copilot | Microsoft 365の中でそのままAIを使える |
| 外部サービスをまたいで仕事 | Mistral Vibe | メール、Slack、Notion、GitHubなどとの連携が広い |
| ブラウザでサイト操作まで任せたい | Tabbit / Comet / Opera Neon / Fellou | 閲覧中のページを読むだけでなく、ブラウザ上の複数手順まで進められる |
| 調査から資料・成果物まで作りたい | Genspark / Manus / Skywork / MiniMax Agent | 調査後に文書・表・スライド・Web成果物へつなげやすい |
| 速報・Xの情報 | Grok | インターネットとXの最新情報を追いやすい |
| 文章・知識作業 | Claude | ファイルや長い作業を落ち着いて扱いやすい |
| 入力データの扱いを重視したい | Venice AI / Proton Lumo / Tabbit / Brave Leo / Duck.ai | 学習利用や保存を抑える方針を比較的明確に打ち出している |
| 複数モデルを低コストで使い分けたい | Chat Smith / Monica / Sider | 1つのサービス内で複数社モデルと独自ツールをまとめて使いやすい |
| 無料で幅広く試したい | Qwen / DeepSeek / Z.ai | 無料でも会話以外の機能へ触れやすい |
| 楽天をよく使う | Rakuten AI | 楽天市場など国内サービスとつながる |
| 値下がりやニュースを見張ってほしい | Agent i | 継続チェックしてLINEなどへ通知できる |
この点数で分かること・分からないこと
24点満点の「サービス総合点」は、検索、ファイル、ほかのサービスとの連携、サービスの成熟度・運用実績、無料版、有料版、データの扱いを比べた点数です。AIの頭の良さや文章のうまさを24点で表したものではありません。 たとえばDeepSeekがC Tierだからといって、回答の質がCという意味ではありません。
反対に、Mistral VibeがS Tierだからといって、難しい質問への回答がClaudeより優れていると断定することもできません。回答品質、日本語の自然さ、間違いにくさ、実際に長い仕事を最後までやり切れるかは、別の「実際に使った比較」で確認する必要があります。
結局どれを選べばいい?
特にこだわりがなく、まず1つ使ってみたいならChatGPTかGeminiが選びやすいでしょう。WordやExcelを毎日使うならMicrosoft Copilot、ほかのサービスをまたいだ作業が多いならMistral Vibe、Xや速報性を重視するならGrokと、普段の使い方を一つ決めるだけで候補はかなり絞れます。
大切なのは、Tierの文字だけで決めないことです。BやCでも、自分の目的にぴったり合えばSより使いやすいことがあります。各カードの「こんな人向け」「ここが強い」「ここは注意」を見て、自分の使い方と照らし合わせてください。
更新方針
基準日は2026年10月4日です。新しいAIモデルが発表されただけでは点数を変えません。日本の一般向けサービスで実際に使えるようになり、検索、ファイル、ほかのサービスとの連携、料金、無料枠、データの扱いなど今回の評価項目に影響する変更があったときに更新します。