AIチャットの比較|同じ問いを投げて答えの向き不向きを見る
ai チャット 比較で検索すると、おすすめ12選、18選、17選といった一覧が並ぶ。読み進めても決まらないのは、情報が足りないからではない。同じ一覧の中に、性格の違う2つの商品が混ざっているからになる。毎日の調べものや文章づくりに使う対話型のサービスと、自社サイトの問い合わせを自動で処理する仕組みは、比べる軸がまったく別になる。ここでは、その2つを先に分け、公開されている料金を同じ表に並べ、そのうえで自分の仕事で測る手順を組む。判断の材料は、他人が付けた点数ではなく、自分の代表的な仕事を投げたときの結果になる。
一覧に混ざっている2つの市場を先に分ける
上位の記事を並べて見ると、同じ「AIチャット」という語で2つのものが扱われている。片方は、利用者が自分で開いて質問する汎用の対話型サービスになる。もう片方は、企業が自社の問い合わせ窓口に置く自動応答の仕組みになる。後者の説明は、たとえば次のような形で書かれている。
Zendesk AIは、世界10万社以上の導入実績を持つカスタマーサポートプラットフォーム「Zendesk」にAIエージェント機能を統合したサービスです。既存のZendesk環境にシームレスに導入でき、チケットの自動分類や優先度の判定、回答候補の提示といった機能でオペレーターの業務負荷を大幅に軽減します。 出典: japan-ai.co.jp
読んで分かる通り、こちらの評価軸は既存システムとの接続、チケットの分類精度、対応チャネルの範囲になる。導入を決めるのは情報システムの担当者で、検討には見積もりと社内の承認が必要になる。一方、汎用の対話型サービスの評価軸は、答えの質、扱える入力の長さ、出典の出し方、月額の負担になる。決めるのは使う本人で、検討期間は数日で足りる。
この2つを同じ表に並べた記事は、どちらの判断にも使えないことになる。最初にやることは、いま探しているのがどちらなのかを決めることで、それだけで候補は半分以下に減る。以下は、自分で開いて使う汎用の側に絞って進める。
候補が絞れないのは、比べる前提が揃っていないから
汎用の側に絞ってもなお決まらない理由は、上位記事も認めている。
チャット型AIツールの種類が増え、「どれを選べばいいかわからない」と感じているビジネスパーソンも多いのではないでしょうか。ChatGPTをはじめ、Gemini・Claude・Perplexityなど、特徴の異なるツールが次々と登場し、選択肢はますます広がっています。 出典: genee.jp
ただし、選べない原因は種類の多さそのものではない。比較記事が書かれた時点のモデル名と、いま画面に出ているモデル名が違うことにある。汎用の対話型サービスは、料金の体系もモデルの世代も数か月単位で入れ替わる。半年前の比較表は、価格の桁だけが合っていて中身が別物になっていることがある。
だから、比較の方法そのものを変えることになる。他人の評価を読んで決めるのではなく、自分の仕事から代表的な問いを選び、候補に同じものを投げて手元で見る。この手順であれば、モデルの世代が変わっても同じやり方を繰り返せる。所要は1時間ほどで、無料の枠だけでもおおよその見当は付く。
種類で分けると、候補の数は先に減る
汎用の側に絞ったあとでも、まだ性格の違うものが混ざっている。上位の記事が立てている分類を借りると、おおよそ4つの系統になる。
1つ目は汎用型で、文章を書く、要約する、考えを整理するといった幅広い用途を1つの窓で受ける。最初に試すのはここで、ほとんどの人の主力になる。
2つ目は検索連携型で、いまのWebを調べてから答え、参照した元を並べる形を取る。事実を扱う仕事の比率が高い人は、主力をこちらに置いたほうが確認の手間が減る。
3つ目は開発特化型で、コードの読み書きや手元のファイルの操作に寄っている。文章の用途では過剰になることがある。
4つ目は軽量型やローカルで動くもので、手元の機械の中だけで完結する。外に出せない情報を扱う場合に候補になるが、答えの質は上位の商用サービスとは別の水準になる。
候補を並べるとき、この4つのうち自分がどれを主力にするかを先に決めると、比べる相手は3つか4つに収まる。18本の一覧をそのまま比べようとすると決まらないのは、性格の違うものを同じ軸に乗せているからになる。
主力を決めたあとで、2番目の系統を1つだけ足す形が扱いやすい。汎用型を主力にして検索連携型を調べもの用に足す、あるいは検索連携型を主力にして開発特化型を手元の作業用に足す。3つ以上を並行して使うと、どれに投げたか分からなくなる時間のほうが得より大きくなりやすい。
料金は、通貨の違いまで含めて並べる
比べる前に、費用の形を揃えておく。以下は、それぞれの提供元が公開している個人向けの月額になる。
| サービス | 無料の枠 | 中位のプラン | 上位のプラン |
|---|---|---|---|
| ChatGPT | あり | Go 月額1,400円 / Plus 月額3,000円 | Pro 月額16,800円から |
| Claude | あり | Pro 年払いで月17ドル(月払いは20ドル) | Max 月100ドルから |
| Google AI | Geminiに無料の枠あり | Plus 月額725円 / Pro 月額2,900円 | Ultra 月額14,500円から |
この表で気を付ける点が3つある。
1つ目は通貨になる。円で提示される場合とドルで提示される場合が混在していて、ドル建てのものは為替で実際の請求額が動く。年間の負担を比べるときは、同じ日のレートに換算してから足す必要がある。
2つ目は年払いの割引になる。たとえばClaudeのProは年払いにすると1か月あたりの額が下がる形で、年額を一括で支払うことになる。月額の数字だけを横に並べると、支払い方の違いが消えてしまう。
3つ目は付いてくるものになる。Google AIのプランは、ストレージの容量が段階ごとに変わる作りになっていて、Plusで400GB、Proで5TB、Ultraでは20TB以上が付く。すでに写真やファイルの保存で容量を買っている人は、その支出と重なる分を引いて考えることになる。AIの利用枠だけを比べると、この重複が見えない。
無料の枠で比べると、判断を誤りやすい場所がある
無料の範囲で試すのは正しい進め方だが、無料のまま結論を出すと外すところがある。
上限の当たり方が違う。無料の枠は、送れる回数、添付できるファイル、画像の生成、長い調査の実行といった項目ごとに別々に絞られている。文章を書かせる用途では十分に見えても、資料を10本読ませる用途では最初の数分で止まる。仕事で使う予定の作業を投げないと、この差は出てこない。
使えるモデルが違う。無料の枠では上位のモデルに回数の制限が付き、混雑時の速度も抑えられる。答えの質を比べているつもりで、実際には枠の差を比べていることになりやすい。
記憶と設定が効かない場合がある。有料のプランでは、過去のやり取りを踏まえる範囲が広がり、案件ごとに素材や指示をまとめて置ける機能が付く。毎日同じ前提を説明し直す手間がここで消えるので、日常の使い勝手は無料の範囲だけでは測れない。
もう1つ、無料の枠では気付きにくいのが混雑の影響になる。同じ問いを同じサービスに投げても、時間帯によって待ち時間と答えの長さが変わることがある。比べる作業を1日のうちの1つの時間帯にまとめて行うと、この揺れが結果に混ざりにくくなる。逆に、朝に片方、夜にもう片方を試すと、サービスの差ではなく時間帯の差を見ていることになる。
判断の順番としては、まず無料で候補を3つに絞り、残った1つか2つを1か月だけ有料で使う形が現実的になる。1か月分の支出は、選び間違えて1年払い続ける額よりはるかに小さい。
同じ問いを投げて測る手順
手元で測る作業は、次の形に落とすと再現できる。
- 自分の仕事から代表的な問いを5つ選ぶ。よくやるものを選ぶことが肝心で、難問を選ぶと日常の性能が測れない
- 5つとも同じ文面で、候補のすべてに投げる。指示の書き方を相手ごとに変えると比較にならない
- 返ってきたものを4つの軸で見る。事実の確かさ、出典が辿れるか、こちらの指示の細かい条件を守っているか、手直しにかかった時間
- 手直しの時間だけは秒で記録する。印象は当日で薄れるが、この数字は残る
軸のうち、実務でいちばん効くのは4つ目になる。答えの見栄えが良くても、毎回同じ箇所を直しているなら、その分は自分の作業時間として毎日積み上がる。逆に、素っ気ない答えでもそのまま使えるなら、月末の差は大きい。
もう1つ足すとよいのは、断り方の観察になる。分からないことを分からないと返すか、それらしい形で埋めてくるか。後者は、こちらが検算しない限り気付けないので、確認の手間が固定費として乗る。5問のうち1問は、意図的に答えの無い問いを混ぜておくと、この性格が見える。
選び方の軸は、機能表より4つの性格に出る
機能の一覧表は似た形になりやすい。実際に差が出るのは、次の4つになる。
出典の出し方。調べものが主な用途なら、参照した元をその場で並べる設計かどうかが分かれ目になる。後から自分で確かめる作業の量が変わる。
長い入力の扱い。契約書や仕様書をまとめて読ませるなら、一度に渡せる分量が上限になる。分割して渡す運用は手間が増え、前後の整合も崩れやすい。
他の道具との接続。すでに使っている表計算や文書やチャットの側から呼び出せるかどうかで、切り替えの回数が変わる。ここは会社が契約している基盤に引っ張られるので、自由に選べないことも多い。
データの扱い。入力した内容を学習に使うかどうか、その設定を自分で切れるかどうかは、提供元の公開している条件で確かめることになる。業務で使うなら、料金より先に見る項目になる。
この4つで並べると、候補は自然に役割分担の形になる。1つに絞るのではなく、調べものはこちら、長い文書はこちら、という配り方になることが多い。
併用が決まったあとに出る、画面の側の問題
比較の結論が「2つを使い分ける」になった時点で、性格の違う問題が立ち上がる。どちらもブラウザの中で動くサービスなので、タブが増え、どちらのタブがどちらだったか分からなくなり、切り替えのたびに目で探すことになる。
同じ会社のサービスを仕事用と私用で使い分けている場合は、もう1段面倒になる。ブラウザのプロファイルは1つのログイン状態しか持てないため、同じサービスの2つのアカウントを同時に開いたままにはできない。無料の枠を私用で、有料のプランを仕事で使っている人がここで詰まる。
この部分は、サービス側の設定ではなく手元の道具で解く形になる。サービスごとに窓とログイン状態を分けるアプリごとに独立したワークスペースという設計であれば、2つを並べて開いたまま、キーひとつで行き来できる。並べ方の考え方はワークスペースのページに整理されていて、どのサービスが分けて開けるかは使えるアプリの一覧で確かめられる。
同じ考え方の道具は複数あるので、違いを先に知りたい場合はWaveboxとの比較が近い。ログイン状態をどう分けているかという仕組みの説明はよくある質問にあり、窓の側で何ができるかはできることのページに並んでいる。比較の作業で決めるのは契約先で、毎日の速さを決めるのは、決めたあとの置き場所になる。
よくある質問
AIチャットの比較記事を読んでも決まりません。何から始めればよいですか?
自分の仕事から代表的な問いを5つ選び、同じ文面で候補すべてに投げるところから始めてください。よくやる作業を選ぶことが肝心で、難問を選ぶと日常の性能が測れません。手直しにかかった時間を秒で記録すると、印象ではなく数字で比べられます。
無料の枠だけで比べても判断できますか?
候補を3つ程度に絞る用途なら使えます。ただし無料の枠は使えるモデルや回数が絞られているため、答えの質ではなく枠の差を比べてしまいがちです。残った1つか2つを1か月だけ有料で使うと、選び間違えて1年払い続けるよりも負担は小さく済みます。
料金を比べるときに見落としやすい点はどこですか?
通貨と支払い方と付属分の3つです。円建てとドル建てが混在するため同じ日のレートに換算する必要があり、年払いにすると月あたりの額が下がるものもあります。ストレージ容量が付くプランは、すでに払っている保存の費用と重なる分を引いて考えてください。
1つに絞るべきですか、それとも複数を併用すべきですか?
出典の出し方、長い入力の扱い、他の道具との接続、データの扱いという4つの性格で並べると、調べものと長い文書で向きが分かれることが多くなります。併用する場合は、タブではなくサービスごとに窓を分けると、切り替えで探す時間が減ります。