
生成AIのAPI料金比較とは、ChatGPT・Claude・Geminiを自社のシステムから呼び出すときの料金を、同じ使い方に置き換えて横に並べることです。1回に入力2,000・出力1,000トークン、社員1人が月400回使う条件を1ドル=150円で計算すると、上位モデルの1人あたり月額はgpt-6-astraとClaude Fable 5.1が4,200円、Gemini 3.1 Pro Previewが960円となります。軽量モデル同士ではgpt-6-lunaが42円、Gemini 3.1 Flash-Liteが120円、Claude Haiku 4.5が420円と、同じ使い方でも10倍の開きが出てしまいます。ただし、どれもAPI利用料だけの机上の計算で、社員が使う画面・権限・ログ・キーの管理は自社で用意することになるため、自作か会社定額のサービスかはそこで見極めましょう。
同じ使い方で比べた答え|上位は約4.4倍、軽量は10倍の差
同じ使い方で比べると、3社の1人あたり月額の差は、上位モデル同士で約4.4倍、軽量モデル同士で10倍になります。ここでの同じ使い方とは、1回の依頼で入力2,000トークン・出力1,000トークンを使い、社員1人が1日20回、月20営業日で月400回使う想定を指しています。トークンとは、AIが文章を数えるときの単位で、APIの料金はこの数で決まる仕組みです。詳しい数え方は生成AIのトークンとはで整理しているので、あわせて読んでみてください。
各社1社ずつの単価表や人数別の細かな試算は、ChatGPT API料金の解説とGemini API料金の解説に分けてまとめています。ここでは3社を同じ物差しで横に並べることと、APIで自作するか会社定額のサービスを使うかの分かれ目に絞って見ていきます。
| 段 | OpenAI | Anthropic(Claude) | Google(Gemini) |
|---|---|---|---|
| 上位 | gpt-6-astra 4,200円 | Claude Fable 5.1 4,200円 | Gemini 3.1 Pro Preview 960円 |
| 中位 | gpt-6.1-sol 840円 | Claude Sonnet 5.5 840円 | Gemini 3.8 Flash 315円(2027年1月から630円) |
| 軽量 | gpt-6-luna 42円 | Claude Haiku 4.5 420円 | Gemini 3.1 Flash-Lite 120円 |
※社員1人あたりの月額です。1回=入力2,000・出力1,000トークン、月400回で計算し、1ドル=150円で計算した場合の金額を示しています。料金は2026年10月4日時点で各社の公式ページに表示されている標準の単価で、税は含みません。Claude Opus 5.5(1人あたり1,680円)は上位と中位の間の単価のため、表の外に置いています。Claude 4.7以降は同じ文章でトークンが約3割多く数えられる点を計算に入れていません。
表の数字は、各社が公式ページに表示している単価、つまり各社の自己申告の表示価格から計算した机上の試算で、実際に使って測った金額ではありません。中位の段で見ると、gpt-6.1-solとClaude Sonnet 5.5が840円で並び、Gemini 3.8 Flashは2026年末までの価格で315円となります。同じ段でも1人あたりの月額は数倍から10倍ずれるため、社名ではなくモデル名で比べましょう。上位の約4.4倍は4,200円÷960円、軽量の10倍は420円÷42円で求めた値です。
もう1つ押さえておきたいのは、この金額がAPI利用料だけだという点になります。APIは自社のシステムからAIを呼び出すための窓口で、ChatGPTやClaudeの画面で使う月額のプランとは料金の仕組みが別物です。社員に使わせるには、画面や権限、ログの仕組みを自社で組むことになり、その手間は表の金額に含まれていません。この点は後半の自作か会社定額かの節で、項目ごとに確かめていきましょう。
API料金の決まり方|入力と出力で単価が違うトークン課金
APIの料金は、送った文章(入力)と返ってきた文章(出力)のトークン数に、それぞれの単価を掛けて決まります。3社とも単価は100万トークンあたりのドルで表示されていて、出力の単価は入力の5倍から8倍ほどに設定されています。同じ1回のやり取りでも、AIに長く書かせるほど料金が膨らんでしまうのは、この差があるためです。
実際に、今回の前提で入力と出力の料金を分けてみると、出力の重さがよく分かります。gpt-6.1-solの場合、入力80万トークンの料金は1.6ドル、出力40万トークンの料金は4ドルとなり、量が半分の出力のほうが2.5倍高くつく計算です。AIに要点だけを短く返させるよう指示文を工夫すると、月額を抑えやすくなるでしょう。
月額を出す式
1人の月額は、月の入力トークン数×入力単価と、月の出力トークン数×出力単価を足すと求めることが出来ます。今回の前提では、入力が2,000トークン×400回で80万トークン、出力が1,000トークン×400回で40万トークンとなります。100万トークンあたりの単価で表示されているため、式は0.8×入力単価+0.4×出力単価のドルに置き換えられます。たとえばgpt-6.1-solなら、0.8×2ドル+0.4×10ドルで5.6ドル、1ドル=150円で計算した場合は840円になります。この式に公式ページの単価を入れれば別のモデルも同じように計算出来るので、気になるモデルで試してみてください。
人数分の月額は、1人の月額に人数を掛けるだけで出せます。年間の予算にするなら、さらに12か月を掛ける形です。為替が動くと円の金額も動くため、社内の稟議では1ドルを何円で計算したかを必ず書き添えておきましょう。
トークンの数え方はモデルで変わる
同じ文章でも、何トークンと数えるかはモデルによって変わります。Anthropicは料金ページで、Claude 4.7以降のモデルは新しい数え方を使っており、同じ文章でも約3割多くトークンが数えられると説明しています。この記事の計算には、この約3割の増加を入れていません。トークンが3割多く数えられれば、同じ使い方でも料金は約3割前後上がる計算となります。増え方は文章の内容や使い方で変わると説明されているため、Claudeの新しいモデルで見積もるときは数字を割り増して見ておきましょう。
長い文書をまとめて読ませる場合の扱いも、各社で異なります。Gemini 3.1 Pro Previewは、1回の入力が20万トークンを超えると、入力・出力とも高い単価に切り替わる表示です。OpenAIの表にも長い入力向けの別単価が並んでいます。Anthropicは、Claude 4.6以降のモデルでは100万トークンの長さまで標準の単価で扱うと案内しているサービスになります。この記事の計算は、3社とも標準の短い入力向けの単価を使って出したものです。
3社のモデル別単価|上位・中位・軽量の3段で並べる
3社のモデルを単価の高さで上位・中位・軽量の3段に分けると、同じ段の中でも単価に大きな開きがあります。段の分け方は各社の正式な区分ではなく、単価の高い順に並べて揃えたものです。OpenAIはgpt-6-astraを最も難しい仕事向けの最も高性能なモデル、gpt-6.1-solをそれに近い性能をより低い費用で出すモデル、gpt-6-lunaを件数の多い決まった処理向けのモデルと説明しています。Googleの説明では、Gemini 3.8 FlashはFlash系で最も賢いモデルとされます。
| 段 | 会社 | モデル | 入力 | 出力 | キャッシュ入力 | Batch(入力/出力) |
|---|---|---|---|---|---|---|
| 上位 | OpenAI | gpt-6-astra | $10.00 | $50.00 | $1.00 | $5.00/$25.00 |
| 上位 | Anthropic | Claude Fable 5.1 | $10 | $50 | $0.25(読み出し) | 標準の50%引き |
| 上位 | Gemini 3.1 Pro Preview | $2.00(20万トークン以下) $4.00(20万超) | $12.00(20万トークン以下) $18.00(20万超) | — | $1.00/$6.00 | |
| 上位と中位の間 | Anthropic | Claude Opus 5.5 | $4 | $20 | $0.20(読み出し) | 標準の50%引き |
| 中位 | OpenAI | gpt-6.1-sol | $2.00 | $10.00 | $0.10 | $1.00/$5.00 |
| 中位 | Anthropic | Claude Sonnet 5.5 | $2 | $10 | $0.20(読み出し) | 標準の50%引き |
| 中位 | Gemini 3.8 Flash | $0.75(2026年12月31日まで) $1.50(2027年1月1日から) | $3.75(2026年12月31日まで) $7.50(2027年1月1日から) | — | — | |
| 軽量 | OpenAI | gpt-6-luna | $0.10 | $0.50 | $0.01 | $0.05/$0.25 |
| 軽量 | Anthropic | Claude Haiku 4.5 | $1 | $5 | $0.10(読み出し) | 標準の50%引き |
| 軽量 | Gemini 3.5 Flash-Lite | $0.30 | $2.50 | — | — | |
| 軽量 | Gemini 3.1 Flash-Lite | $0.25(音声は$0.50) | $1.50 | — | — |
※100万トークンあたりの標準料金(ドル)です。OpenAIは短い入力向け(Short context)、GoogleはPaid Tierの標準料金を載せています。2026年10月4日時点で各社の公式ページに表示されている単価で、各社の自己申告の表示価格です。「—」はこの表で扱っていない項目です。
表を見ると、上位の段でgpt-6-astraとClaude Fable 5.1の単価は入力・出力とも同じ額で、Gemini 3.1 Pro Previewは入力が5分の1、出力が約4分の1の水準にとどまります。軽量の段では差がさらに広がり、gpt-6-lunaの入力単価0.10ドルに対して、Claude Haiku 4.5は1ドルと10倍になります。単価の安さだけで選ぶと、仕事の難しさに合わないモデルを全社で使うことになりかねないため、段ごとに候補を持っておくと選びやすくなるでしょう。
Gemini 3.8 Flashの単価は2026年12月31日まで
Gemini 3.8 Flashの入力0.75ドル・出力3.75ドルという単価は、2026年12月31日までの価格として表示されています。2027年1月1日からは入力1.50ドル・出力7.50ドルと、入力・出力ともちょうど倍に上がる予定になります。同じ使い方での1人あたり月額は315円から630円に上がり、50人なら月15,750円が31,500円となってしまいます。年をまたいで使う前提なら、Gemini 3.8 Flashは2027年からの単価で予算を組みましょう。
Batchとキャッシュで単価を下げる
単価を下げる仕組みとして、3社の料金ページにはBatchと呼ばれる割引の欄があります。OpenAIの表ではBatchの単価が標準のちょうど半額となり、Anthropicも入力・出力の両方を50%引きとしています。Gemini 3.1 Pro PreviewのBatchも入力1.00ドル・出力6.00ドルで、標準のちょうど半額です。Batchは処理をまとめて依頼するときの料金で、社員が画面で対話する使い方の計算には入れていません。夜のうちに大量の文書を分類するような急がない処理であれば、使えるかどうか検討してみてください。
もう1つの仕組みがキャッシュで、同じ入力を繰り返し送るときに、その部分の単価が下がります。gpt-6-astraのキャッシュ入力は1.00ドルで通常の10分の1、Claude Sonnet 5.5のキャッシュ読み出しも0.20ドルで通常の10分の1になります。毎回同じ長い指示文を付けて送る社内ツールでは効いてくる仕組みですが、どれだけ下がるかは作り方次第のため、この記事の試算には入れていません。
各社の公式ページと確認日
単価は各社が公式の料金ページに表示している金額で、この記事の数字はすべて2026年10月4日に確認したものです。料金は改定されることがあるため、契約や見積もりの前には次のページで最新の表示を確かめてください。
- OpenAI:API Pricing(OpenAI公式)
- Anthropic:Pricing(Claude公式ドキュメント)
- Google:Gemini Developer API pricing(Google公式)
どのページにも円での金額は載っていないため、社内で共有するときは為替の前提を書き添えて円に直すと伝わりやすくなります。
同じ使い方で計算する|1人あたり月額と10人・30人・50人の円換算
同じ使い方で計算すると、50人の会社が上位モデルを全員に使わせた場合、API利用料は月48,000円から210,000円の幅に収まります。下の表は、3社のモデルを上位・中位・軽量の3段に分け、1人あたりの月額と10人・30人・50人の月額を円で並べました。
| 段 | モデル | 1人の月額(ドル) | 1人(円) | 10人 | 30人 | 50人 |
|---|---|---|---|---|---|---|
| 上位 | gpt-6-astra | $28.00 | 4,200円 | 42,000円 | 126,000円 | 210,000円 |
| 上位 | Claude Fable 5.1 | $28.00 | 4,200円 | 42,000円 | 126,000円 | 210,000円 |
| 上位 | Gemini 3.1 Pro Preview | $6.40 | 960円 | 9,600円 | 28,800円 | 48,000円 |
| 上位と中位の間 | Claude Opus 5.5 | $11.20 | 1,680円 | 16,800円 | 50,400円 | 84,000円 |
| 中位 | gpt-6.1-sol | $5.60 | 840円 | 8,400円 | 25,200円 | 42,000円 |
| 中位 | Claude Sonnet 5.5 | $5.60 | 840円 | 8,400円 | 25,200円 | 42,000円 |
| 中位 | Gemini 3.8 Flash(2026年末まで) | $2.10 | 315円 | 3,150円 | 9,450円 | 15,750円 |
| 中位 | Gemini 3.8 Flash(2027年1月から) | $4.20 | 630円 | 6,300円 | 18,900円 | 31,500円 |
| 軽量 | gpt-6-luna | $0.28 | 42円 | 420円 | 1,260円 | 2,100円 |
| 軽量 | Claude Haiku 4.5 | $2.80 | 420円 | 4,200円 | 12,600円 | 21,000円 |
| 軽量 | Gemini 3.5 Flash-Lite | $1.24 | 186円 | 1,860円 | 5,580円 | 9,300円 |
| 軽量 | Gemini 3.1 Flash-Lite | $0.80 | 120円 | 1,200円 | 3,600円 | 6,000円 |
※1回=入力2,000・出力1,000トークン、1人あたり月400回(1日20回×20営業日)で計算しています。1ドル=150円で計算した場合の金額で、税は含みません。単価は2026年10月4日時点で各社の公式ページに表示されている標準料金(各社の自己申告の表示価格)を使い、キャッシュとBatchの割引は入れていません。Claude 4.7以降で同じ文章のトークンが約3割多く数えられる点も計算に入れていない、机上の試算です。Googleの料金表は出力に思考(推論)のトークンを含むと表示しており、実際の出力トークンは想定より増えることがあります。
表から読み取れること
表から読み取れるのは、1人あたりの金額が小さく見えても、全員に上位モデルを渡すと桁が変わるという点です。Claude Fable 5.1を50人で使うと月210,000円、年間では2,520,000円となります。同じ50人でもGemini 3.1 Pro Previewなら月48,000円、gpt-6-lunaなら月2,100円で、選ぶモデルによって年間の出費は大きく変わってしまいます。人数を数えるより先に、どの段のモデルを誰に使わせるかを決めると、APIの月額の見通しが立ちます。
中位の段では、gpt-6.1-solとClaude Sonnet 5.5が同じ840円で並び、30人なら月25,200円になります。Gemini 3.8 Flashは同じ30人で月9,450円ですが、2027年1月からは18,900円に上がるため、表では2行に分けました。Claude Opus 5.5は上位と中位の間の単価で、30人なら月50,400円となる計算です。
APIで自作するときに、料金以外に用意するもの
APIで社内向けのAIを自作すると、払うのはAPI利用料だけでも、社員が使う画面や権限、ログ、キーの管理は自社で用意することになります。APIは自社のシステムからAIを呼び出すための窓口で、ChatGPTやClaudeのように人が開いて使う画面は付いていません。社員に配るには、入力欄や履歴の画面を作り、誰が使えるかを決め、使った記録を残す仕組みまで自分たちで組む必要があります。
席ごとに料金がかかる方式ではなく、APIの従量課金で全社員に開放したほうが安く済むという考え方も見かけます。前の節の表のとおり、API利用料だけを見れば1人あたり月42円から4,200円で、この考え方にも一理あるでしょう。ただ、その安さはAPI利用料だけを数えた場合の話で、下に挙げる項目の手間と費用は含まれていません。APIの単価が安く見えても、画面・ログ・権限・キー管理を自社で持つ費用は、利用料の表の外にあると考えましょう。
料金以外にかかる項目のチェックリスト
自作を検討するときは、次の項目をそれぞれ誰が担うかを書き出してみてください。金額は会社ごとに大きく違うため、ここでは項目だけを挙げています。
- 社員が使う画面の開発入力欄・会話の履歴・ファイルの添付など、ChatGPTやClaudeの画面で当たり前にある機能を、自社で作る必要があります。
- 作った後の保守と改修各社は新しいモデルの追加や単価の改定を続けており、Gemini 3.8 Flashのように期限付きの単価もあります。モデルの切り替えや設定の見直しを続ける担当者が要ります。
- APIキーの発行と保管APIキーは、会社の請求で各社のAIを呼び出せる合言葉のようなものです。誰が発行し、どこに保管し、漏れたときに誰が止めるかを決めておきます。
- 退職者・異動者の権限停止社員ごとのアカウントを自社の仕組みで管理する場合、退職や異動のたびに使えなくする手順と担当者が必要です。
- 利用ログの記録と確認誰がいつ何を入力したかを残し、問題が起きたときに確かめられる状態にするのも自社の仕事になります。
- 利用上限の設定と請求の監視従量課金は使った分だけ請求が増えます。上限の決め方は3社で同じではなく、会社ごとに設定と監視を続ける担当が要ります。
- ドル建ての支払い3社ともドル建てで、カードで支払う場合、日本円の請求額はカード会社の為替で毎月変わります。前払いのクレジットを買う方式もあるため、残高の管理と補充の担当を決めておきます。
- 無料枠のデータの扱いGemini APIの無料枠では、送った内容が製品の改善に使われ、人が読むことがあると規約に書かれています。試作のつもりで業務の情報を無料枠に入れないよう、ルールで止める必要があります。
- 複数社を使うときの契約と請求の分散3社を併用すると、アカウント・キー・請求・上限の設定がそれぞれ3つずつに分かれます。
- 社内ルールと教育入力してよい情報の線引きや、AIの答えを人が確かめる手順は、自作でもサービスでも自社で決めることになります。
3社を使い分けると管理の手間も3つに分かれる
モデルの得意分野に合わせて3社を使い分けたい場合、APIではアカウントの開設から支払い、上限の設定までを会社ごとに繰り返すことになります。キーも請求書も3社分に分かれ、どこか1つで手続きが漏れても気づきにくくなってしまいます。社員の画面から3社のモデルを切り替えられるようにするには、その切り替えの仕組みも自社で作らなければなりません。
どの項目も、API利用料の表には出てこない手間となります。社員10人の会社でも、画面を作る人と、キーと請求を見張る人がいなければ、自作のAIは続けにくいでしょう。こうした手間をどこまで社内で持てるかを、利用料の比較と同じ席で話し合ってみましょう。
画面やキーの管理を自社で抱えずに済ませたい場合は、管理の仕組みが付いた環境を会社で1つ用意する方法もあります。UPGEAR AI(アップギアAI)は、ChatGPT・Claude・Gemini・Perplexityを1つの契約で使える法人向けサービスです(人数無制限)。
料金以外の違い|データの扱い・利用上限・支払い方法
料金以外で3社を比べると、有料のAPIに送った内容を学習に使わないという基本の扱いは共通していますが、無料枠と支払い、上限の仕組みには違いがあります。会社で使う場合は、単価と同じくらいこの違いが運用の手間を左右します。取引先や顧客の情報を扱う部署があるなら、料金表より先にこの表の項目を社内の担当者と読み合わせてみてください。
| 項目 | OpenAI | Anthropic | Google(Gemini API) |
|---|---|---|---|
| 有料で送った内容の学習利用 | 学習や改善に使わない(自分で共有を選んだ場合を除く) | APIを含む商用製品の入力・出力は、既定で学習に使わない | 有料枠の内容は製品の改善に使わない |
| ログの保持 | 不正利用の監視のため、既定で最大30日 | — | 不正利用の検知のため、一定期間 |
| 無料枠の扱い | — | — | 無料枠の内容は製品の改善と開発に使われ、人が読むことがある |
| 支払いの形 | 新規のAPIアカウントは前払い(クレジットを先に購入) | 前払いのクレジット・自動補充あり。販売契約のある組織は月次の請求書 | 前払いと後払いの両方 |
| 使いすぎの止め方 | 自動チャージの上限は、APIの使用上限ではないと案内 | 組織の段階ごとの上限の範囲で、月の使用上限を設定可。ワークスペース別にも設定可 | AI Studioのプロジェクト別の上限は試験的な機能(Experimental) |
| 通貨 | ドル建て | ドル建て | ドル建て |
※2026年10月4日時点で各社の公式ページ(料金・規約・ヘルプ)に表示されている内容です。「—」はこの表で扱っていない項目です。
学習利用とログの保持
有料のAPIに送った内容は、3社とも既定ではモデルの学習や製品の改善に使わないと案内しています。OpenAIは、自分から共有を選ばない限りAPIのデータを学習に使わないとし、不正利用の監視のためのログは既定で最大30日保持する扱いになります。Anthropicも、APIを含む商用製品の入力と出力を既定では学習に使わないと明記しています。一方で、Googleは有料枠の内容を製品の改善に使わないとしつつ、不正利用の検知のために一定期間ログを残すことを規約で定めているため、ログが一切残らないわけではありません。
学習に使われないことと、どこにも残らないことは別の話になります。取引先から預かった情報を扱う会社であれば、各社の規約のどの部分を根拠に説明するかを、使い始める前に決めておくと安心でしょう。社内の点検項目は野良AI(シャドーAI)の対策の記事でも取り上げています。
無料枠とAPIキーの管理
会社で使うときに気をつけたいのは、Gemini APIの無料枠の扱いです。Gemini 3.8 FlashやFlash-Lite系は無料枠で使える一方、無料枠に送った内容と返ってきた答えは、Googleの製品の改善と開発に使われると規約に書かれています。人の審査担当が入力と出力を読むことがあるとも書かれ、機密情報や個人情報を無料枠に送らないよう規約ではっきり求めている点にも注意が必要になります。社員が試しに業務の資料を無料枠へ入れてしまうと、その内容を人が読む可能性が生まれてしまいます。
APIキーの管理も、会社で使うときに抜けやすい点です。APIキーは、そのキーを持つ人が会社の請求で各社のAIを呼び出せる鍵の役割を持ちます。社員の手元のファイルや共有の資料にキーを貼り付けたままにすると、退職後も使われたり、外に漏れて使われたりするおそれがあります。用途ごとにキーを分け、保管する場所と止める担当者を決めておけば、漏れたときもそのキーだけを止めることが出来ます。
支払い方法と利用上限
支払いは3社ともドル建てで、カードで支払う場合、日本円での請求額はカード会社の為替で毎月変わります。OpenAIは新しいAPIアカウントをクレジットの前払いで始める方式で、Anthropicも使う前にクレジットを買う形になります。Anthropicには自動で補充する設定があり、販売契約を結んだ組織には月ごとの請求書で支払う形も用意されています。Googleは前払いと後払いの両方の形を案内しているサービスです。
使いすぎを止める仕組みも、3社で同じではありません。Anthropicは組織の段階ごとの上限の範囲で月の使用上限を自社で決められ、ワークスペースごとにも設定出来ます。OpenAIの自動チャージの上限は、APIの使用上限ではないと案内されているため、補充の上限を決めただけで安心しないようにしましょう。GoogleのAI Studioのプロジェクト別の上限は試験的な機能と表示されており、請求の監視は人の目でも続けてください。費用の見張り方は生成AIのコスト管理でも整理しています。
円で予算を組むときの為替の見方
ドル建ての料金を円の予算に直すときは、何円で換算したかを決めて書き添えることが出発点になります。たとえば30人でgpt-6.1-solを使う場合の料金は月168ドルで、1ドル=150円で計算した場合は25,200円です。1ドルの換算が10円変わるだけで月1,680円、年間では20,160円の差が出る計算になります。予算には為替が動いても収まる余裕を持たせ、実際の請求額と見比べながら見直していきましょう。
用途別のモデルの選び方と月額の規模感
用途で分けると、難しい判断が要る仕事は上位、日常の文書作業は中位、件数の多い決まった処理は軽量という割り当てが基本になります。OpenAIもgpt-6-lunaを、件数の多い決まった処理向けのモデルと説明しています。社員全員に同じモデルを渡すより、仕事ごとに段を選ぶほうが月額を抑えやすいでしょう。
用途別のモデルの選び方
| 用途の例 | 向く段 | 候補のモデル | 1人あたり月額(同じ使い方) |
|---|---|---|---|
| 契約書や企画書の読み込み、判断の材料づくり | 上位 | gpt-6-astra/Claude Fable 5.1/Gemini 3.1 Pro Preview | 960円〜4,200円 |
| 議事録の要約、メールや報告書の下書き | 中位 | gpt-6.1-sol/Claude Sonnet 5.5/Gemini 3.8 Flash | 315円〜840円(Gemini 3.8 Flashは2027年1月から630円) |
| 問い合わせの分類、定型文の作成など件数の多い処理 | 軽量 | gpt-6-luna/Gemini 3.1 Flash-Lite/Claude Haiku 4.5 | 42円〜420円 |
※向く段は目安です。月額は1回=入力2,000・出力1,000トークン、月400回、1ドル=150円で計算した場合の机上の試算です。
表の割り当ては目安で、実際にどの段で足りるかは、自社の文書で同じ依頼を試して確かめるのが確実です。3社の得意分野の違いは主要4AIの違いと使い分けにまとめているので、候補を絞るときに参考にしてみてください。中位で足りる仕事に上位を使うと、同じOpenAIでもgpt-6-astraはgpt-6.1-solの5倍の月額となってしまいます。
人数と使い方で月額の規模感はどう変わるか
規模感をつかむには、人数と段の組み合わせで月額の幅を見るのが近道になります。10人の会社が中位の段を使う場合、API利用料は月3,150円から8,400円の範囲に入ります。30人が上位の段を使うと月28,800円から126,000円、50人なら48,000円から210,000円まで広がってしまいます。軽量の段なら、50人でも月2,100円から21,000円に収まる計算です。ここに前の節で挙げた画面や保守の手間が加わるため、API利用料の小ささだけで社内の予算を決めないようにしましょう。
使う回数が変わると月額はどう動くか
1人の使う回数が変われば、月額はその回数に比例して増減します。社員の多くが1日5回しか使わない会社なら月100回で、円換算表の金額の4分の1に収まります。反対に、1日40回使う方が多ければ月800回となり、表の金額の倍を見込むことになります。たとえばGemini 3.1 Pro Previewを30人で使う場合、1日5回なら月7,200円、1日40回なら月57,600円という幅です。社内の使い方が見えない段階では、まず円換算表の前提で見積もり、実際の利用記録を見て直していきましょう。
1回の大きさが変わる場合も考え方は同じになります。1回の入力が倍の4,000トークンになる使い方なら、入力の料金だけが倍に増える計算です。長い資料を毎回丸ごと読ませる使い方が多い部署は、入力の量が月額を押し上げやすいので、部署ごとに使い方を聞き取ってから見積もってみてください。
API利用料を抑える4つの工夫
API利用料を抑える工夫は、出力を短くすること、仕事ごとに段を分けること、急がない処理をBatchに回すこと、同じ指示文をキャッシュで使い回すことの4つが中心です。
- AIに返させる文章の長さを指示文で決めておくと、単価の高い出力のトークンを減らせます。今回の前提で出力を1,000トークンから500トークンに減らすと、gpt-6.1-solの1人あたり月額は840円から540円に下がります。
- 要約や分類のように軽量で足りる仕事は、軽量の段に振り分けます。gpt-6.1-solからgpt-6-lunaに替えると、同じ使い方で840円が42円になる計算です。
- 夜のうちに流せる大量の処理は、Batchに回すと単価が半額になります。gpt-6-astraなら、月400回分で4,200円の処理が2,100円に下がる計算です。
- 毎回同じ長い指示文を付けて送る作りなら、キャッシュの単価が使えるかを確かめます。gpt-6-astraでは、キャッシュ入力の単価が通常の10分の1と表示されています。
どの工夫も、APIで自作する場合は作る側が仕組みに組み込むことになります。作り始める前に、どの工夫を入れるかを担当者と決めておきましょう。
1つの段に決めずに併用する考え方
API利用料の面では、上位と中位を人や仕事で切り替えて使うと、全員に上位を渡すより月額を下げることが出来ます。たとえばOpenAIで30人のうち5人だけがgpt-6-astraを使い、残り25人がgpt-6.1-solを使う場合、5人分21,000円と25人分21,000円で月42,000円です。全員がgpt-6-astraなら月126,000円のため、3分の1に収まる計算になります。ただし、APIで自作する場合は、この切り替えの仕組みと、誰にどのモデルを許すかの権限も自社で作る必要が出てきます。複数のAIを1つの環境で使う形はマルチAIとはで整理しているので、あわせて確かめてみてください。
APIで自作するか、会社定額のサービスを使うかの分かれ目
分かれ目は金額の大小ではなく、社員が使う画面・権限・ログ・キー管理・支払いを自社で持つかどうかにあります。APIの利用料は使うモデルと回数で増減し、会社定額のサービスにも利用量に応じてプランが分かれるものがあるため、人数だけで損得の境目を引くことは出来ません。実際に比べるときは、自社で作って持ち続ける人と時間があるかを先に確かめるのが近道でしょう。金額の比較より先に、画面と管理の仕組みを誰が持つかで道を決めましょう。
| 確かめること | APIで自作が向く | 会社定額のサービスが向く |
|---|---|---|
| 開発の体制 | 社内に開発と保守を続けられる担当者がいる | 開発の担当者がいない、本業から人を割けない |
| 使い方 | 自社の業務システムにAIを組み込みたい、決まった処理を大量に流したい | 社員が画面で文章作成や要約に使うのが中心 |
| 配る範囲 | 一部の部署や担当者だけが使う | 全社員に同じ環境を配りたい |
| 権限とログ | 自社で仕組みを作って管理出来る | 管理画面で利用ログや権限を見たい |
| キーの管理 | キーの保管と停止の手順を自社で回せる | 社員にAPIキーを持たせたくない |
| 支払い | ドル建て・前払いのクレジットの管理に対応出来る | 円の請求書やカード払いで経理をまとめたい |
| 複数のAI | 1社のAPIで足りる | 複数のAIを1つの契約で使いたい |
| モデルの選び方 | 使うモデルや設定を自社で細かく決めたい | サービスが用意するモデルの範囲で足りる |
自作が向くのは、業務システムにAIを組み込む用途や、件数の多い処理を夜間にまとめて流すような使い方です。この場合は社員向けの画面が要らず、Batchや軽量モデルで利用料も抑えられるため、APIの良さがそのまま生きてきます。社員が日々の文章作業に使う環境を配りたい場合は、画面と管理の仕組みが付いたサービスを選ぶほうが、自作で抱える項目を減らせるでしょう。
自作を決める前に社内で確かめる手順
自作に進むかどうかは、次の順番で社内の答えをそろえていくと判断しやすくなります。
- 社員の誰が、どの仕事にAIを使うかを部署ごとに書き出します。
- 書き出した仕事を上位・中位・軽量の段に振り分け、この記事の円換算表で1人あたりの月額の幅をつかみます。
- 画面・権限・ログ・キーの管理・支払いのそれぞれを、社内の誰が担えるかを決めます。
- 担い手が決まらない項目が残る場合は、その項目を最初から備えたサービスを候補に入れます。
- 自作でもサービスでも、入力してよい情報の線引きを社内ルールにまとめます。
3番目で担い手が決まらない項目が多いほど、自作の負担は重くなってしまいます。反対に、開発の担当者がいて、使う範囲も一部の部署に限られるなら、APIで小さく作り始める道も十分に選べるでしょう。社内ルールのまとめ方は、利用料の見積もりと並行して進めてみてください。
両方を組み合わせる選び方
社員が使う環境は会社定額のサービスでそろえ、業務システムへの組み込みだけをAPIで作る、という分け方も出来ます。この形なら、APIのキーを持つのは開発の担当者だけになり、社員一人ひとりにキーを渡さずに済む形です。法人向けサービスの料金は法人向け生成AIサービスの料金比較で、ChatGPTの法人プランはChatGPT法人プランの料金で整理しています。会社が環境を用意しないままだと、社員が個人のアカウントで使い始める野良AIにつながりやすくなってしまいます。比較の材料がそろったら、まずは社内で使い方の多い部署から聞き取りを始めてみてください。
ChatGPT・Claude・Geminiを、画面と管理の仕組みごと会社で1つに
UPGEAR AIは、ChatGPT・Claude・Gemini・Perplexityを1つの契約・1画面で使える法人向けサービスです。管理者ダッシュボードで利用ログ・権限・モデルのON/OFFを管理でき、会話の途中でもモデルを切り替えられます。基盤はAWSの日本リージョンで稼働しています。料金は月額30,000円(税抜)から。どのプランも利用人数は無制限で、料金は利用量に応じたプラン設計です(人数の目安はライト1〜5名、スタンダード6〜20名、プレミアム21〜50名)。初期費用100,000円(税抜)が別途かかります。上限に近づくと、管理者宛に複数回メールでお知らせします。上限に達した時点で利用を停止する安全設計のため、知らないうちに超過して追加の請求が発生することはありません。お支払いはクレジットカード払いと、請求書による銀行振込(法人のみ)に対応しています。
UPGEAR AIの詳細を見るよくある質問
APIの料金と、ChatGPTやClaudeの月額プランは同じですか?
無料で使えるAPIはありますか?
APIの料金は円で支払えますか?
Claudeの新しいモデルは、記事の計算より高くなりますか?
使いすぎて請求が膨らむのを防ぐ方法はありますか?
APIで自作するのと会社定額のサービスでは、どちらが安いですか?
APIキーはどう管理すればよいですか?
Batchを使えば料金は半額になりますか?
Gemini 3.8 Flashの予算はどの単価で組めばよいですか?
社員10人ほどの会社でも、APIで自作する意味はありますか?
まとめ
1回に入力2,000・出力1,000トークン、1人月400回という同じ使い方で計算すると、上位モデルの1人あたり月額はgpt-6-astraとClaude Fable 5.1が4,200円、Gemini 3.1 Pro Previewが960円となり、約4.4倍の差が出ます。軽量モデル同士では42円から420円と10倍の開きがあり、同じ段の中でもモデル選びで月額は大きく変わってしまいます。どの数字も1ドル=150円で計算した場合の、各社の表示単価からの机上の試算です。
Gemini 3.8 Flashは2026年12月31日までの価格で、2027年1月1日から入力・出力とも倍になります。Claude 4.7以降は同じ文章で約3割多くトークンが数えられる点も、見積もりでは割り増して見ておきましょう。Gemini APIの無料枠は送った内容が製品の改善に使われ、人が読むことがあるため、会社の情報を入れないルールが要ります。
APIで自作するか、会社定額のサービスを使うかの分かれ目は、画面・権限・ログ・キー管理・支払いを自社で持ち続けられるかどうかです。業務システムへの組み込みにはAPI、社員が日々使う環境にはサービスという分け方も出来ます。まずは社員の誰がどの仕事にAIを使うかを書き出し、段ごとの月額の幅と、自社で持つ項目の担い手を1枚の表にまとめてみましょう。その表があれば、APIの見積もりとサービスの見積もりを同じ条件で並べられるはずです。他の記事はAI活用コラム一覧から探してみてください。
