
Gemini APIとは、Googleの生成AIモデルGeminiを、自社のシステムや社内ツールから直接呼び出すための開発者向けの契約です。料金は使った分だけ払う従量課金制で、100万トークンあたり数十セントという単価だけを見ると、社内で使うAIは自分で作ったほうが安く見えます。この記事では、その見積もりに何が入っていて、何が入っていないのかを、Googleの公式ページに書かれている内容だけで最後まで出します。社員10人・30人・50人で使った場合の月額の試算、単価に付いている期限、無料枠と有料枠で送ったデータの扱いが変わる条件、上限を設定しても超過しうる条件まで、社員10〜200名の会社の判断に必要な順に並べます。
※この記事の料金・規約の記載は、2026年9月16日時点で各公式ページに表示されている内容です。出典は、Gemini Developer API の料金(ai.google.dev/gemini-api/docs/pricing)、課金(ai.google.dev/gemini-api/docs/billing)、レート制限(ai.google.dev/gemini-api/docs/rate-limits)、トークンについて(ai.google.dev/gemini-api/docs/tokens)、Gemini API 追加利用規約(ai.google.dev/gemini-api/terms・2026年3月23日より有効)、Gemini Enterprise Agent Platform の料金(cloud.google.com)です。単価はすべて米ドル建てで、公式の料金ページに円建ての記載も税の記載もありません。モデル名と単価は改定されるため、金額を稟議に使うときは公式ページで再確認してください。
Gemini APIとは何か|Geminiアプリ・Google AIプランとは別物
Gemini APIは、Geminiのモデルをプログラムから呼び出すための開発者向けの窓口で、ブラウザで使うGeminiアプリや、個人向けの月額プランであるGoogle AIプランとは、契約も料金の形もまったく別のものです。ここを取り違えたまま話を始めると、社内の検討が最初から噛み合いません。Geminiアプリは画面が用意されていて、月額を払えば誰でもすぐ使えます。Gemini APIには画面がなく、単価が決まっているだけで、使う人が触る画面は自分たちで用意することになります。
もう少し具体的に言うと、Geminiアプリの有料版は、1人あたり月いくらという定額で、上限の中で使い放題に近い形です。個人向けプランの中身や金額はGeminiの有料版の記事にまとめています。会社としてGeminiを全社員に配り、管理者が設定とログを持つ形にしたい場合は、Google側の法人向けサービスが別にあり、その料金はGemini Enterpriseの料金の記事で扱っています。この記事が扱うGemini APIは、そのどちらでもなく、自社で何かを作る人が使う契約です。
公式が示している3つの階層
料金ページの冒頭には、無料・有料・Enterpriseの3つのカードが並んでいます。それぞれに書かれている内容は次のとおりです。
| 階層 | 公式ページに書かれている内容 | 向いている段階 |
|---|---|---|
| 無料 | 特定のモデルへの制限付きアクセス、入力・出力トークンが無料、Google AI Studioへのアクセス。サービス改善のためのコンテンツ利用あり、と記載 | 動くかどうかを試す段階 |
| 有料 | 本番デプロイのためのレート上限の引き上げ、コンテキストキャッシュ、Batch API(コストを50%削減)、最先端モデル。プロダクト改善のためのコンテンツ利用なし、と記載 | 社内で継続して使う段階 |
| Enterprise | Gemini Enterprise Agent Platform。専用サポート、高度なセキュリティとコンプライアンス、プロビジョンドスループット、ボリュームベース割引。金額は掲載されず問い合わせ | 大規模・要件が厳しい段階 |
会社で業務に使うことを考えるなら、実質的な選択肢は有料以上です。理由は金額ではなく、後半で詳しく書くデータの扱いの差にあります。無料の階層は、あくまで動作を確かめるためのものと考えたほうが安全です。
APIを契約しても、社員が使う画面は付いてこない
Gemini APIで手に入るのは、モデルに文章を送ると答えが返ってくる仕組みだけです。社員がログインする画面、誰がどの機能を使えるかの権限、会話の履歴、誰がいつ何を送ったかのログ、うまく動かないときの問い合わせ窓口は、いずれもAPIの料金表には含まれていません。これらを用意する手間と費用は、トークン単価とはまったく別に発生します。単価の安さに目が行きがちですが、社内に配るところまで含めて考えると、費用の重心はむしろこちら側に寄ります。生成AIの費用がどこで膨らむかは生成AIの利用コストが高くなる理由の記事でも整理しています。
料金の決まり方|入力・出力・キャッシュのトークン量と保存時間
Gemini APIの料金は従量課金制で、送ったトークン(入力)、返ってきたトークン(出力)、キャッシュに置いたトークンの量と保存時間の3つで決まります。単位は100万トークンあたりの米ドルです。トークンとは、文章や画像を機械が扱う単位に切り分けたもので、日本語の文章も画像も音声も、すべてトークンに換算されてから課金されます。公式のトークンのページには、Gemini APIとのすべての入出力は、テキスト、画像ファイル、その他のテキスト以外のモダリティを含めてトークン化される、と書かれています。
つまり、月額がいくらになるかは、契約の種類ではなく、社内でどれだけ文章を送り、どれだけ返させたかで決まります。同じ人数でも、長い資料を丸ごと貼り付ける使い方と、短い質問を投げる使い方では、金額が何倍も変わります。ここが定額のサービスと根本的に違う点で、予算を立てるときに最初に押さえるべきところです。
出力トークンの単価は入力より高い(思考トークンも出力に含まれる)
料金表を見ると、どのモデルでも出力の単価は入力の数倍に設定されています。たとえばGemini 3.8 Flashは入力が100万トークンあたり$0.75で、出力は$3.75と5倍です。Gemini 3.5 Flashは入力$1.50に対して出力$9.00で6倍、Gemini 3.1 Pro プレビュー版は入力$2.00に対して出力$12.00で6倍です。しかも料金ページの出力の欄には、思考トークンを含む、という但し書きが付いています。モデルが答えを組み立てる過程で内部的に使ったトークンも、出力として数えられるということです。
この非対称は、設計の方針に直結します。長い資料を読ませること自体は比較的安く済み、長い文章を書かせることのほうが高くつきます。社内で使う仕組みを作るなら、出力の上限を決める、箇条書きで返させる、要約の文字数を指定するといった工夫が、そのまま請求額に効いてきます。逆に、とにかく丁寧に長く書いてほしいという使い方は、見積もりを大きく押し上げます。
コンテキストキャッシュは、保存量だけでなく保存時間にも課金される
コンテキストキャッシュは、毎回同じ長い資料を送り直さずに済ませる仕組みです。料金ページの有料のカードには有料枠の機能として挙げられていますが、モデル別の表では、無料枠が無料と書かれている行(Gemini 3.8 Flash、Gemini 3.5 Flash)と、利用不可と書かれている行(Gemini 3.5 Flash-Lite、Gemini 3.1 Flash-Lite、Gemini 3.1 Pro プレビュー版、Gemini 2.5 系)に分かれています。使う予定のモデルの行を確認してください。同じ社内規程を何度も読ませるような使い方では、入力のトークン量を減らせるため費用が下がります。ただし料金表には、キャッシュの読み出し単価とは別に、保存のための料金が書かれています。単価は100万トークンを1時間保存するあたり$0.50〜$4.50の範囲で、モデルによって異なります。Gemini 3.8 Flashの場合、キャッシュの単価が$0.075(2027年1月1日からは$0.15)で、これに加えて1時間あたり100万トークンあたり$0.50(同じく$1.00)のストレージ料金が書かれています。
ここは見落としやすい部分です。キャッシュは置いておくだけで時間あたりの料金が発生するため、誰も使っていない夜間や休日も課金が続きます。安くするつもりで入れた仕組みが、置きっぱなしのせいで逆に費用を増やすことがあります。保存時間を短くする、使い終わったら消す、という運用まで含めて設計する必要があります。
モデル別の単価一覧|Pro系・Flash系・Flash-Lite系の3系統と選び方
モデルは大きく、賢さを優先するPro系、速さと費用のバランスを取るFlash系、単純な処理を安くこなすFlash-Lite系の3系統に分かれ、単価は系統によって10倍以上の差があります。2026年9月16日時点で料金ページに掲載されている主なモデルの標準単価は次のとおりです。金額は100万トークンあたりの米ドルで、出力には思考トークンが含まれます。
| モデル | 入力(100万トークン) | 出力(100万トークン) | 無料枠 |
|---|---|---|---|
| Gemini 3.8 Flash | $0.75(2026年12月31日まで)→ $1.50(2027年1月1日から) | $3.75 → $7.50 | あり |
| Gemini 3.5 Flash | $1.50 | $9.00 | あり |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | あり |
| Gemini 3.1 Flash-Lite | $0.25(テキスト・画像・動画)/$0.50(音声) | $1.50 | あり |
| Gemini 3.1 Pro プレビュー版 | $2.00(20万トークン以下)/$4.00(超) | $12.00/$18.00 | 利用不可 |
| Gemini 2.5 Pro | $1.25/$2.50 | $10.00/$15.00 | あり |
| Gemini 2.5 Flash | $0.30(テキスト・画像・動画)/$1.00(音声) | $2.50 | あり |
| Gemini 2.5 Flash-Lite | $0.10/$0.30(音声) | $0.40 | あり |
| Gemini Embedding 2 | テキスト $0.20 | - | あり |
※単価は2026年9月16日時点でGemini Developer API の料金ページに表示されている標準の金額です。Gemini 3.1 Pro プレビュー版は、料金ページに無料枠では利用できないと記載されています。同じモデルでも入力の長さで単価が変わる行があり、表の2つの数値はその区分を示しています。
OpenAIのAPI(ChatGPT API)のモデル別単価と社員数別の月額試算は、ChatGPT APIの料金の記事で整理しています。
3系統の選び方は、間違えたときに誰が困るかで決める
系統の選び方は、精度の高さではなく、間違った答えが出たときに誰がどれだけ困るかで決めると整理しやすくなります。社内の雑多な調べものや文章の下書きは、Flash系やFlash-Lite系で十分なことが多く、単価の差がそのまま月額の差になります。一方、契約書の条項の読み取り、数字の突き合わせ、判断の根拠を示させる用途では、Pro系のほうが結果的に手戻りが減ります。
実務では、1つのモデルに統一するより、処理の種類ごとに分ける設計のほうが費用が下がります。たとえば、分類や振り分けはFlash-Lite系、社員の質問への回答はFlash系、専門的な確認が要る処理だけPro系、という分け方です。人が使う画面の側で複数のAIを使い分ける考え方はマルチAIの記事で扱っていますが、APIでも発想は同じです。
バッチと優先度で単価が変わる
同じモデルでも、処理の急ぎ具合によって単価が変わります。料金ページには、Batch API(バッチ)の単価が標準のおよそ半額で並んでいます。Gemini 3.8 Flashなら、標準の入力$0.75に対してバッチは$0.375、出力$3.75に対して$1.875です(いずれも2026年12月31日までの単価)。逆に、優先度を上げる区分は標準のおよそ1.8倍で、Gemini 3.8 Flashでは入力$1.35、出力$6.75と記載されています。
すぐに答えが返らなくてよい処理、たとえば夜間にまとめて分類する、月末に一括で要約する、といった使い方は、バッチに寄せるだけで単価が半分になります。逆に、社員が画面の前で待っている処理は標準で処理する必要があります。どの処理を急がせるかを決めることが、そのまま費用の設計になります。
人数別に月額を試算する|1往復の単価×月間の往復数
月額がいくらになるかは、1往復あたりの単価に月間の往復数を掛ければ出ますが、その前提を書かない試算はほとんど意味がありません。ここでは前提をすべて明示したうえで、社員10人・30人・50人で使った場合の目安を出します。前提が自社と違う場合は、往復数と1往復あたりのトークン数を入れ替えて計算し直してください。
この試算の前提(すべて仮に置いた数字です)
・1人あたり1日20往復、月20営業日で、1人あたり月400往復
・1往復あたり入力2,000トークン、出力600トークン(1人あたり月の合計は入力80万トークン・出力24万トークン)
・1ドル=155円で計算した場合。公式の料金ページに円建ての記載はありません
・税は含みません。料金ページに税の記載がないため、税込の金額は出していません
・画像・音声・動画の送信、検索の利用、キャッシュの保存料金は含みません
この前提で、1往復あたりの単価はモデルによって次のように変わります。Gemini 3.1 Flash-Liteなら1往復あたり$0.00140(1ドル155円で約0.22円)、Gemini 3.8 Flashなら$0.00375(約0.58円)、Gemini 3.1 Pro プレビュー版なら$0.01120(約1.74円)です。1往復あたりで見ると小さな数字に見えますが、人数と日数を掛けると差が開きます。
| モデル | 1人あたり月額 | 10人 | 30人 | 50人 |
|---|---|---|---|---|
| Gemini 3.1 Flash-Lite | 約87円 | 約870円 | 約2,600円 | 約4,340円 |
| Gemini 3.5 Flash-Lite | 約130円 | 約1,300円 | 約3,900円 | 約6,510円 |
| Gemini 3.8 Flash(2026年12月31日までの単価) | 約233円 | 約2,330円 | 約6,980円 | 約11,630円 |
| Gemini 3.8 Flash(2027年1月1日からの単価) | 約465円 | 約4,650円 | 約13,950円 | 約23,250円 |
| Gemini 3.1 Pro プレビュー版 | 約694円 | 約6,940円 | 約20,830円 | 約34,720円 |
※上の金額は、記載した前提を置いて公式の単価から計算した試算です。実際の請求額は、1往復あたりのトークン数、モデル、使う頻度、キャッシュや検索の利用で変わります。1ドル=155円で計算した場合の目安であり、税は含みません。
同じ使い方でも、モデルを1段上げるだけで8倍になる
この表で最初に目に入るのは、人数の差ではなくモデルの差です。同じ400往復、同じトークン数でも、Gemini 3.1 Flash-Liteの約87円とGemini 3.1 Pro プレビュー版の約694円では、ちょうど8倍の開きがあります。人数を増やしたから高くなったのではなく、使うモデルを1段上げたから高くなった、という構図です。
もうひとつ重要なのが、同じモデルの単価が期限で切り替わることです。Gemini 3.8 Flashを50人で使う想定では、2026年12月31日までの単価で約11,630円、2027年1月1日からの単価で約23,250円と、2倍になります。年額に直すと約139,500円と約279,000円で、差は約139,500円です。この期限を見落として現在の単価を恒久価格として社内資料に書くと、年が明けた時点で見積もりが2倍ずれます。
この節の結論
Gemini APIは安い、という言い方は、どのモデルで、いつの単価で、1往復あたり何トークン使うかを決めない限り成り立ちません。同じ使い方でもモデルで8倍、期限をまたぐと同じモデルで2倍になります。見積もりを出すときは、この3つを必ず紙に書いてから計算してください。
会議の音声を1時間文字起こしすると、入力だけでいくらか
文章のやり取り以外の使い方も、同じ考え方で計算できます。公式のトークンのページには、音声は1秒あたり32トークンと書かれています。1時間の会議音声なら3,600秒×32トークンで115,200トークンです。Gemini 3.8 Flashの入力単価$0.75(2026年12月31日までの単価)で計算すると、1時間の音声を読み込ませる入力側の費用は約$0.086、1ドル=155円で計算した場合は約13円です。
この数字だけを見ると、会議の文字起こしと要約を自作するのは非常に安く見えます。ただしこれは入力だけの金額で、要約を返させる出力の費用、録音ファイルを集める仕組み、音声の保存場所、誰が結果を見られるかの権限は、いずれも含まれていません。安く見えるのは、料金表に載っている部分だけを数えているからです。
トークンをどう数えるか|文字数からは決められない
トークン数は、送る前にAPIで数えられるため、見積もりは推測ではなく実測で作れます。公式のトークンのページには、送信前に count_tokens(countTokens)で入力のトークン数を数えられること、応答の usage に入力・出力・思考・キャッシュ・ツール使用の内訳が返ることが書かれています。見積もりを作るうえで確実なのは、自社の実際のやり取りを20件ほど用意して count_tokens を回し、1往復あたりの平均を出すことです。
注意したいのは、日本語は何文字で1トークンといった換算が、このページには書かれていないことです。ネット上には換算の目安を示す記事がありますが、公式の記載ではないため、文字数からトークン数を断定するのは避けたほうが安全です。社内の稟議に出す数字は、実際に数えた平均から作ってください。
画像は258トークン、動画は1秒263トークン、音声は1秒32トークン
テキスト以外のデータも、公式ページに換算のルールが書かれています。画像は、縦横どちらの寸法も384ピクセル以下であれば258トークン、それより大きい画像は768×768のタイルに分割され、タイルごとに258トークンです。動画は1秒あたり263トークンで、公式のコード注釈には、60秒の動画はおよそ263×60=15,780トークンになると書かれています。音声は1秒あたり32トークンです。
さらに、PDFなどのDOCUMENTモダリティのトークンは、画像トークンのレートで課金されると記載されています。請求書や契約書のPDFを読ませる業務を想定している場合、ページ数がそのまま費用に効いてくるということです。紙の資料を大量に読ませる仕組みを考えているなら、テキストのやり取りだけで見積もると実際とずれます。
見積もりを作る手順は3つだけ
手順は単純です。第1に、実際に使う予定の業務から、代表的なやり取りを20件集めます。第2に、その20件を count_tokens に通して、1往復あたりの入力と出力の平均トークン数を出します。第3に、その平均に、1人あたりの1日の件数と営業日数と人数を掛けます。この3つを踏むだけで、この記事の試算表よりも自社に近い数字になります。
逆に、この3つを踏まずに単価表だけを見て月額を語ると、実際より低く出やすくなります。低く見積もった予算で始めて、数か月後に想定の何倍もの請求が来る、という流れを避けやすくなります。
無料枠で使えるモデルと、どこまで試せるか
無料枠は、動くかどうかを確かめるには十分で、業務で使い続ける前提には向きません。料金ページのモデル表を見ると、Gemini 3.8 Flash、Gemini 3.5 Flash、Gemini 3.5 Flash-Lite、Gemini 3.1 Flash-Lite、Gemini 2.5 系の各モデルには無料枠ありと書かれています。一方で、Gemini 3.1 Pro プレビュー版は無料枠では利用できないと記載されています。最新の上位モデルを試したい場合は、その時点で有料枠に上げる必要があるということです。
無料枠でできるのは、社内の実データを使わずに、動作と出力の質を確かめるところまでと考えるのが安全です。理由は後述しますが、無料枠は送ったデータの扱いが有料枠と違うためです。試作の段階で社内の実データを投げてしまうと、そこだけは後から取り消せません。
レート制限の用語(RPM・TPM・RPD)と、公式が固定値を表で公開していないこと
レート制限とは、一定時間にどれだけ呼び出せるかの上限で、RPMは1分あたりのリクエスト数、TPMは1分あたりのトークン数、RPDは1日あたりのリクエスト数を指します。無料枠ではこの上限が低く設定されており、社員が同時に使うと待たされたり、エラーが返ったりします。有料枠に上げる目的の1つが、この上限の引き上げです。
ここで気をつけたいのは、2026年9月16日時点の公式のレート制限のページに、モデル別の無料枠のRPM・TPM・RPDの数値表が掲載されていないことです。原文には、レート上限はさまざまな要因(使用量ティアなど)によって異なり、Google AI Studio で確認できる、と書かれており、指定されたレート上限は保証されず、実際の容量は変動する可能性がある、とも書かれています。ネット上には無料枠は1日何回までと具体的な数値を書いた記事がありますが、公式が表で出していない以上、その数値を前提に社内の計画を立てるのは避けたほうがよいということです。
あわせて公式に書かれているのは、レート上限はAPIキーごとではなくプロジェクトごとに適用されること、RPDは太平洋時間の午前0時にリセットされることです。キーを人数分配れば上限が人数分になる、という考え方は成り立ちません。
無料枠と有料枠で変わるもの(レート上限・コンテキストキャッシュ・Batch API・最新モデル)
有料枠に上げると変わる点は、料金ページの有料カードに列挙されています。本番デプロイのためのレート上限の引き上げ、コンテキストキャッシュの利用、Batch API(コストを50%削減)、最先端モデルへのアクセス、そしてプロダクト改善のためのコンテンツ利用がないこと、の5点です。
| 項目 | 無料枠 | 有料枠 |
|---|---|---|
| レート上限 | 制限付き。固定値は公式の表に掲載されておらず、AI Studio で確認する形 | 本番デプロイ向けに引き上げ |
| コンテキストキャッシュ | 有料カードの機能として記載 | 利用できる(保存量と保存時間に課金) |
| Batch API | 有料カードの機能として記載 | コストを50%削減、と記載 |
| 使えるモデル | 特定のモデルへの制限付きアクセス。Gemini 3.1 Pro プレビュー版は利用不可 | 最先端モデルを含む |
| 送ったデータの扱い | サービス改善のためのコンテンツ利用あり、と記載 | プロダクト改善のためのコンテンツ利用なし、と記載 |
会社の判断としては、レート上限や機能よりも、最後の行が決め手になります。次の節で規約の原文を確認します。
無料枠と有料枠で、送ったデータの扱いが変わる
Gemini APIで社内の情報を扱うなら、無料枠と有料枠の差は機能ではなくデータの扱いだと理解しておく必要があります。Gemini API 追加利用規約(2026年3月23日より有効)には、無料サービスと有料サービスで扱いが違うことが、はっきり書き分けられています。
無料枠では入力が製品の改善に使われ、有料枠では使われない
無料サービス、つまりGoogle AI StudioとGemini APIの無料枠について、規約の原文には、Googleは使用者が本サービスに送信したコンテンツと生成された回答を使用し、Googleのプロダクト、サービス、機械学習技術の提供、改良、開発を行う、と書かれています。さらに、品質の向上とサービスの改善を目的として、使用者が行ったAPI入出力に対して、人間のレビュアーが確認、注記、処理を行う場合がある、とも書かれています。そのうえで、本無料サービスには、プライベート情報、機密情報、または個人情報を送信しないでください、という一文が入っています。
これは書き方を変えた注意喚起ではなく、規約本文に置かれた明確な記載です。料金ページのモデル表にも、行ごとにプロダクトの改善に使用されますという欄があり、無料枠ははい、有料枠はいいえと書かれています。社員が個人で取った無料枠のキーで、顧客名や社内の資料を投げていれば、それは改善に使われる側に入ります。野良AIの記事で扱っている、会社が把握していないAI利用の問題が、APIの形で起きているということです。
有料サービスについては、Googleは、ユーザーのプロンプトまたは回答をプロダクトの改善に使用することはありません、と書かれています。ただし、使用禁止に関するポリシーに対する違反を検出および防止する目的、ならびに法律または規制によって必要とされる開示を行う目的でのみ、プロンプトと回答を一定期間記録する、という記載が続きます。まったく残らないわけではなく、目的が限定される、という読み方が正確です。
請求先アカウントを有効にすると、無料枠の利用も有料サービス扱いになる
ここが、この規約で実務に効く一文です。原文には、Cloud 請求先アカウントを有効化すると、Gemini API および Google AI Studio のすべての使用は、Googleによる使用者のデータの利用方法に関しては有料サービスとなり、これは無料で提供される本サービス(Google AI Studio、Gemini API の無料枠など)を使用する場合でも同様です、と書かれています。
読み替えると、データの扱いを決めているのは、無料枠を使ったか有料枠を使ったかではなく、そのアカウントで請求先アカウントを有効にしているかどうかだということです。会社が管理する請求先アカウントを有効にしたプロジェクトであれば、無料枠の範囲で試している間もデータの扱いは有料サービスの側に立ちます。逆に、社員が自分の個人アカウントで取ったキーには、この前提が揃っていません。同じ無料枠でも、会社として試すのと社員が勝手に試すのとでは、結果がまったく違うということです。
社内で最初に決めること
試作であっても、会社の請求先アカウントを有効にしたプロジェクトのキーだけを使う、と先に決めてください。試してから移せばよい、という順番だと、試作中に送った社内データだけは扱いを戻せません。AIの利用を社内でどう決めるかは生成AI利用ガイドラインの記事にまとめています。
年齢と地域の条件も規約に書かれている
規約には、本APIを利用できるのは18歳以上の方です、という条件があります。また、EEA・スイス・英国のユーザーにAPIクライアントを利用させる場合は、有料サービスのみとされています。海外拠点の社員に使わせる計画がある場合は、無料枠のまま配るという選択肢が最初から取れないということです。
APIで社内ツールを作ると、単価計算やキー管理まで自社で抱えることになります。UPGEAR AI(アップギアAI)は、ChatGPT・Claude・Gemini・Perplexityを1つの契約で使える法人向けサービスです(人数無制限)。
APIキーの取得手順(Google AI Studio)と有料枠への切り替え
APIキーの取得はGoogle AI Studioから行い、有料枠に上げるには請求先アカウントをリンクして最低$5を前払いする、というのが公式の課金ページに書かれている流れです。手順そのものは難しくありませんが、会社として始める場合は、誰のアカウントで取るかを先に決めておく必要があります。
大まかな流れは、Google AI Studio でプロジェクトを選んでAPIキーを発行し、そのプロジェクトに Cloud 請求先アカウントをリンクし、前払いのクレジットを入れる、という順番です。ここで、キーを発行する人のGoogleアカウントと、請求先アカウントを管理する人が別々になっていると、後で誰が支払っているのか分からなくなります。最初に、会社のアカウントでプロジェクトを作る、という一点だけは崩さないほうがよいところです。
支払いの仕組み(Cloud 請求先アカウント/前払いと後払い)
支払いは Cloud 請求先アカウントを通して行われ、前払いと後払いの2つの形があります。公式の課金ページには、無料枠から有料枠に上げるには請求先アカウントをリンクし、最低$5(または同等額)のクレジットを前払いする、と書かれています。1ドル=155円で計算した場合、およそ775円です。
前払いには、条件が2つ書かれています。1つは、アカウントタイプの切り替えの場合を除き、前払いの請求先アカウントでは払い戻しはできない、という記載です。もう1つは、後払いにアップグレードする以外の理由で前払いアカウントを閉鎖した場合、前払いクレジットの残高は失効する、という記載です。加えて、前払いクレジットの有効期限は1年とされています。使い切る前提でない大きな金額を先に入れると、そのまま消えることがあるということです。
もう1つ、請求の単位にも注意が要ります。レート上限も課金上限もプロジェクト単位や請求先アカウント単位で効くため、1つの請求先アカウントに複数のプロジェクトをぶら下げていると、片方の使いすぎが両方に影響します。検証用と本番用で請求先を分けるかどうかは、最初に決めておくべき設計です。
止まり方と予算|上限は壁ではなく、自動で上がる階段
Gemini APIの課金上限は、使いすぎを防ぐ壁ではなく、支払い実績に応じて自動的に上がっていく階段として設計されています。この性質を知らずに、上限があるから安心と説明してしまうと、経理や総務への説明が後で食い違います。
使用量ティアと月間の課金上限(Tier1 $250・Tier2 $2,000・Tier3 $20,000〜)
公式の課金ページには、使用量ティアごとの月間の利用額上限が表で示されています。無料は上限なし、Tier 1 は$250、Tier 2 は$2,000、Tier 3 は$20,000〜$100,000以上です。1ドル=155円で計算した場合、Tier 1 の$250は約38,750円、Tier 2 の$2,000は約310,000円に相当します。
| ティア | 上がる条件(公式の記載) | 月間の利用額上限 |
|---|---|---|
| 無料 | 有効なプロジェクト、または無料トライアル | 上限なし |
| Tier 1 | 請求先アカウントをリンク | $250 |
| Tier 2 | $100の支払い+初回支払いから3日 | $2,000 |
| Tier 3 | $1,000の支払い+初回支払いから30日 | $20,000〜$100,000以上 |
表の2列目が重要です。ティアは申請して上げるものではなく、支払いの実績と日数の条件を満たすと自動的に上がります。つまり、月の上限$250で運用しているつもりでも、支払いが積み上がれば、いつの間にか上限$2,000の階層に移っているということです。上限があるから使いすぎても$250で止まる、という説明は成り立ちません。
上限に達した場合の挙動も書かれています。原文には、次の請求期間(毎月1日)が始まるまで、その請求先アカウントにリンクされているすべてのプロジェクトでサービスが一時停止される、とあります。1つのプロジェクトの暴走が、同じ請求先にぶら下がる他のプロジェクトも巻き込んで止めるということです。社内で複数の仕組みを動かしている場合、業務が同時に止まります。
費用上限・予算アラートの設定と、意図しない高額請求の防ぎ方
使いすぎを抑える仕組みは複数用意されていますが、それぞれに公式が明記している制約があります。防ぎ方を決める前に、この制約を読んでおく必要があります。
1つ目は、費用ベースのレート上限です。10分のローリングウィンドウで見て、無料は設定なし、Tier 1 は$10、Tier 2 と Tier 3 は$200とされています。これを超えると 429 RESOURCE_EXHAUSTED が返ります。短時間の暴走に対しては、この仕組みが効きます。
2つ目は、プロジェクト単位の費用上限です。ただし公式ページには、この機能が試験運用版であることと、次の但し書きが書かれています。原文では、レイテンシ期間が約10分間発生すると、超過料金が発生します、と書かれており、さらに、バッチモードの完了やエージェント セッションなどの長時間実行されるタスクでは、プロジェクトの費用上限を超える超過料金が発生する可能性があります、と書かれています。課金データの処理時間が最大10分程度遅れることがある、という記載もあります。
上限を入れたから安心、が成立しない3つの条件
1. 上限の判定に約10分の遅れがあるため、その10分の間に使った分は超過しうる
2. バッチ処理やエージェントのように長時間動き続ける処理は、上限を超えて課金されうる
3. ティアの上限そのものが、支払い実績に応じて自動的に上がる
この3つは推測ではなく、公式の課金ページに書かれている内容です。予算の説明をするときは、上限で止まると言い切らず、10分程度の遅れがあることまで含めて伝えてください。
前払いクレジットが尽きると、同じ請求先の全キーが同時に止まる
費用が増える方向のリスクだけでなく、業務が止まる方向のリスクも押さえておく必要があります。前払いの残高が尽きれば、その請求先アカウントにリンクされているプロジェクトのAPIキーは機能しなくなります。社内の業務フローに組み込んだ後でこれが起きると、残高の補充が終わるまで、その業務全体が止まります。
さらに、未使用のクレジットには期限があります。前払いクレジットの有効期限は1年で、払い戻しはできないと書かれています。多めに入れておけば安心、という買い方をすると、使い切れなかった分が消えます。稟議に書くべきなのは、月いくらかかるかだけでなく、残高が切れたら誰がいつ気づいて補充するか、という運用の話です。
$300のウェルカムクレジットは、Gemini APIの支払いには使えない
もう1つ、予算の前提が崩れやすい点があります。公式の課金ページのFAQには、Google Cloud のウェルカム クレジットまたは無料トライアル クレジットは Gemini API または AI Studio に使用できません、と書かれています。あわせて、2026年3月より Gemini API の使用料金は $300 の Google Cloud 無料トライアル プログラムの対象外です、とも記載されています。2026年3月2日以降に開設した請求先アカウントの$300のクレジットは、Gemini API と AI Studio の支払いには充てられないということです。
Google Cloud の無料トライアルで数か月は無料で試せる、という前提で予算を組むと、初月から実費が発生します。試作の段階から、前払いのクレジットを自社で入れる必要があると考えておいてください。
使用量と請求額の確認方法(AI Studio のダッシュボード/Google Cloud コンソール)
使った量と請求額は、AI Studio の支払いに関するページと、請求先アカウントを管理する Google Cloud のコンソールの2か所で確認します。どちらを見るかではなく、両方を誰がいつ見るかを決めておくことが、実務では効きます。
確認のときに押さえておきたいのが、数字がリアルタイムではないことです。公式の課金ページには、課金データの処理時間が最大10分程度遅れることがある、という記載があります。画面に出ている金額が今この瞬間の実額とは限らない、ということです。暴走に気づいてから画面を見ても、表示が追いついていない可能性があります。
もう1つは、集計の単位です。レート上限はAPIキーごとではなくプロジェクトごとに適用され、月間の利用額上限は請求先アカウントにリンクされたすべてのプロジェクトに及びます。RPDは太平洋時間の午前0時にリセットされるため、日本時間の午後の時間帯に切り替わります。日本の営業日の区切りとずれることを知らないと、日次の集計を見るときに混乱します。
- 週に1回、使用量と請求額を見る担当を決める危険なのは、誰も見ていない状態です。金額の多寡ではなく、先週と比べて跳ねていないかを見ます。
- プロジェクトと請求先アカウントの対応表を作るどのプロジェクトがどの請求先にぶら下がっているかが分からないと、止まったときに原因を追えません。
- 残高と有効期限を台帳に書く前払いクレジットは1年で失効します。入金日と残高を記録しておきます。
- 表示が最大10分遅れる前提で運用する画面の数字を見て大丈夫と判断した直後に超過することがあります。
コストを抑える設計(モデルの使い分け・コンテキストキャッシュ・Batch APIで50%・出力上限)
費用を下げる方法は公式ページの中にひととおり書かれていて、効き目が大きい順に、モデルの使い分け、Batch API、出力の上限、コンテキストキャッシュの4つです。どれも仕組みを作る側の設計であり、契約を変えて下がるものではありません。
| 方法 | 効き方 | 注意点 |
|---|---|---|
| モデルの使い分け | 処理の種類ごとに系統を分ける。試算ではFlash-Lite系とPro系で8倍の差 | 精度が要る処理まで下げると手戻りが増える |
| Batch API | 単価が標準のおよそ半額。料金ページにコストを50%削減と記載 | すぐ結果が要る処理には使えない。長時間タスクは費用上限を超えうる |
| 出力の上限を決める | 出力の単価は入力の5〜6倍。返す長さを絞ると直接効く | 思考トークンも出力に含まれるため、考えさせる設計は高くなる |
| コンテキストキャッシュ | 同じ長文を毎回送り直さずに済む | 保存量と保存時間の両方に課金。100万トークン1時間あたり$0.50〜$4.50 |
| 検索の無料枠の範囲に収める | Gemini 3系はGoogle検索によるグラウンディングが月5,000件まで無料 | 共有の範囲は全Geminiモデルと全てのGemini 3.xモデルの2通りの表記あり。超過分は1,000件あたり$14 |
順番としては、まずモデルを分けること、次に出力を絞ること、そのうえで急がない処理をバッチに寄せること、という流れが現実的です。キャッシュは効果が大きい一方で、保存時間の管理という新しい運用が増えるため、対象を絞って入れるのが安全です。
もう1つ、費用を下げる前に確認したいのが、そもそもAPIを直接呼ばずに済む処理がないかという点です。社員が画面で調べものをするだけの用途なら、既製のサービスを使うほうが全体の手間は小さくなります。作るか買うかの考え方はローカルLLMとクラウドAIの比較の記事でも整理しています。
単価表に出てこない費用
実際の請求額と社内の総費用が単価表からずれる原因は、ツールの利用料、テキスト以外のモデルの別体系、そして料金表にまったく載っていない社内の手間の3つです。この節は、見積もりが外れる場所を1つずつ潰すためのものです。
Google検索によるグラウンディングなどツール利用の追加料金
モデルにインターネットの検索結果を参照させる機能は、モデルの単価とは別に課金されます。料金ページのツールの料金の欄には、Google 検索によるグラウンディングについて、Gemini 3 モデルは月5,000件まで無料で、その後は1,000件あたり$14と書かれています。共有の範囲は、ツールの料金の欄では全Geminiモデルで共有、モデル別の表では全てのGemini 3.xモデルで共有と、2か所で表記が分かれています。Gemini 2.5 モデルは1,500 RPD まで無料(FlashとFlash-Liteで共有)で、その後は1,000件あたり$35です。Google マップについては、ツールの料金の欄に、1,500 RPD(FlashとFlash-Liteで共有、Proは10,000 RPD)まで無料で、その後は1,000件あたり$25と書かれています。ただし同じページのGemini 3系のモデル表には、月5,000件のプロンプトまで無料(Gemini 3で共有)、その後は1,000件あたり$14と書かれており、2か所で内容が異なります。使う予定のモデルの行を確認してください。
1ドル=155円で計算した場合、Gemini 3系の検索は超過分1件あたり約2.2円、Gemini 2.5系は約5.4円、Google マップは$25で計算した場合に約3.9円です。社員50人が毎日検索付きで使う設計にすると、月5,000件の無料枠は早い段階で使い切ります。1人1日5回で50人なら、20営業日で5,000件です。ここを見落とすと、モデルの単価で作った見積もりに、もう1本の課金が上乗せされます。
無料と書かれたツールでも、生成されたコードや取得した本文はトークンとして課金される
コード実行、URLコンテキスト、ファイル検索は、料金ページで無料と表記されています。ただし同じページに、生成されたコード、実行結果、取得したドキュメントは通常のトークンとして課金される、と書かれています。ツールの利用そのものに料金がかからないだけで、その結果として増えたトークンには料金がかかるということです。
ファイル検索については、エンベディングが100万トークンあたり$0.15と記載されています。社内文書を読ませる仕組みを作る場合、文書を検索可能にする処理そのものにも費用がかかります。無料と書いてあるからゼロ、ではないという読み方が必要です。
画像・動画・音声・埋め込みは別の課金体系
料金ページには、テキストのモデルとは別に、画像生成、動画生成、音声、埋め込みのモデルがそれぞれ独立した表で並んでいます。単価の体系も、件数あたり、秒あたりなど、テキストのモデルとは異なります。埋め込みについては、Gemini Embedding 2 がテキスト100万トークンあたり$0.20と記載されています。
そのため、社内の資料を検索できるようにする仕組み、会議の録画を扱う仕組み、画像を生成する仕組みを同時に作るなら、テキストの単価表だけで見積もることはできません。使う機能ごとに、対応する表を開いて単価を拾い直す必要があります。
画面・認証・ログ・保守・人件費は料金表に入っていない
ここが、単価表と大きくずれる部分です。APIの料金は、モデルを呼び出した分の利用料だけです。社員が使う画面、ログインと権限の管理、誰がいつ何を送ったかのログ、社内からの問い合わせ対応、モデルが提供終了になったときの作り直し、これらはすべて料金表の外側にあります。
金額を出しにくい項目ですが、出さないまま比較すると、料金表に載っている側が安く見えます。少なくとも、次の問いに答えられる形で見積もりを作ってください。誰が最初に作るのか、その工数は何人日か。作った後、月に何時間の保守を誰が担当するのか。社員からの質問には誰が答えるのか。モデルが変わったときに誰が入れ替えるのか。これらに人件費を割り当てて初めて、月額の比較ができる状態になります。
単価には期限がついている|2026年12月31日までと2027年1月1日から
料金ページの単価には期限付きのものがあり、Gemini 3.x の多くの行で、2026年12月31日までの金額と2027年1月1日からの金額が併記されています。Gemini 3.8 Flash の入力は、原文で、2026年12月31日までは$0.75、2027年1月1日からは$1.50と書かれています。出力は$3.75から$7.50、キャッシュは$0.075から$0.15、キャッシュのストレージは1時間100万トークンあたり$0.50から$1.00です。いずれも2倍です。
これを見落とすと、いま作った見積もりが年明けに2倍ずれます。前掲の試算表で言えば、50人でGemini 3.8 Flash を使う想定は、月約11,630円から月約23,250円に変わります。年額では約139,500円から約279,000円です。社内資料に単価を写すときは、金額だけでなく期限も一緒に写してください。
もう1つ、規約側にも価格の変更について記載があります。原文には、別途指定のない限り、変更は掲載されてから30日後に有効になる、と書かれています。改定は事前に長く告知されるものではなく、掲載から30日という短い周期で効き始めるということです。年に1回だけ料金ページを見る運用では追いつきません。
社内の運用に落とすなら
・稟議書と見積書には、単価の横に確認日と適用期限を必ず書く
・期限付きの単価を恒久価格として表に写さない。期限後の金額も併記する
・料金ページを見る担当と頻度を決める(改定は掲載から30日後に有効、と規約に記載)
・年度をまたぐ予算は、期限後の単価で計算した金額も並べて出す
円で払うのか、ドルで払うのか
公式の料金ページに円建ての記載はなく、単価はすべて米ドルで表示されています。Google Cloud 側の料金ページには、料金は米ドル(USD)で表示し、米ドル以外の通貨で支払う場合は Cloud Platform SKU に記載された該当通貨の料金が適用される、と書かれています。円で請求されるかどうかは、請求先アカウントの設定によって決まる部分であり、料金ページの単価をそのまま円に置き換えた表があるわけではありません。
この記事の試算はすべて、1ドル=155円で計算した場合の目安です。この前提は必ず明記してください。為替が動けば、使い方をまったく変えなくても円建ての支出は変わります。1ドルが10円動けば、試算表のGemini 3.8 Flash・50人の月額は、単価が変わらなくても6%以上動きます。年度予算に入れるなら、レートの前提と、レートが動いた場合の幅を併記しておくのが安全です。
日本語のトークン消費と円換算の目安をどう置くか
日本語は英語よりトークンを多く消費すると説明されることがありますが、日本語が何文字で1トークンになるかという換算は、公式のトークンのページに書かれていません。そのため、この記事では文字数からトークン数を導く計算はしていません。同じ趣旨の説明をネット上で見かけても、公式の記載ではない数値を社内の見積もりの根拠にするのは避けてください。
実務での置き方は単純です。トークン数は count_tokens で自社の実データから測り、ドルの単価を掛けてドル建ての月額を出し、最後にレートの前提を書いたうえで円に換算します。この順番なら、換算の前提が1か所(レート)にまとまり、後から為替が動いたときに計算し直せます。文字数から推測した数値を混ぜると、どこがずれたのか追えなくなります。
Developer APIとGemini Enterprise Agent Platformの違い
同じGeminiのモデルでも、AI Studio 経由のDeveloper APIと、Google Cloud 側の Gemini Enterprise Agent Platform では、単価も条件も一致しません。社内の要件でリージョンを指定する必要がある場合は、この差が費用に直接効きます。
Agent Platform の料金ページを見ると、同じモデルでもグローバルと非グローバルで単価が分かれています。Gemini 3.8 Flash は、入力がグローバル$0.75に対して非グローバルが$0.825、出力がグローバル$3.75に対して非グローバルが$4.125です。リージョンを指定する非グローバルのほうが、およそ10%高い設定になっています。処理する場所を指定したいという要件は、単価を上げる方向に働くということです。
もう1つ、Agent Platform の料金ページには、課金されるのは200レスポンスコードを返すリクエストのみです、という記載があります。エラーが返ったリクエストには料金が発生しない、という条件です。また、Developer API の料金ページには、価格はここに記載されている価格や Gemini Enterprise Agent Platform で提供されている価格と異なる場合があります、という注記が付いています。どちらの経路で見積もるかを決めずに単価を拾うと、実際の請求とずれます。
| Developer API(AI Studio 経由) | Gemini Enterprise Agent Platform | |
|---|---|---|
| 入口 | Google AI Studio でキーを発行 | Google Cloud 側の環境 |
| 単価の例(Gemini 3.8 Flash 入力) | $0.75(2026年12月31日まで) | グローバル$0.75/非グローバル$0.825 |
| リージョンの指定 | 料金表はリージョン別に分かれていない | 非グローバルを選ぶと単価が約10%高い |
| エラー時の課金 | 料金ページに個別の記載なし | 200レスポンスコードを返すリクエストのみ課金、と記載 |
| Enterprise向けの条件 | 料金ページのEnterpriseカードから問い合わせ | 専用サポート・ボリュームベース割引などが案内されている |
社内の情報を扱う仕組みで、処理する場所に条件を付ける必要があるかどうかは、費用の話に入る前に決めておく項目です。決め方の材料は生成AI利用ガイドラインの記事にまとめています。
APIキーの流出リスクと管理
APIキーを配ることは、モデルを使う権利だけでなく、請求先を一緒に配ることと同じです。公式の記載では、Cloud 請求先アカウントにリンクされているすべてのプロジェクトは、請求先アカウントの使用量階層と、関連するレート上限とアカウント上限を継承する、と書かれています。レート上限はAPIキーごとではなくプロジェクトごとに適用されます。つまり、キーを1本渡した相手は、そのプロジェクトの上限まで使える状態になり、その利用分は会社の請求先アカウントに積み上がります。
キーが外に出た場合、止める方法は基本的にキーを無効にすることです。ただし、気づくまでの間に使われた分は請求されます。前述のとおり、上限の判定には約10分の遅れがあり、費用ベースのレート上限もTier 1 で$10、Tier 2 以上で$200という10分あたりの枠です。流出に気づくのが数時間後なら、その間の分は積み上がります。
- 本番・検証・個人の実験でキーを分ける1本のキーを共用すると、誰の処理で費用が跳ねたのかを後から追えません。用途ごとに分けて、プロジェクトも分けます。
- キーを発行できる人を決める誰でも発行できる状態だと、会社が把握していないキーが増えます。発行できる人と、発行の記録を残す場所を決めます。
- 退職・異動のときに失効させる手順を作る退職時のチェックリストにAPIキーの失効を入れます。入っていなければ、鍵は残り続けます。
- キーをソースコードや共有ファイルに書かないコードに直接書いたキーは、共有した時点で相手にも渡ります。設定ファイルや環境変数に置き、共有範囲を限定します。
- 止まったときに誰が気づくかを決める残高切れでも上限到達でも、業務は同じように止まります。気づく人と連絡先を先に決めておきます。
社員が個人のGoogleアカウントで取ったキーは、この管理の外側にあります。会社からは存在も利用量も見えず、前述のとおりデータの扱いも会社の請求先アカウントの前提が効きません。野良AIの記事で扱っている問題が、APIという形で起きているということです。
自分で作るか、既製の法人向けサービスを買うか
判断の分かれ目は金額ではなく、作った後に誰が面倒を見るかです。ここまで見てきたとおり、APIの単価だけを比べれば自作は安く見えますが、画面・権限・ログ・保守・問い合わせ対応は料金表の外側にあり、それを担う人が社内にいるかどうかで結論が変わります。
作る価値が出やすい業務と、出にくい業務
APIで作る価値が出やすいのは、処理の形が決まっていて、件数が多く、人が毎回同じ判断をしている業務です。決まった帳票からの項目の抽出、大量の問い合わせの分類、定型の要約、データの突き合わせなどが該当します。こうした業務は、画面を凝る必要がなく、成果が件数で測れるため、投資に対する効果が見えます。
逆に、作る価値が出にくいのは、社員が日々の調べものや文章作成に使う用途です。使い方が人によってばらばらで、画面の使い勝手が成果を左右し、要望が次々に出ます。この用途でAPIから自作すると、モデルの利用料より、画面の改修と問い合わせ対応の手間のほうが大きくなりがちです。
| APIで作る価値が出やすい | 既製のサービスが向きやすい | |
|---|---|---|
| 業務の形 | 手順が決まっている・件数が多い | 人によって使い方が違う・自由度が要る |
| 例 | 帳票からの抽出、分類、定型の要約、突き合わせ | 調べもの、文章の下書き、資料の相談、翻訳 |
| 成果の測り方 | 処理件数と削減時間で測れる | 使う人の満足度に左右される |
| 画面の重要度 | 低い(人が直接触らないことも多い) | 高い(使いにくいと使われない) |
| 費用の中心 | トークンの利用料と初期の開発工数 | 月額の利用料 |
| 止まったときの影響 | その業務だけが止まる | 全社の利用が止まる |
実際には、この2つを分けて考えるのが現実的です。全社員が使う入口は既製のサービスに任せ、件数の多い定型処理だけをAPIで作る、という組み合わせであれば、どちらの弱点も避けられます。全社で使う場合の選択肢の広がりは法人向け生成AIサービスの比較記事にまとめています。
導入前に確認する5項目
APIで組んだ仕組みが特定の1人に紐づくと、その人が抜けた時点で鍵も知識も止まります。作ると決める前に、次の5つに答えられるかを確認してください。答えが全部同じ人の名前になるなら、その時点で作らない判断も選択肢に入ります。
- 1. 誰が書くのか最初に作る人です。社内か、外部に頼むのか。外部に頼むなら、その後の改修の単価も先に決めます。
- 2. 誰が直すのか作った人と直す人が同じとは限りません。仕様が書かれていない仕組みは、作った人以外には直せません。
- 3. 鍵は誰が持つのかAPIキーと請求先アカウントの管理者です。個人のアカウントに紐づいていないかを確認します。
- 4. 止まったとき誰が気づくのか残高切れ、上限到達、モデル側のエラー。気づく人と、業務側への連絡経路を決めます。
- 5. モデルが終わるとき誰が入れ替えるのかモデル名と単価は改定されます。入れ替えの作業と検証を誰がやるかを決めておきます。
この5項目のうち3つ以上が空欄のまま作り始めた仕組みは、動き出した後に社内で持て余しやすくなります。逆に、5項目が埋まっていて、対象が件数の多い定型処理であれば、APIで作る価値は十分にあります。
作る前に、既製の法人向けサービスと並べて比べる
UPGEAR AIは、ChatGPT・Claude・Gemini・Perplexityを1画面で切り替えて使える法人向けプラットフォームです。全モデルで学習非利用を標準適用し、会話履歴・利用ログ・アカウントは国内サーバー(AWSの日本リージョン)で管理します。管理者ダッシュボードで利用ログ・権限・モデルのON/OFFを管理できます。料金は月額30,000円(税抜)からで、ユーザーごとの課金はありません(人数の目安はライト1〜5名、スタンダード6〜20名、プレミアム21〜50名)。別途、初期費用100,000円(税抜)がかかります。APIのトークン単価に含まれるのはモデルの利用料だけで、画面・権限・ログ・保守は含まれません。金額だけでなく、含まれるものの違いで比べてください。
UPGEAR AIの詳細を見るよくある質問
Gemini APIの料金は、Geminiアプリの有料版とは別にかかりますか?
無料枠だけで業務に使い続けても問題ありませんか?
社員10人で使うと、月にいくらぐらいかかりますか?
使いすぎて高額請求になるのを、確実に止められますか?
Google Cloudの$300の無料クレジットは、Gemini APIに使えますか?
Gemini APIの料金は円で請求されますか?
社内のAIをAPIで自作するのと、法人向けのAIサービスを契約するのは、どちらを選ぶべきですか?
まとめ
Gemini APIの料金は、入力・出力・キャッシュのトークン量と保存時間で決まる従量課金制で、単価だけを見れば確かに安く見えます。ただし、その安さは条件付きです。同じ使い方でもモデルを1段上げれば8倍になり、Gemini 3.8 Flash のように2027年1月1日から単価が2倍になる行もあります。検索のグラウンディング、キャッシュの保存時間、無料と書かれたツールが生むトークンは、モデルの単価とは別に積み上がります。
会社としての判断で先に決めるべきなのは、金額より前に2つあります。1つは、試作の段階から会社の請求先アカウントを有効にしたプロジェクトのキーだけを使うことです。規約には、請求先アカウントを有効化すると無料枠の利用もデータの扱いに関しては有料サービスとなる、と書かれています。もう1つは、止まり方の確認です。上限の判定には約10分の遅れがあり、長時間のタスクは上限を超えうること、前払いの残高が尽きれば同じ請求先の全プロジェクトが止まること、ティアの上限は支払い実績で自動的に上がることは、いずれも公式に書かれています。
そのうえで、作るか買うかは、導入前に確認する5項目(誰が書くか・誰が直すか・鍵は誰が持つか・止まったとき誰が気づくか・モデル終了時に誰が入れ替えるか)に答えられるかで判断してください。件数の多い定型処理はAPIで作る価値があり、社員が日々使う入口は既製のサービスのほうが手間が小さく収まります。法人のAI活用に関する他の記事はAI活用コラム一覧をご覧ください。
