
Gemini Flashとは、Googleが提供する生成AIモデル「Gemini」のうち、応答の速さと費用の低さを重視したシリーズの名前です。会社で使うときに先に決めるべきなのは、どの版のFlashを使うかではなく、どのアカウント・どの契約から使うかです。同じGeminiでも、個人のGeminiアプリ、Google Workspaceの仕事用アカウント、Gemini APIの無料枠と有料枠、Google Cloudとで、入力した内容が学習に使われるか、会話が誰の管理下に残るかが変わります。この記事では、前半で最新の3.8 Flashの位置づけ・仕様・料金を公式発表から整理し、後半で社員10〜200名の会社が業務で試す前に確かめておきたい点をまとめます。
※この記事の内容は、2026年9月18日時点で各社の公式ページで確認した内容です。モデルの名前・提供先・料金は短い間隔で変わるため、検討の際は公式ページで最新の内容をご確認ください。
Gemini Flashとは|速さと費用を重視した主力モデル
Gemini Flashは、Googleが日常の大量処理を任せる主力として位置づけているモデル群です。Googleの英語の発表では、3.8 Flashを自社の「最も賢いworkhorse model」(毎日の仕事をこなす働き手のようなモデル)と説明しています。
開発者向けのGemini APIのドキュメントでは、3.8 Flashを、長時間のソフトウェア開発・自律的に動くAIエージェント・複雑な業務フロー向けに作られた、Flashの中で最も賢いモデルと説明しています(いずれも同社の説明)。AIエージェントとは、人が1回ずつ指示しなくても、目標に向けて調べる・書く・ツールを呼ぶといった手順を自分で組み立てて進めるAIの使い方を指します。
Flashの位置づけと、3.8・3.7・3.6の関係
Flashの版は短い間隔で更新されています。公式の発表日(いずれも米国時間の一般提供開始日)を並べると次のとおりです。
- Gemini 3.5 Flash:2026年5月19日
- Gemini 3.6 Flash:2026年7月21日(同じ日にGemini 3.5 Flash-Liteも一般提供)
- Gemini 3.7 Flash:2026年8月13日
- Gemini 3.8 Flash:2026年9月2日
Googleは3.8 Flashの発表で、3.7 Flashから3週間、6週間で3度目のFlashのリリースだと述べています。3.7 Flashの発表も、3.6 Flashからわずか3週間後のリリースだと書いていました。3.8 Flashは3.7 Flashと同じ速さ・同じ低コストのまま、推論とコーディングの力を上げたモデルとして発表されています。
前の版がすぐに使えなくなるわけではありません。Gemini APIの提供終了予定の一覧では、2026年9月18日時点で3.8・3.7・3.6・3.5 Flashのいずれにも終了日が発表されていません。Googleは、効率を優先する用途では3.7 Flashを引き続き全面的にサポートすると明記しています。モデル一覧の説明文は、3.7 Flashと3.6 Flashを前世代、3.5 Flashを旧来のモデルとしています。
検索語としてのGemini Flash:2026年9月18日時点の検索結果では、Gemini Flashと調べると3.5・3.7・3.8の記事が混ざって表示されます。Gemini Flashは特定の版ではなくシリーズの名前として使われていると考えるのが実態に近く、記事や資料を読むときは、どの版の話かを最初に確かめる必要があります。
Flash・Flash-Lite・Proの違い
Geminiには、速さと費用の軽い順にFlash-Lite、Flash、Proという3つの系統があります。Geminiアプリのヘルプは、それぞれを次のように説明しています。
- Flash-Lite:速さを重視した効率のよいモデル。要約やブレインストーミングなど日常的な作業向け
- Flash:速さと推論のバランスが取れた、より強力なモデル。簡単な問題から複雑な問題まで幅広く扱う
- Pro:複雑な数学やコーディングの処理に優れたモデル。一般に応答には他のモデルより時間がかかる
同じヘルプには、より高度なモデルと高い思考レベルほど利用上限を多く消費する、という注意もあります。事務作業に当てはめると、議事録の要約やメールの言い換えのように答えの形が決まっている作業はFlash-LiteやFlash、長いPDFを読み込んで論点を整理する作業はFlash、数字の検算を何段階も重ねる作業や複雑な表計算の式づくりはProを試す、という分け方が目安になります。ただし、これは各モデルの公式説明から導いた目安で、業務ごとの精度を保証するものではありません。
なお、Gemini APIのモデル一覧では、2026年9月18日時点で3.x世代のProはGemini 3.1 Proのプレビュー版だけが掲載されています。各AIの得意分野の比べ方は主要4AIの違いと使い分けで解説しています。
3.8 Flashの仕様と思考レベル
3.8 Flashは、長い資料をまとめて読み込める点と、考える量を3段階で切り替えられる点が特徴です。
仕様:入力100万トークン・出力64Kトークン、扱える形式とツール
Gemini APIのモデルページに掲載されている主な仕様は次のとおりです。トークンは、AIが文章を処理するときの単位で、料金もこの単位で計算されます。
- モデルID:gemini-3.8-flash(安定版)
- 入力できる量:1,048,576トークン(約100万トークン)
- 出力できる量:65,536トークン(約64Kトークン)
- 入力の形式:テキスト・画像・動画・音声・PDF。出力はテキスト
- 使えるツール:関数呼び出し(外部のシステムを呼び出す仕組み)、Google検索によるグラウンディング(検索結果を根拠に回答する機能)、Googleマップによるグラウンディング、コード実行、URLの読み込み、ファイル検索、構造化出力、コンテキストキャッシュ。画面を操作するComputer Useはプレビュー版として対応
- 非対応:音声の生成、画像の生成、Live API
Batch API(まとめて処理する代わりに安くなる方式)、Flex、Priorityの各処理方式にも対応しています。
思考レベルlow・medium・highと、トークン消費が増える設計
3.8 Flashは、難しい作業ほど手間をかけて答える設計で、そのぶんトークンを多く使うことがあります。Googleの発表は、複雑な作業では推論の手順を増やし、ツールを繰り返し呼び出すため、特に高い思考レベルではより多くのトークンを使う場合があると説明しています。Gemini APIのドキュメントも、長く複雑な作業でトークンを多く使うのは設計どおりだと明記しています。
考える量は、思考レベル(thinking_level)で3段階に切り替えます。
- low:答えるまでの時間を短くする。リアルタイムのチャット、下書き、速いデータ分析など、待ち時間を減らしたい用途向け
- medium(既定):ほとんどの作業で品質がよい設定。複雑なコードやエージェントの用途に推奨
- high:推論とツールの使い分けの力を最大にする。深い推論、数学、難しい多段階の作業向け
それより軽いminimalは3.8 Flashでは使えず、指定するとエラーになります。Googleは、日常の作業では思考レベルを下げてトークン消費を抑えるか、3.7 Flashを使い続ける選択肢を示しています。社内で使う場合も、定型の作業はlowから試し、足りない場面だけmediumに上げる運用のほうが費用を読みやすくなります。
3.7 Flashからの伸びと、Google発表のベンチマーク
ベンチマークの数字は、どれもGoogleが自社で発表したもので、第三者による独立検証の結果ではありません。読むときはこの前提を置いてください。
前モデルからの伸びとベンチマーク(Google発表)
3.8 Flashの発表記事の本文で数値が示されているのは、専門分野の多段階の推論を測るHLE-Verifiedの54.9%です。発表記事に掲載された比較表からは、3.7 Flashとの差として次の値が読み取れます(左が3.8 Flash、右が3.7 Flash)。
- DeepSWE v1.1(長時間のソフトウェア開発):73.7%/65.3%
- Vals Finance Agent v2(金融アナリストの業務):61.4%/59.0%
- Harvey's Legal Agent Benchmark(法務の業務・すべて合格した割合):10.0%/8.8%
- HLE-Verified:54.9%/53.6%
- GDP.PDF(PDF文書の理解):35.0%/34.0%
- OSWorld-2.0(パソコン操作):59.0%/50.6%
1つ前の3.7 Flashも、発表時に3.6 Flashとの比較として、DeepSWE v1.1で65.3%(3.6 Flashは49.0%)、GDP.PDFで34.0%(同22.0%)という値を示していました。比較表には他社のモデルの値も載っていますが、測り方は同社の方法論ページに依存するため、この記事では他社との優劣は扱いません。
数字の読み方:事務作業に近いPDF文書の理解(GDP.PDF)は、3.7 Flashから1ポイントの差です。伸びが大きいのは長時間の開発やパソコン操作などエージェント寄りの項目で、社内文書の要約や下書きが中心の会社にとっては、3.8 Flashへの切り替えで体感が大きく変わるとは限りません。
デモと導入企業のコメント
Googleは発表記事とDeepMindのモデルページに、開発環境のGoogle Antigravityで簡単な指示から作った3Dのゲームや、1回の指示で経路案内まで動くDOS版のGoogleマップなどのデモを掲載しています。導入企業のコメントとしては、Gleanが自社の評価で3.7 Flashの3倍以上のタスクを完了したと述べています。これはGoogleのサイトに掲載された導入企業のコメントで、評価の条件は公開されていません。
安全性:悪用へのセーフガードとプロンプトインジェクション耐性
Googleは、3.8 Flashに化学・生物・放射性物質・核(CBRN)とサイバー攻撃の分野での悪用を防ぐセーフガードを入れたと発表しています。また、Gemini 3.8のモデルは、Gray Swanによる測定でプロンプトインジェクションへの耐性が大きく改善したとしています。プロンプトインジェクションとは、読み込ませた文書やWebページに紛れ込ませた指示でAIを乗っ取ろうとする攻撃です。AIにメールや外部のページを読ませる使い方が増えるほど、この耐性が問題になります。ただし耐性は攻撃を防ぎきる保証ではないため、社外から届いたファイルをAIに読ませる業務では、出力を人が確認する工程を残してください。
同時発表のGemini 3.8 Flash Cyberは一般企業向けではない
3.8 Flashと同じ日に発表されたGemini 3.8 Flash Cyberは、一般の会社が申し込んで使うモデルではありません。
3.8 Flash Cyberと、審査済みの組織だけに提供するFairwind Program
3.8 Flash Cyberは、ソフトウェアの脆弱性の発見と修正に特化した派生モデルです。Googleは、サイバーセキュリティ向けに制限をゆるめた設定で出荷しているため、信頼できる防御側の組織にだけ提供すると説明しています。提供の枠組みは同日に始まったFairwind Programで、対象は政府・国のサイバー当局、重要インフラの事業者、中核となる技術基盤の事業者です。参加する組織は、社内のセキュリティ・インシデント対応・侵入テストの担当者だけに使わせることや、多要素認証の導入などの厳しい運用基準に同意する必要があり、世界で650以上の組織が参加しているとGoogleは発表しています。
一般の会社が自社のコードの点検にAIを使いたい場合、Googleは、Google Cloudの顧客であれば公開モデルとCodeMenderを使ってコードを守れると案内しています。
どこで使えるか|開発者・企業・個人の提供先
3.8 Flashの提供先は、開発者・企業・個人の3つに分かれます。どこから使うかで、データの扱いと管理のしかたが変わります。
提供先の整理:開発者・企業・個人
- 開発者:Gemini API(Google AI Studioから試せる)、開発環境のGoogle Antigravity、Android Studio、UIを作るStitch
- 企業:Gemini Enterprise。Google Cloud側のリリースノートでは、2026年9月2日からglobal・us・euのリージョンで一般提供と記載
- 個人:Google AI ProとUltraの契約者が、Geminiアプリ、Google検索のAIモード、GoogleスプレッドシートのGeminiで使えると発表(同社発表)
個人向けは、発表でGoogle AI ProとUltraの契約者が対象とされています。日本の料金ページでは、無料プランのGeminiアプリの欄に3.6 Flashへのアクセスと書かれており、Google AI Plus(月725円)、Google AI Pro(月2,900円)、Google AI Ultra(月14,500円から)の欄には、Flashの版番号(3.8 Flash)の記載がありません。日本のPro契約者の画面にいつ3.8 Flashが表示されるかは、実際の画面で確かめてください。
エージェント用途への軸足
3.8 Flashの発表は、チャットよりもエージェントとしての使い方に重心があります。Gemini APIのドキュメントでは、Googleが運用を引き受けるManaged Agentsの既定のエージェント(Antigravity agent)が3.8 Flashで動くようになり、Antigravity SDKも既定で3.8 Flashを使うと説明しています。Google Cloud側でも、コードの脆弱性を直すCodeMender CLIの既定モデルが3.8 Flashになりました。
個人向けでは、1つ前の3.7 Flashの発表時に、Geminiアプリの常時稼働の個人エージェントGemini Spark(Google AI ProとUltraの契約者向け、対象国のみ)が3.7 Flashを使い始めたと案内されています。長く動かすほどトークンを使う設計なので、エージェントに任せる作業は、費用の上限を決めてから始めるのが安全です。
Gemini APIの料金|2026年末までの導入価格と2027年からの単価
3.8 FlashのAPI料金は、2026年12月31日までの導入価格で、2027年1月1日から入力・出力ともに2倍になります。
API料金:入力$0.75・出力$3.75は2026年末まで、2027年から$1.50・$7.50
Gemini APIの料金ページ(標準の処理・100万トークンあたり)の表示は次のとおりです。
- 入力:2026年12月31日まで$0.75、2027年1月1日から$1.50
- 出力(思考に使ったトークンを含む):2026年12月31日まで$3.75、2027年1月1日から$7.50
- BatchとFlex:入力$0.375・出力$1.875(2027年から$0.75・$3.75)。無料枠では使えない
- Priority:入力$1.35・出力$6.75(2027年から$2.70・$13.50)
3.7 Flashと3.6 Flashも同じ導入価格と通常価格で表示されています。3.6 Flashは発表時には入力$1.50・出力$7.50でしたが、2026年9月18日時点の料金ページでは3.8 Flashと同じ導入価格が表示されています。Googleは、導入価格はGoogle AI StudioとGemini Enterprise Agent Platformの両方に適用されると案内しています。
1ドル=155円で計算した場合、100万トークンあたりの入力は約116円、出力は約581円で、2027年からは約233円、約1,163円になります。Google検索によるグラウンディングは、有料枠で月5,000件まで無料(Gemini 3.xのモデルで共有)、それを超えると1,000件あたり$14かかり、無料枠では使えません。
※料金は2026年9月18日時点でGoogleの公式料金ページに表示されている金額です。料金ページに税の記載はないため、円換算に税は含めていません。
既存のAPIから3.8 Flashへ移行するときの変更点
すでにGemini APIを社内ツールに組み込んでいる場合、モデル名を書き換えるだけでは済まないことがあります。
移行の手順:モデルID・temperatureの削除・thinking_level
Gemini APIの移行ガイドが挙げる主な変更は次の3つです。
- モデルIDを
gemini-3.8-flashに変える - 生成設定からtemperature・top_p・top_k(出力のばらつきを調整する値)を削除する。これらは2026年7月21日から非推奨になっている
- 思考の量を数値で指定していた
thinking_budgetを、文字列で指定するthinking_levelに置き換える
3.7 Flashは引き続きサポートされるため、急いで切り替える必要はありません。費用が上がる可能性もあるため、同じ業務の入力を両方のモデルに流し、答えの質とトークン数を比べてから切り替えると判断しやすくなります。応答にはトークンの内訳が返り、送る前の入力はトークン数を数える機能で確かめられます。
Google Cloud側(Gemini Enterprise Agent Platform)では、Gemini 2.5 Flashの提供終了日が2026年10月20日と表示されています(すでに使っている場合の扱いは、公式の案内で確認してください)。Gemini API側の2.5 Flashは終了日が未発表で、場所によって扱いが違う点に注意してください。
会社で使う前に|入口ごとにデータの扱いが違う
ここからは、会社で使う目線の話です。結論から言うと、入力した内容の扱いは、モデルの版ではなく、どのアカウント・どの契約から使うかで決まります。同じGeminiでも、入口は大きく6つに分かれます。
| 入口 | 入力の学習利用 | 人によるレビュー・記録 | 会話の管理 | 3.8 Flash |
|---|---|---|---|---|
| 個人のGeminiアプリ(無料プラン) | アクティビティの保存がオンなら改良に使われる | ありうる | 本人のアカウント | 料金ページの表記は3.6 Flash |
| Google AI Pro・Ultra(個人の有料プラン) | 無料プランと同じ個人アカウントの設定 | ありうる | 本人のアカウント | 提供対象(同社発表) |
| Workspaceの仕事用アカウント(対象エディション) | 許可なくドメイン外の学習には使われない | レビューなし(履歴は管理者の設定で保存) | 管理者が設定 | 提供の告知は未確認 |
| Gemini APIの無料枠 | プロダクトの改善に使われる | ありうる | 開発した会社 | 使える |
| Gemini APIの有料枠 | プロダクトの改善に使われない | 違反の検出目的で一定期間記録 | 開発した会社 | 使える |
| Google Cloud(Gemini Enterprise・Agent Platform) | Google Cloudの契約条件による | 契約条件による | 会社のGoogle Cloud | global・us・euで使える |
※各行の出典:Geminiアプリのプライバシーハブ、Workspaceの生成AIに関するプライバシーハブと管理者ヘルプ、Gemini API追加利用規約と料金ページ、Google Cloudのリリースノートとモデルページ。2026年9月18日時点の内容です。
入口1:個人のGeminiアプリ(無料プラン)
社員が自分のGoogleアカウントでgemini.google.comを開いて使う形です。18歳以上のユーザーは、アクティビティの保存が既定でオンになっています。Geminiアプリのプライバシーハブは、トレーニングを受けた人間のレビュアーが収集したデータの一部を確認することがあるとし、レビュアーに見られたくない機密情報や、機械学習技術などの改良に使われたくない情報は入力しないよう求めています。一度に読み込める量も、プランなしでは32,000トークンに限られます。
入口2:Google AI Pro・Ultra(個人の有料プラン)
3.8 Flashをアプリで使えるとGoogleが発表しているのは、この有料プランです。ただし、有料にしても個人アカウントであることは変わりません。Google AIのプランは、公式FAQで個人のGoogleアカウントでのみ申し込めると明記されており、Workspaceの利用者は既存の契約へのアドオンを申し込むよう案内されています。データの扱いは入口1と同じ個人アカウントの設定で決まり、データの扱いは変わらず、違うのは読み込める量(100万トークン)や利用上限などです。
起きやすい構図:新しいモデルを早く試したい社員が、月2,900円のGoogle AI Proを自分で契約し、そこに業務の資料を入れる。本人に悪意はなくても、会社から見れば管理の外で業務データが扱われる、いわゆる野良AI(シャドーAI)の典型的な形です。新モデルの話題が出るたびに、この構図が起きやすくなります。
入口3:Google Workspaceの仕事用アカウント
Business StarterやBusiness Standardなど対象のエディションでは、GeminiアプリはWorkspaceのコアサービスとして扱われます。管理者ヘルプは、ユーザーのコンテンツが人間にレビューされることも、許可なくドメインの外で生成AIモデルのトレーニングに使われることもないと明記しています。管理コンソールで組織部門やグループごとにオン・オフでき、会話履歴は既定で18か月保存され、管理者が3か月・18か月・36か月の保持期間を選ぶか、履歴をオフにできます。
注意したいのは、Workspaceでも対象外のエディションがある点です。Workspace IndividualやCloud Identityなど追加サービス扱いの場合は、Google利用規約とGeminiアプリのプライバシーに関するお知らせが適用され、チャットが人間のレビュアーに確認され、改良に使われる場合があります。また、Googleの3.8 Flashの発表で企業向けの提供先として挙がっているのはGemini Enterpriseで、WorkspaceのGeminiアプリで3.8 Flashを提供するという告知は、2026年9月18日時点のWorkspaceの更新情報には見当たりません。
入口4:Gemini APIの無料枠
Google AI StudioでAPIキーを発行すると、3.8 Flashも無料で試せます。一方、Gemini API追加利用規約は、無料サービスに送った内容と生成された回答をGoogleのプロダクトや機械学習技術の改良に使うこと、人間のレビュアーが入出力を確認する場合があることを定め、無料サービスにはプライベート情報、機密情報、個人情報を送信しないよう求めています。社内の資料を試しに流す場所としては向きません。無料枠の1日あたりの回数は、公式ページに数値の表がなく、AI Studioで確かめる形になっています。
入口5:Gemini APIの有料枠
請求先アカウントを紐づけた有料枠では、規約上、プロンプトと回答はプロダクトの改善に使われません。ただし、使用禁止ポリシーへの違反の検出と、法令で求められる開示のために、一定期間は記録されます。規約には、Cloudの請求先アカウントを有効にすると、Gemini APIとGoogle AI Studioのすべての使用が、データの扱いについては有料サービスになるという条項もあります。無料で使っている部分も含めて学習に使われない側に入るため、業務で試すなら最初から請求先を有効にしたプロジェクトで試すほうが扱いが明確です。
入口6:Google Cloud(Gemini Enterprise・Agent Platform)
Google Cloudの契約の中で使う形です。Gemini APIの料金ページでは、専用サポート・高度なセキュリティとコンプライアンス・処理量の予約などを備えた法人向けの階層として位置づけられています。どの地域で処理させるかを選べるのが大きな違いで、この点は後の処理場所の節で扱います。データの扱いは会社とGoogle Cloudの契約条件で決まるため、契約前に条件を確認してください。
入口が複数あると、社員がどこから使ったかでデータの扱いと記録の残り方が変わります。UPGEAR AI(アップギアAI)は、ChatGPT・Claude・Gemini・Perplexityを1つの契約で使える法人向けサービスです(人数無制限)。
個人のGeminiアプリで設定を変えてもできないこと
個人アカウントでアクティビティの保存をオフにすれば、以後の会話は学習に使われなくなります。ただし、それで会話がどこにも残らなくなるわけではありません。
アクティビティの保存をオフにしても最長72時間は残る
設定はパソコンのgemini.google.comで、設定とヘルプからアクティビティを開き、上部のオンを押してオフにします。プライバシーハブによると、オフにした後の会話はアクティビティに表示されず、AIモデルのトレーニングにも使われません(本人がフィードバックを送った場合を除く)。一方で、応答やフィードバックの処理と安全のために、会話は最長72時間アカウントに保持されます。一時チャットも同じ扱いです。
さらに、人間のレビュアーが確認したチャットは、アクティビティを削除しても消えず、最長3年間保存されます。自動削除の既定は18か月で、3か月・36か月・自動削除しないの中から変更できます。
会社から見えないという問題
設定を正しくしても、残る課題があります。個人アカウントの会話は本人のアカウントに保存されるため、会社は誰が・いつ・何を入力したかを一覧で確かめられません。本人が設定を戻しても気づけず、退職後も履歴は本人の手元に残ります。学習に使われないことと、会社が管理できることは別の話です。仕事用アカウントの場合は、Geminiアプリのアクティビティを削除できるのはWorkspaceの管理者だけで、会話履歴の保持期間も管理者が決めます。
社員に個人アカウントでの利用を認めるかどうかを決めるときは、生成AIのセキュリティ対策チェックリストで点検項目を先に洗い出しておくと、判断がぶれにくくなります。
Gemini APIを業務で使うときの費用と止まり方
APIの有料枠は、使った分だけ払う仕組みですが、前払いと上限の仕組みを知らないと、ある日突然止まることがあります。経理・総務の担当者が知っておきたい点をまとめます。
前払いと利用額の上限
- 始めるとき:請求先アカウントを紐づけ、最低$5のクレジットを前払いする。前払いクレジットの有効期限は1年で、原則として払い戻しはできない
- 月の上限:利用実績に応じたTierごとに月の利用額に上限がある。Tier 1は$250、Tier 2は$2,000、Tier 3は$20,000からそれ以上
- 上限の引き上げ:Tier 2は$100の支払いと初回支払いから3日、Tier 3は$1,000の支払いと初回支払いから30日で自動的に上がる
- 短時間の上限:10分間の利用額にも上限があり、Tier 1は$10。超えると一時的にエラーになる
上限に達すると請求先の全プロジェクトが止まる
課金のドキュメントによると、月の上限に達すると、次の請求期間が始まる毎月1日まで、その請求先アカウントに紐づくすべてのプロジェクトでサービスが一時停止します。1つの部署の使いすぎが、同じ請求先で動いている別の社内ツールまで止める可能性があるということです。プロジェクト単位の費用上限の機能は試験運用版で、請求データの反映が最大10分ほど遅れるため、長時間動くエージェントやバッチ処理では上限を超える料金が発生しうると明記されています。
もう1つ、2026年3月2日以降に開設したGoogle Cloudの請求先アカウントの$300のウェルカムクレジットは、Gemini APIとAI Studioの支払いには使えません。費用の管理全般については生成AIのコスト管理で整理しています。
Google Cloudで3.8 Flashを使うときの処理場所
2026年9月18日時点で、Google CloudのGemini Enterprise Agent Platformでは、3.8 Flashを東京リージョンで使えません。
3.8 Flashはglobal・us・euのみ、東京リージョンは非対応
リージョンとは、データを処理するデータセンターの地域のことです。Agent Platformの3.8 Flashのモデルページでは、提供地域はglobal(地域を指定しない)と、us・euのマルチリージョンだけです。地域ごとの対応表でも、東京(asia-northeast1)を含むアジア太平洋の各リージョンで3.8 Flashの欄は空欄で、3.7 Flashと3.6 Flashも同じです。
一方、同じ表で3.5 Flashと2.5 Flashは東京リージョンに対応しています。Googleのドキュメントは、globalのエンドポイントを使うと処理がどの地域に送られるかを管理も把握もできないため、処理場所に要件がある場合はglobalを使わないよう注意しています。
判断の言い換え:取引先との契約や社内規程で、AIの処理を日本国内で行うことを条件にしている会社は、2026年9月18日時点では、Google Cloud上で3.8 Flashを選べません。東京リージョンに対応している3.5 Flashなどを使うか、処理場所の条件を見直すかの判断になります。なお、Agent Platformでは2.5 Flashの提供終了日が2026年10月20日と表示されているため、新しく組むなら3.5 Flashが候補になります。
円での月額試算|10人と50人で比べる
Gemini APIで社内ツールを作り、社員に3.8 Flashを使わせた場合の費用を、前提を置いて試算します。トークン数は業務の内容で大きく変わるため、下の数字は考え方の例です。
試算の前提
- 1人1日20回、月20営業日(1人あたり月400回)
- 1回あたり入力5,000トークン、出力2,000トークン(出力は思考に使ったトークンを含む)
- 標準の処理・思考レベルは既定、検索などのツール料金と税は含めない
- 1ドル=155円で計算した場合
この前提では、1人あたり月に入力200万トークン、出力80万トークンになります。
2026年12月までと2027年1月からの比較
2026年12月まで(導入価格):1人あたり入力$1.50+出力$3.00=月$4.50(約698円)。10人で月$45(約6,975円)、50人で月$225(約34,875円)です。
2027年1月から(通常価格):単価が2倍になるため、1人あたり月$9.00(約1,395円)。10人で月$90(約13,950円)、50人で月$450(約69,750円)です。
見落としやすい点:50人の2027年の試算額$450は、Tier 1の月の上限$250を超えます。Tierが上がる前にこの使い方をすると、月の途中で請求先の全プロジェクトが止まる計算です。単価の倍増と上限の両方を、予算と運用の計画に入れておく必要があります。
実際のトークン数は、送る前にトークン数を数える機能で確かめられ、応答にも入力・出力・思考の内訳が返ります。長いPDFを毎回読み込ませる使い方や、思考レベルをhighにした使い方では、この試算を大きく上回ります。反対に、急ぎでない処理をBatchに回せば、単価は標準の約半分です。
※試算の前提は説明のための仮定です。APIの利用料のほかに、社内ツールの開発・運用の費用が別にかかります。
直近は約3週間で版が変わる|社内ルールは入口で書く
Flashは2026年7月から9月の間に3回版が変わりました。社内ルールにモデル名を書くと、そのたびに書き直しが必要になります。
モデル名ではなく、アカウントと契約で決める
たとえば、Gemini 3.7 Flashは使用可と書いたルールは、3週間後には古くなります。変わりにくいのは、どの入口から使うかのほうです。ルールは次のように入口で書くと、版の更新に左右されません。
- 業務の情報を入力してよいのは、会社が契約・管理するアカウントと環境に限る
- 個人のGoogleアカウント(無料・有料を問わない)には、社外秘・顧客の情報を入力しない
- Gemini APIは請求先を有効にした会社のプロジェクトだけで使い、無料枠の個人キーで業務データを送らない
- 処理場所に条件がある業務は、リージョンを指定できる環境で、条件を満たすモデルだけを使う
入力してよい情報を入口ごとに分ける
情報の区分と入口を組み合わせると、現場が迷いにくくなります。公開済みの情報(自社サイトの文章、公表資料)はどの入口でも入力してよい、社外秘の資料は会社が管理する環境だけ、顧客の個人情報や顧問先の決算データのように取引先から預かった情報は、会社が管理する環境の中でも、取引先との契約で認められた範囲だけ、という3段階が目安です。会計事務所であれば顧問先の試算表、総務であれば社員の人事情報が、3つ目の区分に入ります。ルール文書の組み立て方は生成AIの社内ガイドラインの作り方で解説しています。
社員が新しいFlashを試す前の確認リスト
新しい版が出たときに、社員が試す前に確かめておきたい項目です。
- どのアカウントで使うか個人のGoogleアカウントか、会社のWorkspaceか、会社のAPIプロジェクトか。個人で契約したGoogle AI Proは個人アカウントの扱いです。
- 入力した内容が学習に使われる設定か個人アプリはアクティビティの保存の設定次第、APIは無料枠か有料枠かで変わります。Workspaceは対象エディションかどうかを確かめます。
- 入力してよい情報の区分が決まっているか公開情報・社外秘・取引先から預かった情報の3区分と、それぞれ使ってよい入口を先に決めておきます。
- 誰が・いつ・何を使ったかが会社に残るか個人アカウントの会話は会社から見えません。記録を残すには、管理者が利用状況を確認できる環境が必要です。
- 費用の上限と、上限に達したときの止まり方を把握しているかAPIはTier 1で月$250の上限があり、達すると請求先の全プロジェクトが翌月1日まで止まります。2027年からの単価の倍増も予算に入れます。
- 処理場所の条件を満たすか国内処理が条件なら、2026年9月18日時点で3.8 FlashはGoogle Cloudの東京リージョンでは使えません。
- 版が変わったときに見直す担当者が決まっているかFlashは2026年7月から9月の間に3回更新されています(直近は約3週間ごと)。提供先・料金・処理場所を見直す担当者と確認のタイミングを決めておきます。
優先順位をつけるなら:7項目のうち、後から取り返しがつきにくいのは、どのアカウントで使うかと、記録が会社に残るかの2つです。個人アカウントで始まった利用は、履歴ごと会社の管理下に移すことができません。
社員のAI利用を、会社の管理下に
社員が個人アカウントで生成AIを試す前に、会社として管理できる環境があるかを確かめてください。UPGEAR AIは、ChatGPT・Claude・Gemini・Perplexityを1画面で切り替えて使える法人向けAI基盤です。全モデルで学習非利用を標準適用し、会話履歴・利用ログ・アカウントは国内サーバー(AWSの日本リージョン)で管理します。管理画面では、誰が・いつ・どのAIを・どう使ったかを一覧で確認でき、使わせるAIも会社が選べます。UPGEAR AIの料金は月額30,000円(税抜)からで、ユーザーごとの課金はありません(人数の目安はライト1〜5名、スタンダード6〜20名、プレミアム21〜50名)。初期費用100,000円(税抜)が別途かかります。
UPGEAR AIの詳細を見るよくある質問
Gemini Flashは無料で使えますか?
Gemini 3.8 Flashと3.7 Flashはどちらを使えばよいですか?
個人のGeminiアプリに入力した内容は学習に使われますか?
社員が自費で契約したGoogle AI Proを業務に使ってもよいですか?
Gemini APIの無料枠で社内ツールを試作してもよいですか?
Gemini 3.8 Flashは日本国内のデータセンターで処理できますか?
会社でGeminiを使うなら、どの契約を選べばよいですか?
まとめ
Gemini Flashは、Googleが速さと費用を重視して作る主力のモデル群で、2026年9月2日に公開された3.8 Flashが最新です。長時間の開発やエージェントに強くなった一方、難しい作業ではトークンを多く使い、APIの単価は2027年1月から2倍になります。ベンチマークはすべてGoogleの発表です。
会社で使うときに効いてくるのは、版の違いより入口の違いです。個人のGeminiアプリは有料でも個人アカウントで会社からは見えず、APIの無料枠は機密情報を送らない前提の場所です。Flashは直近では約3週間ごとに更新されているため、社内ルールはモデル名ではなく入口で書き、社員が新しい版を試す前に、どのアカウントで使うか、記録が会社に残るかを確かめる流れを決めておくことをおすすめします。複数のAIを会社でどう併用するかはマルチAIの解説、そのほかの記事はAI活用コラム一覧をご覧ください。
