コンテンツへスキップ

media AI活用の最前線

ツール比較・実践ガイド

Gemini 3.6/3.7 Flashとは|料金・世代比較【2026年10月】

Gemini 3.6/3.7 Flashとは|料金・世代比較【2026年10月】

2026年9月6日更新:2026年9月2日にGemini 3.8 Flashが一般提供(GA)になったため、世代表・料金表・用途別の推奨モデルを更新しました。単価は3.6/3.7 Flashと同じ入力$0.75・出力$3.75(100万トークンあたり・2026年12月31日まで)です。あわせて、セキュリティ特化モデルも「Gemini 3.8 Flash Cyber」へ更新され、新設のFairwind Programで信頼された防御側にのみ提供される点を追記しました。本文中の料金はすべてGemini API公式料金ページで再確認しています。

結論: 2026年9月6日時点でGoogleのGemini Flashティアは「3.5 Flash-Lite」「3.5 Flash」「3.6 Flash」「3.7 Flash」「3.8 Flash」の5世代が併存しています。3.6 Flashは2026年7月21日、その3週間後の8月13日には後継の3.7 Flashが発表され、コーディング系ベンチマーク(DeepSWE)が49.0%から65.3%へ跳ね上がりました。さらに9月2日にはGemini 3.8 Flashが一般提供(GA)となり、単価は3.7 Flashと同額のまま最上位のFlashになっています。「Gemini 3.6 Pro」という製品は存在せず、上位のProティアはGemini 3.1 Pro(Gemini APIではプレビュー)やGemini 3.1 Deep Thinkという別ラインで、フラッグシップの3.5 Proは2026年9月6日時点でも一般提供が始まっていません。新規にFlashティアを選ぶなら、コーディング・エージェント運用は3.8 Flash、検索・大量処理は3.5 Flash-Liteが基本線です。

この記事の要点:

  • 要点1: 2026年9月2日にGemini 3.8 Flashが一般提供(GA)。3.6/3.7 Flashと同額(入力$0.75・出力$3.75/100万トークン、2026年12月31日まで)で、長時間のソフトウェア開発・自律エージェント向けに強化された最上位Flash
  • 要点2: 2026年8月13日発表のGemini 3.7 Flashも同額のまま。Googleは効率重視のワークロード向けに3.7 Flashを引き続きサポートすると明言
  • 要点3: 「Gemini 3.6 Pro」は存在しない。Proティアは別ライン(3.1 Proプレビュー/3.1 Deep Think/「近日提供」表示のままの3.5 Pro)
  • 要点4: Gemini 3.5 Flash-Liteは入力$0.30・出力$2.50で依然として最安・最速(350トークン/秒)

対象読者: 生成AIのAPIコストとモデル選定を見直したい情シス担当者・エンジニアリングマネージャー・経営者

読了後にできること: 現行のGemini Flash世代(3.5 Flash-Lite〜3.8 Flash)を用途別に整理し、自社のどの業務にどのモデルを割り当てるべきか判断できるようになります

最終更新:2026年9月6日(Gemini 3.8 Flashの一般提供と公式料金を再確認)

この記事はもともと2026年7月21日のGemini 3.6 Flash・3.5 Flash-Lite・3.5 Flash Cyberの同時発表を扱ったものでした。ですが、わずか3週間後の8月13日にGoogleは後継の「Gemini 3.7 Flash」を発表し、さらにその3週間後の9月2日には「Gemini 3.8 Flash」が一般提供(GA)となりました。Google自身が「6週間で3本目のFlash」と説明しているとおり、Flashティアの世代交代はさらに加速しています。Uravationでは法人向けのAI研修・導入支援を行う中で、Geminiは検索経由の流入で最も接点の多いモデルファミリーの一つです。「結局いま何を選べばいいのか」が数週間おきに変わる状況は、情シス担当者にとって大きな負担になっています。

この記事では、Google公式ブログ・Google DeepMindのモデルカード・公式料金ページの情報をもとに、現行のGemini Flashティア(3.5 Flash-Lite〜3.8 Flash)を世代ごとに整理し、料金・仕様・用途別の選び方をまとめます。既に3.6/3.7 Flashを使っている場合の移行判断、これから選定する場合の比較軸の両方をカバーします。

【2026年9月16日 追記】

Gemini 3.8世代の音声モデル「Gemini 3.8 Live」と推論強化の「3.8 Live Extended Thinking」が2026年9月に公開されました。3.7世代との違い・料金・提供面。詳しくは Gemini 3.8 Liveとは|裏でタスク実行する音声AIの料金と使い方 で整理しています。

【追記 2026年10月1日】Flash 系の上に「Gemini 4 Argon」が発表されました

Google は2026年9月30日(米国時間)に Gemini 4 Argon を発表しました。API の導入価格は入力 100万トークンあたり 2ドル・出力 10ドルで、Flash 系との差は導入価格でも約 2.7 倍、通常価格(入力 4ドル・出力 20ドル)では 5 倍を超えます。長い多段階の作業に絞って使うモデルで、提供の順番と料金の整理は Gemini 4 Argonとは|料金・提供時期・できること【2026年9月】 にまとめています。

Gemini Flashティアの世代整理|3.1→3.5→3.6→3.7→3.8

Geminiのモデル名はバージョン番号が細かく刻まれるため、「今どれが最新か」が分かりにくくなっています。まず全体像を時系列で整理します。

Gemini Flashティアの世代進化タイムライン。3.1 Flash-Liteから3.5 Flash-Lite・3.5 Flash、2026年7月21日の3.6 Flash、8月13日の3.7 Flashまでの発表時期と位置づけを示す図

モデル発表時期位置づけ2026年9月6日時点の状態
Gemini 3.1 Flash-Lite/3.1 Flash2026年春旧世代の軽量モデル提供中(詳細は後述の別記事で解説)
Gemini 3.5 Flash-Lite2026年7月21日3系で最安・最速のティア提供中(現行)
Gemini 3.5 Flash2026年6月GA旧世代の汎用Flash提供中だが3.6/3.7 Flashが実質的な後継
Gemini 3.6 Flash2026年7月21日Flashティアの主力(ワークホース)提供中(3.7 Flashが上位互換として登場済み)
Gemini 3.5 Flash Cyber2026年7月21日セキュリティ診断特化一般提供なし(政府・パートナー限定パイロット)
Gemini 3.7 Flash2026年8月13日効率重視のワークホース提供中(3.8 Flash登場後も公式に「引き続き完全サポート」と明記)
Gemini 3.8 Flash2026年9月2日(GA)現時点最新・最上位のFlashティア提供中(Gemini API/AI Studio/Antigravity/Gemini Enterprise。Geminiアプリ・AIモードはGoogle AI Pro・Ultra向け)
Gemini 3.8 Flash Cyber2026年9月2日セキュリティ診断特化(3.5 Flash Cyberの後継)一般提供なし(新設のFairwind Programで信頼された防御側にのみ提供)

Proティアは別ラインです。2026年9月6日時点で公式に案内されているのは「Gemini 3.1 Pro」(Gemini APIではプレビュー・モデルIDは gemini-3.1-pro-preview)と「Gemini 3.1 Deep Think」で、上位の「Gemini 3.5 Pro」は一般提供が始まっておらず、Google DeepMindの公式モデルページは「3.5 Pro coming soon(近日提供)」の表示のままです。海外メディアはコーディング性能が社内基準に届いていないことを延期理由として報じています。つまり「Gemini 3.6 Pro」「Gemini 3.7 Pro」という製品名は存在しません。Flashティアのバージョン番号とProティアのバージョン番号は別々に進んでいる点に注意してください。

AI導入を検討する際の全体的な進め方については、AI導入戦略ガイドで6フェーズに分けて解説しています。モデル選定はそのうちの一工程にすぎず、業務設計・運用ルールとセットで考えることが重要です。

料金比較|3.5 Flash-Lite〜3.8 Flashの現在価格

API料金はGemini API公式料金ページ(ai.google.dev/gemini-api/docs/pricing・2026年9月6日確認)とGoogle DeepMindの各モデルカードで確認した数値です(トークン単価はキャッシュなしの標準価格、100万トークンあたり)。

モデル入力出力備考(2026年9月6日時点)
Gemini 3.5 Flash-Lite$0.30$2.50ラインアップ最安。変更なし
Gemini 3.5 Flash(旧世代・参考)$1.50$9.003.6/3.7 Flashが実質的な後継
Gemini 3.6 Flash$0.75(〜2026/12/31)
$1.50(2027/1/1〜)
$3.75(〜2026/12/31)
$7.50(2027/1/1〜)
7月21日発表時は$1.50/$9.00→$7.50だったが、8月13日の3.7 Flash発表後は3.7と同額の期間限定価格に統一
Gemini 3.7 Flash$0.75(〜2026/12/31)
$1.50(2027/1/1〜)
$3.75(〜2026/12/31)
$7.50(2027/1/1〜)
Google公式は「前モデル(3.6 Flash)発表時の半額」と説明
Gemini 3.8 Flash(現行最新)$0.75(〜2026/12/31)
$1.50(2027/1/1〜)
$3.75(〜2026/12/31)
$7.50(2027/1/1〜)
2026年9月2日GA。Google公式は「3.7 Flashと同じ導入価格」と明記
Gemini 3.5 Flash Cyber非公開非公開一般提供なし(政府・パートナー限定)

ここで注意したいのは、3.6 Flashの価格が発表時から変わっていることです。2026年7月21日の発表時点では入力$1.50・出力$9.00→$7.50でしたが、8月13日に3.7 Flashが「前モデルの半額」の導入価格(入力$0.75・出力$3.75、2026年末まで)で登場したのに合わせて、3.6 Flash自体の標準料金も同じ導入価格帯に揃えられています。つまり2026年9月6日時点では、3.6 Flash・3.7 Flash・3.8 Flashがいずれも入力$0.75・出力$3.75(2026年12月31日まで)の同じ単価で使えます。単価が同じなら、あとはベンチマーク性能とトークン消費量の差で選べばよいということになります。

Googleは公式に、3.7 Flashのエージェント運用コストが3.6 Flash比で35%安いという早期利用企業のフィードバックも紹介しています(プロンプトキャッシュのヒット率が8ポイント向上、ツールエラーも減少)。単価が同額でも、実運用でのトークン消費量・リトライ回数が減れば総コストはさらに下がる可能性があります。

円換算では、3.6/3.7/3.8 Flashの出力単価(導入価格)は100万トークンあたり約563円(1ドル=150円換算の目安。2026年9月6日時点の実勢は1ドル=約156円)です。実際の請求額は為替レートとGoogle Cloudの契約条件によって変動するため、正確な金額はGoogle Cloudの請求書またはコンソールで確認してください。

Gemini 3.5 Flash-Lite・3.5 Flash・3.6 Flash・3.7 Flashの入力/出力トークン単価を比較する棒グラフ。3.6 Flashと3.7 Flashが同額であることを示す

仕様・ベンチマーク比較|3.6 Flashから3.7 Flashで何が伸びたか

Gemini 3.7 FlashはGoogle DeepMindの公式モデルカードによれば「Gemini 3.6 Flashをベースに、開発者からのフィードバックとアルゴリズム改善を反映したモデル」と位置づけられています。仕様面ではコンテキストウィンドウ最大100万トークン・最大出力64,000トークン・知識のカットオフ2026年3月と、3.6 Flashからの大きな変更はありません。変わったのは推論の質と効率です。

ベンチマークGemini 3.6 FlashGemini 3.7 Flash
DeepSWE v1.1(コーディング)49.0%65.3%
FrontierCode 1.1 Main34.4%43.6%
WebDev Arena Elo15381588
GDP.pdf(実務タスク評価)22.0%34.0%
AutomationBench17.0%30.4%

参考までに、3.6 Flash自身が前世代(3.5 Flash)からどれだけ伸びたかも並記します(Google公式発表の数値)。

ベンチマークGemini 3.5 FlashGemini 3.6 Flash
DeepSWE37%49%
OSWorld-Verified(Computer Use)78.4%83.0%

Gemini 3.5 Flash-Liteの位置づけは変わっていません。出力速度350トークン/秒を公称し、「エージェント型の検索処理や大量ドキュメント処理向けの高スループットモデル」という立ち位置です。思考の深さを「minimal」「low」「higher」から選べる設定(Configurable Thinking)も引き続き提供されており、レイテンシとコストのバランスを用途ごとに調整できます。

他社モデルとのコンテキストウィンドウやAPI料金を横並びで見たい場合は、主要AIモデルAPI料金 横断比較と主要AIモデル コンテキスト長 横断比較で毎月更新しています。あわせて参照してください。

用途別の選び方|結局どれを使うべきか

単価が3.6 Flash・3.7 Flash・3.8 Flashで並んだ今、実務での選び方はシンプルになりました。以下は公式発表の位置づけをもとに整理した目安です。

用途別にGemini Flashモデルを選ぶフローチャート。コーディング・エージェント用途は3.7 Flash、検索・大量処理は3.5 Flash-Lite、脆弱性診断は3.5 Flash Cyberへ分岐する図

ユースケース推奨モデル理由
長時間のコーディング・自律エージェントGemini 3.8 Flash3.7 Flashと同額のままDeepSWE v1.1など長時間タスクの成績が伸び、HLE-Verifiedは54.9%。Googleは「最も賢いワークホース」と位置づけている
トークン消費を抑えたい日常的なコーディング・ツール実行Gemini 3.7 Flash3.8 Flashは難しいタスクほど推論ステップとツール呼び出しを増やしトークンを多く使うため、効率優先の用途では3.7 Flashを使い続けるようGoogleが案内している
マルチモーダル処理(画像・動画・音声を含む業務)Gemini 3.8 Flash入力モダリティが最も広く、3.6/3.7 Flashからの実質的な上位互換
社内検索・FAQボットの応答生成Gemini 3.5 Flash-Lite単価が最安でレイテンシも短く、検索連携との親和性が高い
大量ドキュメントの分類・要約バッチ処理Gemini 3.5 Flash-Lite350トークン/秒の高速性でスループット重視の処理に向く
チャットボットの一次応答・簡易タスク振り分けGemini 3.5 Flash-Lite(thinking=minimal)思考レベルを最小に設定してコストとレイテンシを抑えられる
ソフトウェアの脆弱性診断・パッチ提案Gemini 3.8 Flash Cyber(旧 3.5 Flash Cyber)専用チューニングだが現状はFairwind Programの信頼された防御側限定で一般利用不可

すでにGemini 3.6 Flashで本番運用しているシステムがある場合、まず検討すべきは「そのままGemini 3.8 Flashに切り替えられないか」です。単価は同額のため、コスト面のリスクは小さいと考えられます。ただし3.8 Flashは難しいタスクほど推論ステップを増やして出力トークンが伸びる設計なので、単価が同じでも請求額が増える可能性があります。モデル固有のプロンプト調整や出力フォーマットの挙動差も含め、本番切り替え前にステージング環境でのA/Bテストは必須です。まだGemini 3.5 Flashを使っている場合は、いきなりGemini 3.8 Flashへ移行することを検討してよいでしょう(3.6/3.7 Flashを経由する理由が単価面ではなくなったため)。

Gemini 3.5 Flash Cyberの特殊な立ち位置

この記事で扱う3.5モデル群の中で唯一、Gemini 3.5 Flash Cyberだけは一般提供されていません。Googleはこのモデルを、自社のセキュリティエージェント「CodeMender」を動かすために使っており、政府機関・信頼できるパートナーへの限定パイロットとしてのみ提供するとしています。8月13日の3.7 Flash発表ではCyberに関する更新はありませんでしたが、2026年9月2日にGoogleは後継の「Gemini 3.8 Flash Cyber」を発表しました。こちらも一般提供はされず、新設の「Fairwind Program」を通じて政府機関・重要インフラ事業者・ソフトウェア保守者といった信頼された防御側にのみ優先提供されます(2026年9月6日時点)。

公式発表によれば、V8 JavaScriptエンジンを対象にした検証で、Gemini 3.5 Flash Cyberは55件のユニークな脆弱性を確認しました。これは同条件でのGemini 3.5 Flash(47件)やClaude Opus 4.6(36件)を上回る結果として紹介されています。CodeMender側では、1つの脆弱性に対して最大5回の並列呼び出しを行い、結果を1つのレポートに統合する運用がされているとのことです。

企業のセキュリティ担当者にとっての実務上のポイントは、「今すぐ自社で使えるモデルではない」という点です。脆弱性診断の自動化を検討している場合、現時点では一般提供されているGemini 3.8 Flashや他のセキュリティ特化ツールとの組み合わせで代替する必要があります。Cyberの一般提供状況は今後変わる可能性があるため、公式発表のウォッチを続けることをおすすめします。

この記事の内容を社内で使うなら

要点と手順をまとめた資料を無料で受け取れます。研修4,000名以上・支援100社以上の実績をもとに、自社の業務に当てはめる相談も30分から受け付けています。

生成AI 料金・プラン早見表 2026年10月版無料で受け取る →AI顧問に相談する(30分・無料)→

【要注意】モデル選定でよくある失敗パターン

失敗1:3.6 Flashで運用を固定し、3.7/3.8 Flashへの切り替えを検討しない

❌ 「7月に3.6 Flashへ移行したばかりだから」と、単価が同額の3.7/3.8 Flashへの検証を後回しにする

⭕ 単価が変わらないなら、まずステージング環境でDeepSWEなど自社に近いタスクでの精度差を実際に検証する

なぜ重要か: モデルの世代交代は数週間サイクルで起きており、単価が同じであれば切り替えコストは検証工数だけです。「切り替えない理由」がなければ検証だけでもしておく価値があります。

失敗2:単価だけを見て「安いから」でFlash-Liteを全業務に使う

❌ コーディング支援やマルチステップの分析タスクにもFlash-Liteを使い、出力の精度不足で結局人手による修正コストが増える

⭕ 精度が求められるタスクは3.8 Flash、スループット重視のタスクはFlash-Liteと使い分ける

なぜ重要か: 単価差は最大5倍近くありますが、精度不足による手戻りコストはそれ以上になり得ます。トークン単価だけでなく「タスクの性質」で選ぶことが重要です。

失敗3:「Gemini 3.6 Pro」のような存在しないモデル名で情報収集してしまう

❌ 検索や社内報告で「3.6 Pro」「3.7 Pro」「3.8 Pro」といった名称を使い、存在しないモデルの情報を探し続ける

⭕ Flashティアのバージョン(3.5〜3.8)とProティアのバージョン(3.1・3.5)は別系統であることを確認したうえで情報収集する

なぜ重要か: モデル名の枝番が増えるほど、社内での情報共有時に誤解が生まれやすくなります。正式なモデルIDは必ず公式ドキュメントで確認する習慣が必要です。

失敗4:Cyberの一般提供を待たずに導入計画を立ててしまう

❌ セキュリティ診断の自動化ロードマップに「Gemini 3.5 Flash Cyber導入」を組み込んでしまう

⭕ 現時点では政府・パートナー限定であることを前提に、一般提供されているモデルでの代替案を先に検討する

なぜ重要か: 限定提供モデルを前提に計画を立てると、提供開始時期が不透明なままプロジェクトが停滞する原因になります。

日本企業が今日からできること

  1. 今日:Gemini 3.6/3.7 Flashを本番利用中なら、Google AI Studioで同じプロンプトをGemini 3.8 Flashに投げて出力品質とトークン数を比較する
  2. 今週中:社内の生成AI利用マップ(どの業務にどのモデルを使っているか)を棚卸しし、Flash-Liteへ切り替えられる低リスクな業務(一次応答・分類・要約)を洗い出す
  3. 今月中:ステージング環境でのA/Bテストを経て、コスト・精度の両面で問題なければ本番のモデルIDを切り替える。あわせて月次のAPI利用コストをGoogle Cloudの請求ダッシュボードで再確認する

正式なAPIモデルID文字列やSDKのパラメータ名は変更される可能性があるため、実装時は必ずGoogle公式のモデルドキュメント(ai.google.dev)で最新のモデルID表記を確認してください。本記事では推測のコード例は掲載していません。

よくある質問

Q. Gemini 3.6 Proという製品はありますか?

A. ありません。2026年9月6日時点でGemini 3系のFlashティアは3.5 Flash-Lite・3.5 Flash・3.6 Flash・3.7 Flash・3.8 Flashの5モデル体制で、「3.6 Pro」「3.7 Pro」「3.8 Pro」という名称のモデルは存在しません。上位のProティアはGemini 3.1 Pro(Gemini APIではプレビュー)・Gemini 3.1 Deep Think、そして一般提供が始まっていないGemini 3.5 Proという別ラインです。

Q. Gemini 3.6 Flash・3.7 Flash・3.8 Flashはどれを使うべきですか?

A. 新規導入なら3.8 Flash(モデルID: gemini-3.8-flash)を推奨します。料金は3つとも同額(2026年12月31日まで入力$0.75・出力$3.75/100万トークン)で、3.8 Flashは長時間のソフトウェア開発・自律エージェント向けに最も伸びています。ただしGoogleは「3.8 Flashは難しいタスクほど推論ステップとツール呼び出しを増やし、トークン消費が増えることがある」「計算効率が最優先なら3.7 Flashを使い続けてよい」とも明記しています(2026年9月2日発表)。既存の3.6/3.7 Flash運用がある場合も、モデルIDの切り替えのみで多くのケースは移行できます。

Q. Gemini 3.5 Proは今回発表されなかったのですか?

A. されていません。2026年9月6日時点でも一般提供は始まっておらず、Google DeepMindの公式モデルページは「近日提供」表示のままです。当初は2026年6月ごろの一般提供が示唆されていましたが、複数の海外メディアはコーディング性能が社内基準に届いていないことを延期理由として報じています。

Q. Gemini 3.5 Flash Cyberは個人開発者でも使えますか?

A. 使えません。政府機関・信頼できるパートナー向けの限定提供のみで、一般公開のAPIやコンソールからは利用できません。2026年9月2日に発表された後継の「Gemini 3.8 Flash Cyber」も、新設のFairwind Programを通じた信頼された防御側への限定提供です。

Q. Gemini 3.5 Flash-Liteは無料枠がありますか?

A. 本記事では有料APIの単価のみ確認しています。無料枠の有無・条件はGoogle AI Studioの公式料金ページで最新情報を確認してください。

Q. Gemini 4はいつ頃提供されますか?

A. Google公式は2026年7月21日、Gemini 4の事前学習を開始したと発表し、7月23日のAlphabet第2四半期決算説明会でもSundar Pichai CEOが「より大規模なベースモデルになる」とコメントしました。2026年9月6日時点でも具体的な提供時期は公表されていません。

まとめ

今回のポイントは、Flashティアの世代交代が2026年7月から9月にかけて一気に進んだということです。Gemini 3.7 Flashは3.6 Flashと同額の料金でDeepSWEなど主要ベンチマークを大きく伸ばし、さらに9月2日にGAとなったGemini 3.8 Flashが同額のまま最上位のワークホースになりました。Gemini 3.5 Flash-Liteは検索連携や大量処理向けの最安モデルとして立ち位置を維持し、Gemini 3.5 Flash Cyberは一般提供されない専門特化モデルとしてCodeMenderを支え続けています。すでにGemini系のAPIを使っている企業は、まず自社のプロンプトをGemini 3.8 Flashで再検証し、精度とコスト(特に出力トークン量)の両面で切り替えメリットがあるか確認することから始めるのが現実的な一歩です。


参考・出典

あわせて読みたい:


著者: 佐藤傑(さとう・すぐる)
株式会社Uravation代表取締役。X(@SuguruKun_ai)フォロワー約10万人。
100社以上の企業向けAI研修・導入支援。著書『AIエージェント仕事術』(SBクリエイティブ)。
SoftBank IT連載7回執筆(NewsPicks最大1,125ピックス)。

ご質問・ご相談は お問い合わせフォーム からお気軽にどうぞ。

この記事の内容を社内展開する方へ: 生成AI 料金・プラン早見表 2026年10月版(無料・PDF 35ページ+Excel) をダウンロードできます。

佐藤傑
この記事を書いた人 佐藤傑

株式会社Uravation 代表取締役CEO/生成AIエバンジェリスト。法人向けAI研修・コンサルティングを手がけ、日経・SBクリエイティブ・GMO等のメディアで生成AIについて執筆。

執筆・監修:佐藤傑/下書き・図版・機械検査:当社のAI社員(人が確認してから公開しています)。記事の作り方と検査の方針

この記事をシェア

Contact お問い合わせ

30分の無料相談では、いま時間を取られている業務を伺い、稼働中のAI社員62体の事例の画面と一緒に近い進め方をお見せします。
売り込みはしません。

Claude Code 個別指導(1対1・12セッション)をご希望の方はこちら、Codex 個別指導はこちらから別途お申し込みください

Claude Code 個別指導 無料相談