Gemini APIは2026年9月26日時点で無料ティア(クレジットカード登録なし)から使い始められ、有料に上げた場合の主力モデル Gemini 3.8 Flash は100万トークンあたり入力 $0.75・出力 $3.75(2026年12月31日までの導入価格/1ドル150円換算で約113円・約563円)です。2027年1月1日からは入力 $1.50・出力 $7.50(約225円・約1,125円)に上がります。
この記事の要点:
- 無料枠の正体: 「無料ティアのレート上限まで無料」で、モデル別のRPM/TPM/RPDの具体値は2026年9月26日時点の公式レート制限ページには掲載されていません(Google AI Studioの自分の上限画面で確認する仕様)
- 有料化は最低5ドルの前払い: 請求アカウントをリンクし、最低 $5 のクレジットを購入するPrepay方式。残高が0になると同じ請求アカウントに紐づく全プロジェクトのAPIキーが同時に止まり、HTTP 402 が返ります
- 2.5系のコード例をそのままコピペしない: 2026年9月18日にGoogleが「Gemini 2.5系へのアクセスを、過去に実際に使っていた利用者に限定する」と公式アナウンスしました。新規プロジェクトは
gemini-3.5-flash-liteかgemini-3.8-flashを使います
対象読者: Gemini APIの費用を見積もりたい開発者・情シス・部門責任者/これから最初のリクエストを送る人
読了後にできること: 自社の処理量から月額を円で試算し、キーの取得から最初のPython実行まで進められる
最終更新:2026年9月(料金・無料枠・レート制限・データの扱いは、この日に ai.google.dev の公式ページを取得して突き合わせた値です)
Gemini APIの料金を調べていて厄介なのは、「無料で使える」と「月いくらかかる」の間にある情報が抜けていることです。単価表は各社の記事に載っていますが、無料ティアの実際の条件、有料に上げるときの前払い方式、残高が切れたときの挙動、保存されたログの保持期間までを一続きで書いたものはほとんど見つかりません。
もう一つの落とし穴がモデルIDの鮮度です。日本語の解説記事は gemini-2.5-flash のコード例が主流ですが、2026年9月18日の公式アナウンス以降、新しく作ったプロジェクトでは2.5系が使えない可能性があります。コードをコピペして動かない原因の多くがここです。
この記事では、料金早見表(円換算つき)→ 無料枠の正確な条件 → 有料化と課金の仕組み → 5手順のセットアップ → 費用試算3例 → 法人で先に決めること、の順で、すべて2026年9月26日に取得した公式値だけで組み立てます。Pythonコードは公式ドキュメントに掲載されている例をそのまま引用し、どこが公式掲載でどこが本記事の補足かを分けて書きます。
情シス・法務・経営の23項目チェックリストを無料公開中
累計100社以上のAI研修実績から、Fable 5法人導入で詰まりやすい論点を体系化しました。30分無料相談で御社固有の障壁を整理します。
Gemini APIの料金早見表(2026年9月26日時点・100万トークンあたり)
まず結論から使える形にします。下の表は Gemini Developer API pricing(ai.google.dev/gemini-api/docs/pricing・2026年9月26日取得)のStandard(標準)階層の値です。ドル建てが公式の表示で、円は1ドル150円で換算した参考値(税・為替手数料は含みません。Google Cloudの請求は為替レートと課税区分によって変わります)。

| モデルID | 入力($/100万トークン) | 出力($/100万トークン) | 円換算(入力/出力・150円) | 無料ティア | 位置づけ |
|---|---|---|---|---|---|
gemini-3.8-flash | $0.75(2026年12月31日まで) | $3.75(2026年12月31日まで) | 約113円/約563円 | あり | 現行の最上位Flash。2026年9月2日一般提供。2027年1月1日から $1.50/$7.50 |
gemini-3.7-flash | $0.75(同上) | $3.75(同上) | 約113円/約563円 | あり | 日常のコーディングとツール実行向け。2026年8月13日リリース |
gemini-3.6-flash | $0.75(同上) | $3.75(同上) | 約113円/約563円 | あり | 前世代Flash。汎用エージェントと日常タスク |
gemini-3.5-flash | $1.50 | $9.00 | 約225円/約1,350円 | あり | 公式表記は「legacy Flash model」。3.8系より高い |
gemini-3.5-flash-lite | $0.30(テキスト/画像/動画/音声) | $2.50 | 約45円/約375円 | あり | 大量処理・翻訳・単純なデータ処理向け。新規プロジェクトの推奨2択のうち低コスト側 |
gemini-3.1-flash-lite | $0.25(テキスト/画像/動画)・$0.50(音声) | $1.50 | 約38円/約225円 | あり | 最安クラスだが提供終了予定日が2027年5月7日として公表済み。推奨移行先は gemini-3.5-flash-lite |
gemini-3.1-pro-preview | $2.00(プロンプト20万トークン以下) | $12.00(同) | 約300円/約1,800円 | なし | 第3世代Proのプレビュー。無料ティアでは使えない(AI Studio上での試用のみ) |
gemini-2.5-pro | $1.25(20万トークン以下) | $10.00(同) | 約188円/約1,500円 | あり | 2026年9月18日以降、新規プロジェクトからのアクセスを制限 |
gemini-2.5-flash | $0.30(テキスト/画像/動画)・$1.00(音声) | $2.50 | 約45円/約375円 | あり | 同上。既存利用者は継続可(提供終了日は未告知) |
gemini-2.5-flash-lite | $0.10(テキスト/画像/動画)・$0.30(音声) | $0.40 | 約15円/約60円 | あり | 単価は最安だが同じくアクセス制限の対象。新規では選べない前提で設計する |
gemini-embedding-2-preview | テキスト $0.20/画像 $0.45/音声 $6.50/動画 $12.00 | —(埋め込みは入力課金のみ) | テキスト約30円 | あり | テキスト・画像・動画・音声・PDFを同じ空間に埋め込むマルチモーダル埋め込み。RAGの検索側 |
読み方の注意3点:
- 出力単価には思考(thinking)トークンが含まれる: 公式の行名が「Output price (including thinking tokens)」です。推論を深く回すモデルは出力トークンが膨らむため、出力単価の影響が入力より大きく出ます
- 3.8/3.7/3.6 Flashは同一単価: 2026年9月26日時点で3世代とも $0.75/$3.75 です。安さで旧世代を選ぶ理由はなく、精度で選べます
- 2.5系の単価は参考情報: 単価だけ見れば
gemini-2.5-flash-lite($0.10/$0.40)が最安ですが、新規プロジェクトでは使えない可能性があるため、見積りの基準にしないでください
Gemini全体(アプリ・Workspace・API)の料金の並びはGemini 3.6/3.7 Flashの料金と世代比較、Pro系の位置づけはGemini 3.1 Proの無料枠と料金ガイドでそれぞれ扱っています。
サービス階層で単価が変わる:Standard・Batch・Flex・Priority
Gemini APIの料金表で見落としやすいのが、同じモデルに4つのサービス階層があり、それぞれ単価が違う点です。急がない処理をBatchやFlexに寄せるだけで単価が半分になります。
| 階層 | gemini-3.8-flash 入力/出力 | gemini-3.5-flash-lite 入力/出力 | 使いどころ |
|---|---|---|---|
| Standard(標準) | $0.75/$3.75 | $0.30/$2.50 | 対話・API連携など即時応答が必要な処理 |
| Batch(バッチ) | $0.375/$1.875 | $0.15/$1.25 | 非同期の大量処理。標準料金の50%、目標ターンアラウンドは24時間以内 |
| Flex | $0.375/$1.875 | $0.15/$1.25 | 遅延を許容できる推論。Batchと同単価 |
| Priority(優先) | $1.35/$6.75 | $0.54/$4.50 | 混雑時も待たされたくない処理。レート上限は標準の0.3倍が既定 |
数字はいずれも2026年9月26日取得の公式pricingページの値で、3.8 Flashの $0.375/$1.875 は導入価格(2026年12月31日まで)です。2027年1月1日からは $0.75/$3.75 になります。
無料ティアでBatchが使えるかはモデルで違います。公式pricingページの表記では、gemini-3.8-flash/3.7/3.6/3.5-flash のBatch欄が無料ティア「Not available」、gemini-3.5-flash-lite と gemini-3.1-flash-lite は無料ティアでも「Free of charge」です。「無料でバッチ処理を試したい」なら Flash-Lite 系を選びます。
Batch APIそのものの制限(2026年9月26日時点の公式レート制限ページ)は、同時実行バッチ100件・入力ファイル2GBまで・ファイル保存20GBまで。さらにモデルごとに「キューに投入できるトークン数」の上限があり、Tier 1 では gemini-3.8-flash が300万トークン、gemini-3.5-flash-lite が1,000万トークンです。なおBatch APIは2026年9月26日時点で generateContent API のみ対応で、後述するInteractions APIからは使えません。
ツールとエージェントの料金(Google検索・Maps・File search)
モデルの単価とは別に、組み込みツールには独自の料金があります。ここを見ないと「検索グラウンディングを入れたら請求が跳ねた」という事故になります。
| ツール | 無料ティア | 有料ティア |
|---|---|---|
| Google検索グラウンディング | 500 RPD無料(FlashとFlash-Liteで共有・Proは対象外) | Gemini 3系: 月5,000リクエスト無料(全Geminiモデルで共有)、以降 $14/1,000リクエスト/Gemini 2.5系: 1,500 RPD無料、以降 $35/1,000グラウンデッドプロンプト |
| Google Mapsグラウンディング | 500 RPD(Proは対象外) | 1,500 RPD無料(FlashとFlash-Liteで共有)・Proは10,000 RPD無料、以降 $25/1,000グラウンデッドプロンプト |
| コード実行 | 無料 | 選んだモデルの標準トークン単価で課金。生成コードと実行結果は出力トークン、モデルが再利用するときは入力トークン。セッションの稼働時間そのものには課金されない |
| URLコンテキスト | 無料 | モデルの入力トークン単価で課金 |
| File search | 無料 | 埋め込みが $0.15/100万トークン。取得したドキュメントのトークンは通常のモデル単価 |
| Computer use | 利用不可 | 通常のトークン単価(例: 標準の Gemini 3.5 Flash 相当) |
公式の注記で重要なのが「1回のリクエストがGoogle検索への複数クエリになることがあり、個々の検索クエリごとに課金される」という点です。1リクエスト=1課金ではありません。動的検索(dynamic retrieval)を使う場合は、応答にWebのグラウンディングURLが1件以上含まれたリクエストだけが課金対象になります。
エージェント(Gemini Deep Research・Managed agents・Antigravity Agent)は、エージェントループ中の中間的な入力・推論トークンも含めてすべて標準のモデル単価で課金されます。プレビュー期間中は環境コンピュート(CPU・メモリ・サンドボックス実行)は課金されません。Antigravity Agentは2026年9月17日に antigravity-preview-09-2026 へ更新され、旧 antigravity-preview-05-2026 は2026年10月5日にシャットダウン予定です。
Gemini APIとは:課金はトークン単位で発生する
Gemini APIは、GoogleのLLMであるGeminiシリーズをHTTPリクエストで直接呼び出すためのインターフェースです。GeminiアプリのようなチャットUIを経由せず、自社のプロダクトや社内ワークフローにGeminiの推論を組み込めます。前節までの単価表を読むうえで押さえるべき特徴は3つです。
- 課金の単位はトークン: 入力(送ったプロンプト・画像・PDF)と出力(返ってきた文章+思考トークン)のトークン数で決まります。「1リクエストいくら」ではありません。PDFなどDOCUMENTモダリティのトークンは画像トークンのレートで課金されます
- マルチモーダル入力: テキストだけでなく画像・動画・音声・PDFを入力にできます。
gemini-embedding-2-previewを使えば、それらを同じ埋め込み空間に載せた検索もできます - コンテキストは1Mトークン級:
gemini-3.8-flashは1Mトークンのコンテキストと最大出力64kトークン。公式の説明では1Mトークンは「80文字×5万行のコード」「平均的な長さの英語の小説8冊」「平均的な長さのポッドキャスト200回超の書き起こし」に相当します。長い資料を分割せずに投げられる一方、入力トークンがそのまま費用になる点は前節の試算どおりです
組み込みツール(Google検索・Google Maps・コード実行・URLコンテキスト・File search・Computer use)はモデル側から呼び出され、前節の表のとおりモデル単価とは別に課金されます。エージェントとの関係を含む全体像はAIエージェント導入完全ガイドで扱っています。
Gemini APIの無料枠はどこまで無料か
「Gemini APIは無料ですか」に対する2026年9月26日時点の正確な答えは、「無料ティアがあり、そのレート上限までは入力・出力トークンが無料。ただしモデル別の上限値は公式ページに数値として掲載されていない」です。

公式pricingページが無料ティアとして挙げているのは次の4点です。
- 一部モデルへの限定的なアクセス
- 入力・出力トークンが無料
- Google AI Studioへのアクセス
- 送信したコンテンツが製品改善に利用される
一方、有料ティアで追加されるのは「本番向けの高いレート上限」「コンテキストキャッシュの利用」「Batch API(50%オフ)」「最上位モデルへのアクセス」「コンテンツが製品改善に利用されない」の5点です。
レート上限の3軸と、超えたときの挙動
無料枠の実体はレート制限です。公式レート制限ページ(2026年9月26日取得)は3軸を挙げています。
- RPM: 1分あたりのリクエスト数
- TPM: 1分あたりの入力トークン数
- RPD: 1日あたりのリクエスト数
いずれか1つでも超えるとレート制限エラーになります。公式の例では「RPM上限が20なら、TPMに余裕があっても1分に21リクエスト送った時点でエラー」。画像生成モデルにはIPM(1分あたりの画像数)、モデルによってはTPD(1日あたりトークン数)が加わります。
重要な仕様が2つあります。レート制限はAPIキー単位ではなくプロジェクト単位で適用されること、そしてRPDのリセットは太平洋時間の午前0時(日本時間では夏時間期間で午後4時、標準時間期間で午後5時に相当)であることです。「無料枠はいつ回復するのか」の答えはここです。
そしてモデル別のRPM/TPM/RPDの具体値は、2026年9月26日時点の公式レート制限ページには掲載されていません。公式は「Google AI Studioで自分の有効なレート上限を見る」という案内に統一しており、ページにも「明示されたレート上限は保証されず、実際の容量は変動する」と書かれています。他社記事に載っている「1分5リクエスト・25万トークン」といった数字は特定モデル・特定時点のスナップショットなので、見積りの根拠にはAI Studioの自分の画面を使ってください。
支出ベースのレート上限(有料ティアのみ)
有料ティアには、RPM/TPMとは別に10分間のローリングウィンドウで見る支出上限があります。想定外の請求を防ぐ仕組みで、超えると429 RESOURCE_EXHAUSTEDが返ります。
| 使用ティア | 10分あたりの支出上限 | 昇格条件 | 請求ティア上限 |
|---|---|---|---|
| Free | 該当なし | 有効なプロジェクト、または無料トライアル | 該当なし |
| Tier 1 | $10 | 有効な請求アカウントを設定してリンクする | $250 |
| Tier 2 | $50 | 累計 $100 の支払いと、初回支払いから3日の経過 | $2,000 |
| Tier 3 | $200 | 累計 $1,000 の支払いと、初回支払いから30日の経過 | 2万ドル〜10万ドル以上 |
Tier 2・Tier 3の条件は「そのプロジェクトに紐づく請求アカウントでの、Gemini APIに限らないGoogle Cloudサービス全体の累計支出」で判定されます。ティア・レート上限・請求上限はすべて請求アカウント単位で決まります。
無料ティアのデータの扱い(ここが法人の分岐点)
Gemini API 追加利用規約(2026年3月23日発効・2026年9月26日取得)の記載を、無料と有料で並べます。
| 項目 | 無料(Unpaid Services) | 有料(Paid Services) |
|---|---|---|
| プロンプトと応答の利用 | Googleの製品・サービス・機械学習技術の提供・改善・開発に利用される(エンタープライズ向け機能を含む) | 製品改善には利用されない |
| 人によるレビュー | 品質向上のため、人間のレビュアーが入出力を読み・注釈し・処理することがある(Googleアカウント・APIキー・Cloudプロジェクトとの紐付けを外してから) | 規約上の言及なし。禁止用途ポリシー違反の検知・防止と法令対応のため、限定期間ログを保存 |
| 公式の注意書き | 「機密情報・秘密情報・個人情報を無料サービスに送信しないこと」と明記 | データ処理者としてのData Processing Addendumに従って処理 |
| EEA・スイス・英国 | 無料でも有料側の「データの利用」条項が適用される | これらの地域の利用者にアプリを提供する場合は有料サービスのみ利用可 |
つまり無料ティアは「検証用」と割り切るのが安全です。社内文書や顧客データを流す段階になったら、機能の必要性ではなくデータの扱いのために有料ティアへ上げる、という判断になります。
なお利用規約には他にも、18歳以上であること・18歳未満に向けたサービスやアクセスされる可能性の高いサービスには使えないこと・Geminiと競合するモデルの開発に使えないこと・臨床実践や医療アドバイス、医療機器規制の対象となる用途には使えないことが明記されています。提供地域の一覧に日本は含まれています。
この記事の内容を社内で使うなら
要点と手順をまとめた資料を無料で受け取れます。研修4,000名以上・支援100社以上の実績をもとに、自社の業務に当てはめる相談も30分から受け付けています。
有料ティアへの上げ方とPrepay課金の落とし穴
2026年3月23日から、Gemini APIの課金はPrepay(前払い)とPostpay(後払い)の2方式になりました。新規ユーザーの既定はPrepayです。ここは他社記事でほとんど触れられていないのに、運用で一番事故が起きるところです。

有料化の手順
- Google AI StudioのAPIキーページ/プロジェクトページ、または「Set up billing」ボタンから入る(新規ユーザーはプロジェクトとAPIキーが自動作成済み)
- 無料ティアのプロジェクトを選び、Billing Tier列の「Set up billing」をクリック
- 請求アカウントを作成またはリンクし、支払い方法を登録
- 最低 $5(または各通貨の同等額)のクレジットを前払いして完了。アカウントによってはPrepayとPostpayの選択肢が出る
Prepayで必ず知っておくこと5点
- 残高0で全キーが同時停止: 請求アカウントのPrepay残高が $0 になると、そのアカウントに紐づくすべてのプロジェクトのすべてのAPIキーが同時に動かなくなり、リクエストはHTTP 402 Payment Requiredで失敗します。クレジットを足すまで復旧しません
- 未使用クレジットは12か月で失効・返金不可: 例外はPostpayアカウントへ切り替えた場合(残高が元の支払い方法へ返金される)。それ以外の理由でCloud請求アカウントを閉じると残高は失われます
- 購入は最低 $5・最大 $5,000: 「Buy credits」から購入します。プロモーションのCloudクレジットを使うには、先にPrepay残高を入れる必要があり、その後はプロモーション分が先に消費されます
- 約10分の課金パイプライン遅延がある: バッチモードやエージェントのような長時間処理は、システムが停止処理を回すより先に残高を超えて消費することがあると公式に注記されています
- 自動リロードと月次上限を必ず組む: 残高が下がったら自動で補充する「Auto reload」と、1請求サイクル内の自動補充額の合計に上限をかける「Monthly auto-charge limit」があります。前者だけ入れて後者を入れないと、想定外の連続補充が起きます
Prepayは請求書(Invoiced/Offline)アカウントでは使えません。また有料ティアのステータスは動的で、使用ティアはアカウント履歴で決まりますが、Prepay残高がプラスでなければAPIはリクエストを処理しません。AI StudioのProjectsページに「Set up billing」「Set up Prepay」「No credits」のいずれかが表示されている状態は、そのままだと止まる状態です。
APIキー取得からPythonで動かすまでの5手順
最初の関門はAPIキーです。Gemini APIはGoogle AI Studio(aistudio.google.com)から取得でき、新規ユーザーにはプロジェクトとAPIキーが自動で作成されます。以下は公式の「Getting started」および「Using Gemini API keys」(いずれも2026年9月26日取得)の手順とコードです。

手順1: APIキーを取得する
- Google AI StudioのAPI keysページにGoogleアカウントでログインする
- 新規ユーザーは自動作成されたキーをコピーする。新しいキーが必要なら「Create API key」からキーとプロジェクトの組を追加する
- キーは環境変数に入れる(コードに直書きしない)
# 公式ドキュメント掲載の設定例
export GEMINI_API_KEY="YOUR_API_KEY"SDKが自動で読む環境変数は GEMINI_API_KEY と GOOGLE_API_KEY の2つで、両方設定されている場合は GOOGLE_API_KEY が優先されます。意図しないキーが使われる原因になるので、片方に統一してください。
「Create API key」が押せず「You do not have permission to create a key in this project」と出る場合は、Google CloudのIAM権限(resourcemanager.projects.get/apikeys.keys.create/serviceusage.services.enable/iam.serviceAccounts.create/iam.serviceAccountApiKeyBindings.create)が足りていません。管理者にProject Editor相当のロール付与を依頼するか、組織に属さない新しいプロジェクトを作ります。法人環境で最初に詰まるのは、たいていここです。
手順2: キーの種類と制限を確認する
2026年に入ってAPIキーの仕様が変わっています。公式の記載を整理します。
- 標準キーから認可(auth)キーへ移行中: authキーはGoogle Cloudのサービスアカウントに直接バインドされ、そのサービスアカウントのIDでリクエストが処理されます。既定でGenerative Language API(Gemini API)に限定され、漏えい検知時の遮断が速いという説明です
- 2026年5月28日以降、AI Studioで作る新規キーはすべてauthキー
- 制限のない標準キーからのリクエストは拒否される: 明示的な制限を付けた標準キーは動き続けます。AI Studioで「Unrestricted」ラベルのキーに「Restrict to Gemini API only」を適用するのが最短の対処です
- 2026年5月7日以降、長期間使われていない無制限キーはブロックされる: AI Studioに「Blocked」タグが付きます。新しいキーを作るか、制限済みのキーを使います
AI Studio側の上限も押さえておきます。プロジェクトは同時に最大10個まで作成可、APIキーページの表示は最大100キー・プロジェクトは最大50件、表示されるのは「無制限」または「Generative Language APIに限定」したキーだけです。それ以外の制限を持つキーはGoogle Cloudコンソールで管理します。
手順3: SDKをインストールする
# 公式ドキュメント掲載のインストール手順
pip install -U google-genaiパッケージ名は google-genai です。旧 google-generativeai は使いません。Node.jsは npm install @google/genai、ほかにJava・GoのSDKとRESTが公式提供されています。
手順4: 最初のリクエストを送る
2026年9月26日時点の公式クイックスタートはInteractions APIが入口です。以下は公式ドキュメントに掲載されているコードそのままです(筆者が実行した結果ではなく、公式の掲載例です)。
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)RESTで叩く場合の公式例はこちらです。
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H "Content-Type: application/json" -d '{"model": "gemini-3.8-flash", "input": "Explain how AI works in a few words"}'(公式ドキュメントでは行末で改行を継続する書き方で掲載されていますが、ここでは1行にまとめています。)
応答は steps 配列(モデルの思考・ツール呼び出し・最終出力)を含むInteractionリソースで、SDKは interaction.output_text や interaction.output_image という取り出し口を用意しています。
手順5: ストリーミングと複数ターンをつなぐ
逐次表示は stream=True、会話の継続は previous_interaction_id です(いずれも公式掲載例)。
from google import genai
client = genai.Client()
stream = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works",
stream=True
)
for event in stream:
print(event)from google import genai
client = genai.Client()
interaction1 = client.interactions.create(
model="gemini-3.8-flash",
input="I have 2 dogs in my house.",
)
print("Response 1:", interaction1.output_text)
interaction2 = client.interactions.create(
model="gemini-3.8-flash",
input="How many paws are in my house?",
previous_interaction_id=interaction1.id,
)
print("Response 2:", interaction2.output_text)2ターン目でこれまでの履歴を渡していないのがポイントです。会話履歴をサーバー側が保持するため、クライアントで履歴を組み立てる必要がありません。ただしこれは「保存される」ことと同義なので、後述の保持期間の設定とセットで考えてください。
Interactions APIとgenerateContent:どちらで書くか
Gemini APIには2つの入口があります。2026年9月26日時点の公式の位置づけを、そのまま整理します。
| 項目 | Interactions API | generateContent API |
|---|---|---|
| 公式の位置づけ | 2026年6月に一般提供。新規プロジェクトはすべてこちらを推奨。今後の新モデル・新ツール・エージェント機能はこちらに先に載る | 「legacy(旧来)」とされたが引き続き完全にサポートされる |
| 会話状態 | 既定でサーバー側保持(previous_interaction_id)。store=false でステートレスにもできる | ステートレス。クライアントが履歴を持つ |
| レスポンス構造 | steps 配列(思考・ツール呼び出し・出力を型付きで観測できる) | candidates → content → parts を自分で解く |
| 長時間処理 | background=true でバックグラウンド実行 | 非対応 |
| コンテキストキャッシュ | 暗黙キャッシュのみ。明示キャッシュ(キャッシュオブジェクトの手動作成)は非対応 | 暗黙キャッシュと明示キャッシュの両方 |
| Batch API | 非対応(2026年9月26日時点) | 対応 |
判断の目安: 新規で書くならInteractions API。ただし「明示キャッシュで長大なシステムプロンプトを固定したい」「Batch APIで夜間に大量処理を回したい」という要件があるなら、その処理だけ generateContent を残す構成になります。両方が併存する前提で設計しておくのが現実的です。
移行は公式のコーディングエージェント用スキルが用意されていて、npx skills add google-gemini/gemini-skills --skill gemini-api-dev でインストールし、/gemini-api-dev migrate my app to the interactions api と指示するとガイド記載の変更が適用される、と公式移行ガイドに書かれています。
モデルの選び方(2026年9月26日時点の現行ラインナップ)
単価が同じモデルが並ぶので、選び方は「性能」と「提供終了リスク」で決まります。
- 迷ったら
gemini-3.8-flash: 2026年9月2日に一般提供。1Mトークンのコンテキスト、最大出力64kトークン、思考レベル(thinking_level)をlow/medium/highで調整できます。既定はmedium。minimalは指定するとエラーになる点が3.8 Flash固有の注意です。公式の説明では「難しい多段タスクで品質を出すため、小さく刻んで推論しツールを反復して検証する」設計で、そのぶんトークンを多く使います。日常タスクは思考レベルを下げるか、3.7 Flashを使う方が安く済みます - 大量処理・翻訳・単純な抽出は
gemini-3.5-flash-lite: $0.30/$2.50。公式が新規プロジェクトの推奨として3.8 Flashと並べて挙げている2択の片方です - 最安を狙うなら注意つきで
gemini-3.1-flash-lite: $0.25/$1.50ですが、提供終了予定日が2027年5月7日として公表済みです。長く使う実装には向きません - 高度な推論は
gemini-3.1-pro-preview: $2.00/$12.00(20万トークン以下のプロンプト)。無料ティアでは使えません - RAGの検索側は
gemini-embedding-2-preview: テキスト・画像・動画・音声・PDFを同じ埋め込み空間に載せられます。実装の流れはGemini Embedding 2入門で扱っています - 音声・TTSは3.8系が最新: 2026年9月15日に
gemini-3.8-liveとgemini-3.8-live-extended-thinking、9月22日にgemini-3.8-flash-ttsとgemini-3.8-flash-lite-ttsが一般提供になり、音声一覧のエンドポイント(/v1beta/voices)と150種類以上のボイスが公開されています。音声対話の設計はGemini 3.8 Liveの解説を参照してください
2.5系のコードをコピペする前に
2026年9月18日のリリースノートに、次の公式アナウンスが載りました。
出典: Gemini API リリースノート 2026年9月18日(ai.google.dev/gemini-api/docs/changelog・2026年9月26日取得)
「すべての利用者に安定した性能を提供するため、Gemini 2.5系モデルへのアクセスを、過去に実際に使っていた利用者に限定します。これらのモデルは非推奨(deprecated)ではなく、追って通知するまでAPI経由で提供を続けます。新規プロジェクトでは最新モデル、3.5 Flash-Liteまたは3.8 Flashを使ってください。」
つまり2.5系は「まだ使える人」と「もう使えない人」に分かれた状態です。提供終了日は公表されていません(公式の非推奨一覧では gemini-2.5-pro/gemini-2.5-flash/gemini-2.5-flash-lite は「No shutdown date announced」)。これから書くコードのモデルIDは gemini-3.8-flash か gemini-3.5-flash-lite にしておくのが安全です。
費用試算3例(1ドル150円・公式単価で計算)
事例区分: 試算例(実測値ではありません)
前提と計算式を明記した机上の試算です。実際のトークン数はプロンプト設計と日本語の分かち書きで変わるため、必ず自社の代表的なリクエストでusageのトークン数を測ってから稟議に使ってください。単価は2026年9月26日取得の公式pricingページのStandard階層、為替は1ドル150円で計算しています。
例1: 問い合わせ返信の下書きを月10,000件
前提: gemini-3.5-flash-lite/1件あたり入力1,500トークン(FAQ抜粋を含む)・出力400トークン
- 入力: 10,000件 × 1,500トークン = 1,500万トークン → 15 × $0.30 = $4.50
- 出力: 10,000件 × 400トークン = 400万トークン → 4 × $2.50 = $10.00
- 合計: $4.50 + $10.00 = $14.50(約2,175円)
- Batch階層に寄せた場合: $2.25 + $5.00 = $7.25(約1,088円)
例2: PDFの条項抽出を月500件
前提: gemini-3.8-flash/1件あたり入力40,000トークン(30ページ相当)・出力1,200トークン
- 入力: 500件 × 40,000トークン = 2,000万トークン → 20 × $0.75 = $15.00
- 出力: 500件 × 1,200トークン = 60万トークン → 0.6 × $3.75 = $2.25
- 合計: $15.00 + $2.25 = $17.25(約2,588円)
- 2027年1月1日以降の標準価格($1.50/$7.50)に戻ると: $30.00 + $4.50 = $34.50(約5,175円)= ちょうど2倍
公式の注記で押さえておくべき点が1つ。PDFなどDOCUMENTモダリティのトークンは画像トークンのレートで課金され、APIの応答では promptTokensDetails のDOCUMENTモダリティに現れます。テキスト換算で見積もると外れます。
例3: 社内Q&AのRAGを月30,000クエリ
前提: 検索側は gemini-embedding-2-preview(テキスト $0.20)、回答側は gemini-3.5-flash-lite/社内文書の初回インデックスが2,000万トークン・質問の埋め込みが1件30トークン・回答は入力3,000トークン(引用文3本)・出力300トークン
- 初回インデックス: 20 × $0.20 = $4.00(初月のみ)
- 質問の埋め込み: 30,000件 × 30トークン = 90万トークン → 0.9 × $0.20 = $0.18
- 回答の入力: 30,000件 × 3,000トークン = 9,000万トークン → 90 × $0.30 = $27.00
- 回答の出力: 30,000件 × 300トークン = 900万トークン → 9 × $2.50 = $22.50
- 初月合計: $53.68(約8,052円)/2か月目以降: $49.68(約7,452円)
この構成でコストの8割を占めるのは「回答の入力トークン」です。引用文を3本から2本に削るだけで入力が3分の2になり、月額は $18.00 + $22.50 + $0.18 = $40.68(約6,102円)になります。モデルを変える前に、渡すコンテキストの量を削るほうが効きます。
コストを下げる4つの手(Batch・キャッシュ・ルーティング・Flex)
手1: 急がない処理をBatch/Flexへ
標準料金の50%です。目標ターンアラウンドは24時間以内で、多くの場合それより早いと公式に書かれています。投入方法は2つ。合計20MB未満ならリクエストをインラインで並べ、それより大きければJSONL(1行1リクエスト)のファイルを使います。
from google import genai
client = genai.Client()
# 公式ドキュメント掲載のインライン投入例
inline_requests = [
{'contents': [{'parts': [{'text': 'Tell me a one-sentence joke.'}], 'role': 'user'}]},
{'contents': [{'parts': [{'text': 'Why is the sky blue?'}], 'role': 'user'}]}
]
inline_batch_job = client.batches.create(
model="gemini-3.8-flash",
src=inline_requests,
config={'display_name': "inlined-requests-job-1"},
)
print(f"Created batch job: {inline_batch_job.name}")手2: 暗黙キャッシュに当てる
2026年9月26日時点の公式仕様では、暗黙キャッシュ(implicit caching)はGemini 2.5以降で既定で有効で、こちらで何か設定する必要はありません。ヒットすればコスト削減が自動で適用されます。当てるための条件が明確に書かれています。
- 最小入力トークン数:
gemini-3.8-flash/3.7/3.6/3.5-flash/3.1-pro-previewは4,096トークン、gemini-2.5-flash/2.5-proは2,048トークン。これを下回るとキャッシュに載りません - 大きく共通する内容をプロンプトの先頭に置く
- 同じ接頭辞のリクエストを短時間にまとめて送る
- ヒットしたトークン数は応答の
usage.total_cached_tokens(Python/JavaScript)で確認できます
キャッシュ入力の単価は、gemini-3.8-flash で $0.075/100万トークン(2026年12月31日まで/2027年1月1日から $0.15)に加えて、保存料が $0.50/100万トークン・1時間(同じく2027年から $1.00)です。保存料は時間課金なので、置いたまま忘れると無駄が出ます。
手3: モデルのルーティング
すべてのリクエストを上位モデルへ送る必要はありません。単純な分類・整形は gemini-3.5-flash-lite、複雑な推論とツール実行は gemini-3.8-flash に振り分けます。以下は本記事で構成した実装パターンです(公式掲載コードではありません)。
from google import genai
client = genai.Client()
REASONING_HINTS = ("分析", "比較", "推論", "戦略", "コード", "設計")
def route_and_run(prompt: str) -> str:
"""入力の長さと語で使うモデルを切り替える"""
needs_reasoning = any(h in prompt for h in REASONING_HINTS)
if needs_reasoning or len(prompt) > 1200:
model = "gemini-3.8-flash" # 入力 $0.75 / 出力 $3.75
else:
model = "gemini-3.5-flash-lite" # 入力 $0.30 / 出力 $2.50
interaction = client.interactions.create(model=model, input=prompt)
return interaction.output_text手4: 思考レベルを下げる
gemini-3.8-flash は出力トークンに思考トークンが含まれます。定型処理で高い推論が不要なら thinking_level を low にするか、3.7 Flashを使います。公式掲載の指定例はこちらです(minimal は3.8 Flashでは指定できません)。
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
generation_config={
"thinking_level": "medium"
}
)
print(interaction.output_text)実務で使えるプロンプトとコード例5シナリオ
ここからは業務に落とすときのプロンプトです。プロンプト本文はそのままコピーして使えます。API呼び出しは前節までの公式コードに載せ替えてください。
シナリオ1: 問い合わせ返信の下書き
あなたはカスタマーサポートの担当者です。
以下の顧客メッセージに対する返信の下書きを作成してください。
【顧客メッセージ】
{ここに問い合わせ本文}
【参考情報(社内FAQの抜粋)】
{ここにFAQ抜粋}
【出力要件】
- 200字以内、敬語
- 具体的な次の一手を1つ提示する
- 参考情報に書かれていないことは書かない
- 参考情報で答えられない場合は「担当部署に確認します」と書き、確認したい項目を箇条書きにする
- 推測した箇所には行末に(要確認)と付けるシナリオ2: 契約書・PDFの条項抽出
添付の契約書から次の5項目を抽出してください。
1. 契約期間(開始日・終了日・自動更新の有無)
2. 支払条件(金額・支払時期・支払方法)
3. 解約条件(予告期間・違約金)
4. 責任の制限(上限額・除外事項)
5. 準拠法と管轄
【出力形式】
項目名 / 原文の該当箇所の引用 / ページまたは条番号 の3列の表
【ルール】
- 引用は原文をそのまま写す(言い換えない)
- 記載が見つからない項目は「記載なし」と書く
- 解釈が分かれる箇所は「解釈注意」列を追加して理由を1行で書くシナリオ3: 構造化データの抽出(JSON出力)
Interactions APIの構造化出力はPydantic(Python)とZod(JavaScript)に対応しています。以下は公式掲載のスキーマ指定例です。
from google import genai
from pydantic import BaseModel, Field
from typing import List, Optional
class Recipe(BaseModel):
recipe_name: str = Field(description="Name of the recipe.")
ingredients: List[str] = Field(description="List of ingredients.")
prep_time_minutes: Optional[int] = Field(description="Prep time in minutes.")
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Give me a recipe for banana bread",
response_format={
"type": "text",
"mime_type": "application/json",
"schema": Recipe.model_json_schema()
},
)
recipe = Recipe.model_validate_json(interaction.output_text)
print(recipe)問い合わせフォームの振り分けに使う場合のプロンプトはこちらです。
以下のテキストから情報を抽出し、指定したキーのJSONだけを返してください。
【テキスト】
{ここに本文}
【キー】
company_name / contact_person / phone / email / inquiry_type / summary
【ルール】
- inquiry_type は 問い合わせ / クレーム / 見積依頼 / 採用 / その他 のいずれか
- summary は50字以内
- 読み取れない項目は null にする(推測で埋めない)
- 説明文やコードブロックの囲みは出力しないシナリオ4: 社内文書に限定して答えるRAGの回答ルール
以下の社内文書だけを根拠に、質問に回答してください。
【社内文書】
{検索で取得した文書を番号付きで貼る}
【質問】
{ここに質問}
【回答ルール】
- 文書に記載がないことは「文書に記載がありません」と答える
- 回答の各文の末尾に、根拠にした文書番号を[1]の形で付ける
- 文書間で内容が矛盾している場合は、両方を並べて「差異あり」と明記する
- 就業規則・給与・人事評価に関わる判断は、必ず人事部への確認を促す一文を最後に付けるシナリオ5: 自社の関数を呼ばせる(Function Calling)
Interactions APIでの関数宣言は公式掲載の形です。
from google import genai
client = genai.Client()
weather_tool = {
"type": "function",
"name": "get_current_temperature",
"description": "Gets the current temperature for a given location.",
"parameters": {
"type": "object",
"properties": {
"location": {
"type": "string",
"description": "The city name, e.g. San Francisco",
},
},
"required": ["location"],
},
}
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="What is the temperature in London?",
tools=[weather_tool],
)在庫照会・CRM更新・稟議ステータスの取得など、自社システムの参照を挟む処理はこの形になります。モデルは「どの関数をどの引数で呼ぶか」を返すだけで、実行するのは自分のコードです。権限チェックと監査ログは呼び出し側に置きます。
Google AI StudioとGemini Enterprise Agent Platform(旧Vertex AI)の使い分け
Gemini APIの入口は2つあります。2026年9月26日時点で、Google Cloud側のVertex AIはGemini Enterprise Agent Platformの一部として案内されています(改称と移行の経緯はVertex AI名称変更の解説にまとめています)。本記事では通りのよい「Vertex AI」表記も併記します。
| 項目 | Google AI Studio(Gemini Developer API) | Gemini Enterprise Agent Platform(旧Vertex AI) |
|---|---|---|
| 認証 | APIキー(authキー=サービスアカウントにバインド) | IAM認証(Google Cloudプロジェクト必須) |
| 無料ティア | あり(クレジットカード登録なしで開始) | Google Cloudの無料枠に準じる |
| データの扱い | 無料ティアは製品改善に利用される/有料ティアは利用されない | Google Cloudのデータ処理条項に従う |
| 料金 | 本記事の表(ai.google.dev のpricing) | ai.google.dev と価格が異なる場合があると公式pricingページに明記。Agent Platform側の料金ページを見る |
| SDK | google-genai に一本化(旧 vertexai.generative_models は2026年6月24日以降のリリースに含まれない) | |
| 向くフェーズ | 検証・小規模サービス・社内ツール | 個人情報を扱う本番・VPC分離や監査ログが要件の環境 |
実務的な流れは「AI Studioで検証 → データの扱いと監査要件が確定したらAgent Platform側へ」です。SDKが共通なので、切り替えは認証設定とエンドポイント指定が中心になります。ただし料金が同一とは限らないので、本番の見積りはAgent Platform側の料金ページで取り直してください。
他社APIとの比較(2026年9月26日に公式取得した単価)
「どのAPIを使えばいい?」は目的次第ですが、判断に効く違いを公式値で並べます。単価はいずれも100万トークンあたり、2026年9月26日に各社の公式ページを取得した値です。
| 比較軸 | Gemini API | OpenAI API | Claude API |
|---|---|---|---|
| 低コスト帯の単価(入力/出力) | gemini-3.5-flash-lite $0.30/$2.50 | gpt-6-luna $0.10/$0.50(短コンテキスト) | Claude Haiku 4.5 $1/$5 |
| 中位モデルの単価(入力/出力) | gemini-3.8-flash $0.75/$3.75(導入価格) | gpt-6-sol $2.00/$10.00(短コンテキスト) | Claude Sonnet 5 $2/$10 |
| 無料ティア | あり(クレジットカード登録なしで開始) | 2026年9月26日に取得した公式料金ページに無料ティアの記載なし | 2026年9月26日に取得した公式モデル一覧ページに無料ティアの記載なし |
| 最大コンテキスト | 1Mトークン(3.8 Flash・最大出力64k) | 短/長コンテキストで単価が2倍に分かれる料金体系 | 1Mトークン(Fable 5.1/Opus 5.5/Sonnet 5)、Haiku 4.5は200K |
| マルチモーダル入力 | テキスト・画像・動画・音声・PDF(PDFは画像トークンのレートで課金) | テキスト・画像・音声(料金表に文字起こしモデルと画像Web検索の行がある) | テキスト・画像(公式モデル一覧はvision/image inputを記載) |
| Web検索の併用コスト | Google検索・Google Mapsがネイティブ統合。Gemini 3系は月5,000リクエスト無料、以降 $14/1,000リクエスト | Web検索ツールは$10.00/1,000コール(全モデル)。加えて検索コンテンツのトークンがモデル単価で課金 | 公式モデル一覧ページにはツール単価の記載がないため、別ページで要確認 |
| 大量処理の割引 | Batch/Flexで標準の50%(3.8 Flashなら $0.375/$1.875) | BatchとFlexで標準の50%(gpt-6-luna なら $0.05/$0.25) | Message Batches APIあり(単価は別ページ) |
使い分けの目安:
- まず無料で検証したい → Gemini API(3社のうち公式に無料ティアが用意されているのはGeminiだけ)
- PDFや動画・音声をそのまま投げたい → Gemini API(対応モダリティが最も広い)
- 最新情報の裏取りをモデル側にやらせたい → Gemini API(Google検索の月5,000リクエスト無料枠)
- 1トークンあたりの絶対単価を最優先 → OpenAIの
gpt-6-lunaが短コンテキストで最安。ただし長コンテキストでは単価が2倍になる体系なので、入力量で逆転します - 既存のOpenAI向けコードを最小変更で寄せたい → GeminiはOpenAI互換エンドポイントも提供しています
複数APIを併用する場合の全体設計はChatGPTビジネス活用完全ガイド、エージェント構成との関係はAIエージェント導入完全ガイドで扱っています。
法人でGemini APIを使う前に決める5点
技術検証が通ってから止まるのは、たいてい以下の5つが決まっていないケースです。導入前にこの5つを文書化しておくと、情シスと法務のレビューが一度で通ります。

1. 無料ティアで何を流し、どこから有料に切り替えるか
無料ティアは送信内容が製品改善に利用され、人間のレビュアーが読む可能性があると公式に書かれています。「機密情報・秘密情報・個人情報を無料サービスに送信しないこと」という注意書きもそのまま載っています。ダミーデータは無料ティア、実データは有料ティアという線引きを先に引いてください。EEA・スイス・英国の利用者にアプリを提供する場合は、規約上そもそも有料サービスしか使えません。
2. 会話ログの保存と保持期間
Interactions APIは既定でリクエストを保存します(store=true)。公式の保持期間は次のとおりです。
- 有料ティア: 55日
- 無料ティア: 1日
store=falseにすると保存されない。ただしバックグラウンド実行と併用できず、previous_interaction_idによる会話継続も使えなくなる- 有料ティアのプロジェクトは、AI Studioで保持期間を7日・14日・28日・55日から選び、期間経過後に自動削除させられる(短くすると過去の会話の取得に影響する)
- 個別の削除はdeleteメソッドでinteraction IDを指定。AI StudioのLogsページからも閲覧・削除できる
社内規程で「対話ログの保持は30日以内」と決めている会社なら、28日を選ぶのが合致します。この設定を知らずに既定のまま動かすと、55日分のログが自社の管理外に積み上がります。
3. APIキーの種類・制限・棚卸し
2026年5月28日以降の新規キーはすべてauthキーで、Google Cloudのサービスアカウントにバインドされます。制限のない標準キーはリクエストが拒否され、2026年5月7日以降は長期間使われていない無制限キーがブロックされます。決めるべきは次の3点です。
- キーを誰が発行するか(プロジェクトは同時に最大10個まで)
- どの制限を付けるか(AI Studioの「Restrict to Gemini API only」か、Cloud ConsoleでのIP制限)
- 漏えい時の手順: 新キー作成 → アプリを新キーで更新 → 新キーの稼働を確認してから旧キーを無効化・削除 → Cloud Consoleで請求ログとAPI使用状況を監査
クライアントサイド(Web・モバイルアプリ)にキーを埋め込まないことも公式に明記されています。必要ならバックエンドのプロキシを置きます。本番のキーはGoogle Cloud Secret Managerのようなシークレットストアに置くのが公式の推奨です。
4. 予算の止め方を3段で組む
Prepayは残高が0になると全キーが止まるため、止め方と補充の両方を決めておきます。
- 自動リロード+月次オートチャージ上限: 補充が止まらない事故を防ぐ。手動の1回払いはこの上限にカウントされない
- Google Cloudの請求アラート: 公式が推奨しているのはこれ。使用量や費用が跳ねたら通知する
- 支出ベースのレート上限を把握: Tier 1は10分あたり $10、Tier 2は $50、Tier 3は $200。想定外の暴走はここで429になる
5. 使う入口(AI Studio/Agent Platform)と地域・年齢の条件
個人情報を扱う本番はGemini Enterprise Agent Platform(旧Vertex AI)側、社内ツールや検証はAI Studio側という切り分けが基本です。あわせて、利用規約の条件(18歳以上・18歳未満に向けたサービスへの利用不可・医療行為や医療アドバイスへの利用不可・提供地域内での利用)を社内の利用ガイドラインに転記しておきます。AI導入全体の判断軸はAI導入戦略ガイドで扱っています。
【要注意】Gemini API実装でよくある失敗パターン5選
失敗1: 2.5系のコード例をそのまま新規プロジェクトで使う
❌ よくある間違い
# 日本語の解説記事に多い書き方(2026年9月18日以降は新規プロジェクトで動かない可能性)
interaction = client.interactions.create(
model="gemini-2.5-flash",
input="..."
)⭕ 正しいアプローチ
# 新規プロジェクトの公式推奨は次の2つ
model = "gemini-3.8-flash" # 最上位Flash・1Mコンテキスト・出力64k
# model = "gemini-3.5-flash-lite" # 大量処理・低コストなぜ重要か: 2026年9月18日の公式リリースノートで「2.5系へのアクセスを過去の利用者に限定する」とアナウンスされました。非推奨ではないため終了日の記載はありませんが、新しく作ったプロジェクトでモデルが見つからないという症状が出ます。記事のコピペで最初に詰まるのはここです。
失敗2: APIキーをコードに直書き/制限なしのまま放置
❌ よくある間違い
# 絶対にやってはいけない
client = genai.Client(api_key="AIzaSy...実際のキー...")⭕ 正しいアプローチ
import os
from google import genai
# 環境変数から読む(SDKは GEMINI_API_KEY / GOOGLE_API_KEY を自動検出)
client = genai.Client(api_key=os.environ.get("GEMINI_API_KEY"))なぜ危険か: Gitに入れたキーは自動収集の対象になります。公式は「APIキーはパスワードと同じように扱う」「ソース管理に入れない」「クライアントサイドに露出させない」と明記しています。加えて2026年からは、制限のない標準キーはそもそもリクエストが拒否される仕様です。AI Studioで「Unrestricted」ラベルが付いているキーは、先に「Restrict to Gemini API only」を適用してください。
失敗3: Prepay残高を監視せず全キーを止める
❌ よくある間違い: 自動リロードを設定せず、残高が0になって本番が止まる。復旧まで全プロジェクトのキーが動かない
⭕ 正しいアプローチ: 自動リロードと月次オートチャージ上限を組み、Google Cloudの請求アラートを設定する。402 Payment Requiredが返ったら残高不足を疑う
なぜ重要か: Prepayの残高が0になると、その請求アカウントに紐づくすべてのプロジェクトのすべてのAPIキーが同時に停止します。1つのプロジェクトの使いすぎが他のサービスを巻き込みます。プロジェクトを請求アカウント単位で分けるかどうかは、この挙動を前提に決めてください。
失敗4: レート制限の値を記事から引いて設計する
❌ よくある間違い
# 記事で見た「1分5リクエスト」を前提に sleep を決め打ちする
for item in items:
call_api(item)
time.sleep(12)⭕ 正しいアプローチ
import time
from tenacity import retry, wait_exponential, stop_after_attempt
@retry(wait=wait_exponential(multiplier=1, min=4, max=10),
stop=stop_after_attempt(5))
def call_with_retry(client, model, text):
"""429(RESOURCE_EXHAUSTED)を指数バックオフで吸収する"""
return client.interactions.create(model=model, input=text)なぜ重要か: モデル別のレート上限は2026年9月26日時点の公式ページに数値として掲載されておらず、「AI Studioで自分の上限を見る」案内になっています。公式にも「明示されたレート上限は保証されない」と書かれています。固定のsleepで設計せず、429を受けてバックオフする実装にしてください。大量処理はBatchへ寄せるのが本筋です。
失敗5: 検索グラウンディングを入れたまま本番に出す
❌ よくある間違い: すべてのリクエストでGoogle検索ツールを有効にしたまま公開する
⭕ 正しいアプローチ: 最新情報が必要なリクエストだけツールを付ける。検索の呼び出し回数を計測する
なぜ重要か: Gemini 3系の検索グラウンディングは月5,000リクエストまで無料(全Geminiモデルで共有)で、超えると $14/1,000リクエストです。さらに公式注記のとおり1回のリクエストがGoogle検索への複数クエリになることがあり、クエリごとに課金されます。「1リクエスト=1課金」で見積もると足りません。
Gemini APIとPython入門記事の使い分け
本記事は料金・無料枠・課金の仕組み・法人の設定を中心に置いています。Pythonの環境構築から順を追って手を動かしたい場合はGemini API Python入門|料金プラン比較と実装例5選が入口として向いています。逆に「月いくらになるか」「無料枠で何が制限されるか」「情シスに何を説明するか」を先に固めたい場合は本記事を使ってください。
よくある質問
Gemini APIは無料ですか?完全無料で使えますか?
無料ティアがあり、そのレート上限までは入力・出力トークンが無料です(クレジットカード登録も不要)。ただし「完全無料」ではありません。無料ティアでは送信したコンテンツがGoogleの製品改善に利用され、人間のレビュアーが読む可能性があると公式に明記されています。また高いレート上限・コンテキストキャッシュ・Batch API・最上位モデルは有料ティアの機能です。2026年9月26日時点の公式pricingページに基づきます。
Gemini APIの無料枠を超えたらどうなりますか?
レート制限エラー(HTTPステータス429・RESOURCE_EXHAUSTED)が返り、リクエストが失敗します。無料ティアは自動的に課金に切り替わることはありません。超過の判定はRPM(1分あたりリクエスト数)・TPM(1分あたり入力トークン数)・RPD(1日あたりリクエスト数)の3軸で、いずれか1つを超えた時点でエラーになります。
無料枠はいつ回復しますか?
RPD(1日あたりのリクエスト数)のクォータは太平洋時間の午前0時にリセットされます。RPMとTPMは分単位のウィンドウなので、1分待てば再試行できます。レート制限はAPIキー単位ではなくプロジェクト単位で適用されるため、同じプロジェクトでキーを増やしても枠は増えません。
無料枠の具体的な回数・トークン数はどこで確認できますか?
2026年9月26日時点の公式レート制限ページには、モデル別のRPM/TPM/RPDの数値は掲載されていません。公式は「Google AI Studioで自分の有効なレート上限を見る」という案内に統一しており、ページにも「明示されたレート上限は保証されず、実際の容量は変動する」と書かれています。AI StudioのDashboard内の該当画面で自分のプロジェクトの値を確認してください。
APIキーは無料で取得できますか?「AIzaSy」で始まるのは何ですか?
APIキーの取得自体は無料で、Google AI Studioから発行できます。新規ユーザーにはプロジェクトとAPIキーが自動作成されます。AIzaSy で始まる文字列はGoogleのAPIキーの一般的な形式で、キーそのものです。公開リポジトリやフロントエンドのコードに AIzaSy で始まる文字列が入っていたら、それは漏えいしているキーです。新しいキーを作り、アプリを更新し、新キーの稼働を確認してから旧キーを無効化してください。
料金の確認方法と上限設定はどうしますか?
使用量はGoogle AI StudioのDashboard内のUsageで確認します。上限の掛け方は3段です。①Prepayの自動リロードに「Monthly auto-charge limit」(1請求サイクル内の自動補充額の上限)を設定する ②Google Cloudの請求アラートを設定する ③使用ティア別の支出レート上限(10分あたりTier 1 $10/Tier 2 $50/Tier 3 $200)を把握しておく。加えて請求ティア上限(Tier 1 $250/Tier 2 $2,000/Tier 3は2万ドル〜10万ドル以上)が請求アカウント単位でかかります。
日本から使えますか?日本円で支払えますか?
公式の提供地域一覧に日本は含まれています。料金の表示はドル建てで、支払いはGoogle CloudのCloud Billingが扱います。前払いクレジットの購入は「最低 $5(または各通貨の同等額)」と公式に書かれているため、円建てでの決済は可能です。本記事の円換算(1ドル150円)は参考値で、実際の請求額は為替レートと課税区分で変わります。
Gemini 2.5 Flashはまだ使えますか?
2026年9月18日以降、過去に実際に使っていた利用者に限定されています。非推奨(deprecated)ではなく、追って通知があるまでAPI経由での提供は続くとされ、公式の非推奨一覧でも gemini-2.5-pro/gemini-2.5-flash/gemini-2.5-flash-lite は「提供終了日は未告知」です。ただし新しく作ったプロジェクトでは使えない可能性があるため、新規実装は gemini-3.8-flash か gemini-3.5-flash-lite を前提にしてください。
Gemini Enterprise Agent Platform(旧Vertex AI)でも料金は同じですか?
同じとは限りません。公式pricingページに「Gemini Enterprise Agent Platformで提供される価格とここに記載の価格は異なる場合がある」と明記されており、Agent Platform側の料金ページを見るよう案内されています。本番の見積りは移行先の料金ページで取り直してください。SDKは google-genai に一本化されているため、コードの大部分は共通です。
Gemini API(従量課金)とGeminiアプリの有料プランは別料金ですか?
別です。Gemini APIはトークン量に応じた従量課金で、Cloud Billingを通して請求されます。GeminiアプリやGoogle Workspaceの有料プランは月額のサブスクリプションで、APIの利用枠は含まれません。APIを使うには、アプリのプランとは別にAPIキーと(有料化する場合は)請求アカウントが必要です。
まとめ:今日から始める3つのアクション
今日やること: Google AI Studioでキーを取得し、本記事の手順4のコード(gemini-3.8-flash)を1本動かす。あわせてAI Studioで自分のプロジェクトのレート上限を開き、「無料枠」の実際の数字を自分の目で確認する。
今週やること: 自社の代表的なリクエスト1種類を10件流し、usage の入力・出力トークン数を実測する。その実測値を本記事の費用試算3例の計算式に当てて、月額を円で出す。
今月やること: 有料ティアへ上げる場合は、自動リロードの月次上限・請求アラート・Interactions APIの保持期間(7/14/28/55日)・キーの制限を4点セットで設定する。無料ティアに実データを流さない線引きを、社内の利用ガイドラインに1行で書く。
あわせて読みたい:
- Gemini API Python入門|料金プラン比較と実装例5選 — 手を動かして覚えたい人向けの入口
- Gemini 3.6/3.7 Flashとは|料金・世代比較 — Flash系の世代の違い
- Vertex AI名称変更|Gemini Enterpriseへ改名と移行 — 本番側の入口の現状
- Claude Fable 5 法人向けプラン解説 — 法人でのAI API活用
参考・出典
- Gemini Developer API pricing — Google AI for Developers(参照日: 2026-09-26)
- Models — Google AI for Developers(参照日: 2026-09-26)
- Rate limits — Google AI for Developers(参照日: 2026-09-26)
- Billing — Google AI for Developers(参照日: 2026-09-26)
- Getting started — Google AI for Developers(参照日: 2026-09-26)
- Using Gemini API keys — Google AI for Developers(参照日: 2026-09-26)
- Interactions API — Google AI for Developers(参照日: 2026-09-26)
- Migrating to the Interactions API — Google AI for Developers(参照日: 2026-09-26)
- Context caching — Google AI for Developers(参照日: 2026-09-26)
- Batch API — Google AI for Developers(参照日: 2026-09-26)
- What’s new in Gemini 3.8 Flash — Google AI for Developers(参照日: 2026-09-26)
- Gemini deprecations — Google AI for Developers(参照日: 2026-09-26)
- Release notes — Google AI for Developers(参照日: 2026-09-26)
- Available regions for Google AI Studio and Gemini API — Google AI for Developers(参照日: 2026-09-26)
- Gemini API Additional Terms of Service(2026年3月23日発効)— Google AI for Developers(参照日: 2026-09-26)
- Pricing — OpenAI(参照日: 2026-09-26)
- Models overview — Anthropic(参照日: 2026-09-26)
著者: 佐藤傑(さとう・すぐる)
株式会社Uravation代表取締役。X(@SuguruKun_ai)フォロワー約10万人。
100社以上の企業向けAI研修・導入支援。著書『AIエージェント仕事術』『Claude仕事術』(SBクリエイティブ・シリーズ累計約6万部)。
SBクリエイティブ「ビジネス+IT」ほかで生成AI連載を執筆(NewsPicks最大1,125ピックス)。
ご質問・ご相談は お問い合わせフォーム からお気軽にどうぞ。
この記事の内容を社内展開する方へ: 生成AI 料金・プラン早見表 2026年10月版(無料・PDF 35ページ+Excel) をダウンロードできます。



