📊 API料金を自分の文章で試算:テキストを貼るだけでトークン数とGPT-5.6・Claude・Gemini・Kimi K3のAPI料金を円換算で一括比較できる無料のLLMトークン計算機を公開しています(登録不要)。
結論(2026年9月24日時点): Grok APIの主力モデル grok-4.7 は、プロンプトが20万トークン未満なら100万トークンあたり入力2.00米ドル・キャッシュ済み入力0.50米ドル・出力6.00米ドル。20万トークン以上になると同じリクエスト内の全トークンが入力4.00米ドル・キャッシュ0.50米ドルの倍の1.00米ドル・出力12.00米ドルの長文脈単価に切り替わります(SpaceXAI公式 API Pricing・最終更新2026年9月21日)。そしてAPIに無料枠の記載はありません。Quickstartは「アカウントを作り、クレジットを入れて使い始める」と書かれています(公式Quickstart)。
この記事の要点:
- 料金は「短文脈(20万トークン未満)」と「長文脈(20万トークン以上)」の2段階。境界を1トークン超えると、そのリクエストの全トークンが長文脈単価で請求される
- 請求はトークン代だけではない。Web検索・X検索・コード実行などのツール呼び出し料金が別立てで乗る(Web検索は1,000回あたり5.00米ドル)
- 法人で先に決めるのはデータの扱い。既定では入出力が30日間サーバーに保存され、学習には使われない。より厳しい要件にはZDR(Zero Data Retention)とUSリージョンの選択肢がある
対象読者: Grok APIを業務システムに組み込むか判断したい情報システム部門・開発責任者・DX推進担当
読了後にできること: 自社の想定利用量から月額を式で試算し、データの扱いとレート制限のティアを社内の承認材料として説明できる
「grok api 料金」で検索して最初に困るのは、どのページの数字がいつの版なのかが分からないことです。Grokはモデルの改訂が速く、2026年に入ってからだけでも4.3・4.5・4.6・4.7と世代が進み、その都度「1トークンあたりいくら」の表が書き換わってきました。
この記事は2026年9月24日に docs.x.ai の Pricing・Models・Rate Limits・FAQ Security を取得し、その内容だけで料金表・上限・データの扱いを組み直したものです。公式に書かれていない項目は「2026年9月24日時点で公式に確認できていない」と明記しています。
なお、ドキュメントの表記は2026年9月時点で SpaceXAI(Grok 4.7のモデルページに「Grok 4.7 is SpaceXAI’s frontier model」)に変わっていますが、API・コンソール・SDKの名称は xAI API / console.x.ai / xai-sdk のままです。本記事では会社名をSpaceXAI、APIの名称をxAI APIと書き分けます。
旧版の本記事には grok-4 の単価やオープンソース版のローカル実行手順を載せていましたが、いずれも2026年9月24日時点の公式ドキュメントには存在しないため、現行の表に差し替えました。ローカル実行の話題はGrokをローカルで動かす方法|オープンソース公開の現状に分けてあります。
Grok APIの料金早見表(2026年9月24日時点)
公式の Text API 料金表をそのまま日本語にしたものが下の表です。単位は100万トークンあたりの米ドル。日本円は1米ドル=150円で換算した2026年9月時点の概算で、実際の請求は決済時のレートと為替手数料で変わります。
短文脈(プロンプト20万トークン未満)の単価
| モデル | コンテキスト | 入力 | キャッシュ済み入力 | 出力 |
|---|---|---|---|---|
| grok-4.7 | 500,000 | 2.00米ドル(約300円) | 0.50米ドル(約75円) | 6.00米ドル(約900円) |
| grok-4.6 | 500,000 | 2.00米ドル(約300円) | 0.50米ドル(約75円) | 6.00米ドル(約900円) |
| grok-4.5 | 500,000 | 2.00米ドル(約300円) | 0.30米ドル(約45円) | 6.00米ドル(約900円) |
| grok-4.3 | 1,000,000 | 1.25米ドル(約188円) | 0.20米ドル(約30円) | 2.50米ドル(約375円) |
| grok-4.20-multi-agent-0309 | 1,000,000 | 1.25米ドル(約188円) | 0.20米ドル(約30円) | 2.50米ドル(約375円) |
| grok-4.20-0309-reasoning | 1,000,000 | 1.25米ドル(約188円) | 0.20米ドル(約30円) | 2.50米ドル(約375円) |
| grok-4.20-0309-non-reasoning | 1,000,000 | 1.25米ドル(約188円) | 0.20米ドル(約30円) | 2.50米ドル(約375円) |
| grok-build-0.1 | 256,000 | 1.00米ドル(約150円) | 0.20米ドル(約30円) | 2.00米ドル(約300円) |
長文脈(プロンプト20万トークン以上)の単価
| モデル | 入力 | キャッシュ済み入力 | 出力 |
|---|---|---|---|
| grok-4.7 / grok-4.6 | 4.00米ドル(約600円) | 1.00米ドル(約150円) | 12.00米ドル(約1,800円) |
| grok-4.5 | 4.00米ドル(約600円) | 0.60米ドル(約90円) | 12.00米ドル(約1,800円) |
| grok-4.3 / grok-4.20系 | 2.50米ドル(約375円) | 0.40米ドル(約60円) | 5.00米ドル(約750円) |
| grok-build-0.1 | 2.00米ドル(約300円) | 0.40米ドル(約60円) | 4.00米ドル(約600円) |
ここが見積りで一番間違えやすいところなので、公式の一文をそのまま引きます。「Models with long context pricing bill the long context rates for all tokens in a request once its prompt reaches the model’s long context threshold.」――しきい値に届いた瞬間、そのリクエストの全トークンが長文脈単価になるという意味です(出典: API Pricing)。先頭の19万トークン分だけ安く計算する、という方式ではありません。

単価に掛かる3つの倍率
上の表は基本料金で、使い方によって倍率が掛かります。いずれも公式Pricingに記載があります。
| 条件 | 倍率 | 対象 |
|---|---|---|
| Batch API(非同期・多くは24時間以内に完了) | 20%割引 | grok-4.3・grok-4.20系の4モデルのみ。他モデルは割引なし |
| Priority Processing(低レイテンシ優先) | 2倍 | Chat Completions・Responsesのみ。応答が "service_tier": "priority" を返した時だけ課金 |
USリージョンエンドポイント https://us.api.x.ai/v1 | 1.1倍 | grok-4.7・grok-4.6のみ。画像・動画・音声APIは非対応 |
USリージョンでの grok-4.7 は、公式が具体値まで書いています。短文脈で入力2.20米ドル・キャッシュ0.55米ドル・出力6.60米ドル、長文脈で4.40米ドル・1.10米ドル・13.20米ドル(100万トークンあたり)。プロンプトキャッシュの割引は倍率を掛ける前に適用されます。
もう1つ、Cursor と Grok Build でのみ提供される Grok 4.7 Fast は「同じモデルを速いインフラで動かすもの」で、標準単価の2倍(短文脈で入力4.00米ドル・キャッシュ1.00米ドル・出力12.00米ドル)。公開のxAI APIからは呼べませんし、Grok Buildの無料枠にも含まれません。API前提の見積りにこの単価を混ぜないでください。
ツールの料金:Web検索・X検索・コード実行・ファイル添付
Grok APIの請求は2階建てです。1階がトークン代(入力・推論・出力・画像・キャッシュ)、2階がサーバー側ツールの呼び出し料金。エージェント的に使うほど、モデルが自分でツールを何回呼ぶかを決めるため、2階の比率が上がります。
| ツール | ツール名 | 単価(1,000回あたり) | 日本円の目安 |
|---|---|---|---|
| Web検索 | web_search | 5.00米ドル | 約750円 |
| X検索(投稿) | x_search | 5.00米ドル / 1,000投稿 | 約750円 |
| X検索(プロフィール) | x_search | 10.00米ドル / 1,000プロフィール | 約1,500円 |
| コード実行 | code_execution / code_interpreter | 5.00米ドル | 約750円 |
| ファイル添付の検索 | attachment_search | 10.00米ドル | 約1,500円 |
| コレクション検索(RAG) | collections_search / file_search | 2.50米ドル | 約375円 |
| 画像生成 | image_generation | Imagine APIの単価 | 画像1枚0.002米ドルから |
| 画像・X動画の理解、リモートMCP | view_image / view_x_video ほか | 呼び出し料金なし | 消費トークン分のみ |
出典はいずれも公式Pricingの Tool Invocation Costs(2026年9月21日更新)。日本円は1米ドル=150円換算の概算です。
X検索だけ課金の単位が違うので注意してください。呼び出し回数ではなく取得した件数で課金されます。公式の説明では、検索やスレッド取得で返ってきた投稿は親投稿・引用投稿も含めて全部が投稿数にカウントされ、重複排除もされません(同じ投稿が2回返れば2件)。実際に何件取ったかは、Responses APIのレスポンスの usage.server_side_tool_usage_details にある x_posts_fetched と x_users_fetched で確認できます。
保管・転送・違反時の料金
- ファイル保管: 1GiBあたり1日0.025米ドル(約3.8円)
- コレクション保管: 1GiBあたり1日0.10米ドル(約15円)
- ファイル/コレクションのダウンロード: 1GiBあたり0.20米ドル(約30円)
- 利用ガイドライン違反と判定された場合、生成分は課金される。Responses APIで生成前に検知された分は1リクエストあたり0.05米ドル(約7.5円)

Grok APIに無料枠はあるのか
2026年9月24日時点で、公式ドキュメントにAPIの無料枠(無料トークン枠)の記載はありません。「grok api 無料枠」で検索している方への直答です。根拠を3つ挙げます。
- Quickstart のStep 1は「console.x.ai でアカウントを作り、クレジットを入れてAPIを使い始める」。無料枠から始める導線は書かれていません
- Pricing に無料枠・無料クレジットの節がありません
- 請求ページの既定は「invoiced billing limit が0米ドル」で、前払いクレジットが尽きるとAPIリクエストは自動的に拒否されると明記されています(Manage Billing)
紛らわしいものが3つあるので、切り分けておきます。
| よくある誤解 | 2026年9月24日時点の実際 |
|---|---|
| 「レート制限のTier 0は0米ドルだから無料で使える」 | Tier 0は累計支払額0米ドルの段階を指すレート制限の区分であって、無料で呼べる量ではありません |
| 「Grok Buildに無料枠があるからAPIも無料」 | Pricingに「Grok Buildの無料枠にGrok 4.7 Fastは含まれない」という記述はありますが、その無料枠の回数・期間は公式ドキュメントで確認できません。いずれにせよxAI APIの無料枠ではありません |
| 「grok.comやXアプリで無料で使えている」 | チャット側の無料利用枠であり、console.x.ai で発行するAPIキーの課金とは別勘定です |
第三者のまとめ記事には「サインアップで25米ドル分」「データ共有プログラムで月175米ドル分」といった数字が出回っていますが、2026年9月24日時点の公式ドキュメントでは確認できませんでした。キャンペーンは入れ替わるので、実際に使えるかは console.x.ai の Billing 画面(プロモコード欄があります)で確認してください。本記事では確認できない数字は載せません。
なお、少額から試すこと自体は可能です。自動チャージ(Auto top-up)の最低金額は5.00米ドル(約750円)と公式に書かれているので、検証だけならこの規模から始められます。
使えるモデルと選び方
公式Modelsページに載っているテキストモデルは8つ。加えて画像(Imagine)・動画・音声のモデルが並びます。テキスト系の選び方は、実質「コンテキスト長」と「単価」と「用途」の3軸です。
| モデル | コンテキスト | 短文脈の入力/出力 | 向く用途 |
|---|---|---|---|
| grok-4.7 | 500,000 | 2.00/6.00米ドル | コーディング・エージェント的なツール呼び出し・知識労働。公式が「コードも含め、まずこれ」と推奨 |
| grok-4.6 | 500,000 | 2.00/6.00米ドル | 4.7と同額。バージョン固定で挙動を揃えたい既存システム |
| grok-4.5 | 500,000 | 2.00/6.00米ドル | キャッシュ単価が0.30米ドルと最安。同じ前置きを繰り返す用途 |
| grok-4.3 | 1,000,000 | 1.25/2.50米ドル | 大量処理。出力単価が4.7の半分以下で、Batch API 20%割引の対象 |
| grok-4.20-multi-agent-0309 | 1,000,000 | 1.25/2.50米ドル | 複数エージェント協調。レート制限は他モデルより厳しい |
| grok-4.20-0309-reasoning / non-reasoning | 1,000,000 | 1.25/2.50米ドル | 推論の有無を明示的に選びたい場合 |
| grok-build-0.1 | 256,000 | 1.00/2.00米ドル | 最安。コンテキストは256,000と短め |
grok-4.7の細かい仕様は公式のモデルページに整理されています。コンテキスト500,000トークン、知識のカットオフは2026年5月、モダリティはテキストと画像の入力・テキスト出力、出力トークンの上限なし、推論の強さは low / medium / high(既定)/ xhigh の4段階(出典: Grok 4.7 ドキュメント)。4.6からの変化点や4つの入口はGrok 4.7とは|料金・仕様・使い方と4.6からの変化にまとめています。マルチエージェント構成の詳細はGrok 4.20完全ガイドを参照してください。
モデル名の指定は「エイリアス」か「日付付き」かを決めておく
公式はモデル名の付け方を3種類に分けています。grok-4.7 のような素の名前は最新の安定版、<モデル名>-latest は最新版、<モデル名>-<日付> は特定のリリースに固定される指定です。
法人システムでは「検証済みの挙動が勝手に変わらないこと」が優先されることが多いので、本番は日付付き、検証環境は -latest、という二本立てにしておくと、モデル更新のたびに全部を再検証しなくて済みます。社内標準として最初に決めておくべき項目です。

APIキーの取得から最初のリクエストまで
ここから先は公式Quickstartの手順です。自分で動かしていない環境の話は書かないので、公式に載っている操作だけを順に並べます。
ステップ1:アカウント作成とクレジット投入
console.x.ai でアカウントを作り、Billing の API spend management から前払いクレジットを購入します。既定では invoiced billing limit が0米ドルなので、クレジットが尽きた時点でリクエストは自動的に拒否されます。「気づいたら請求が膨らんでいた」を防ぎたい法人は、この既定のまま運用するのが安全です。月次請求へ切り替えたい場合だけ上限を引き上げます。
銀行振込での購入は処理に2〜3営業日かかり、完了後にクレジットが付与されると公式に明記されています。決裁フローが銀行振込の会社は、検証開始日から逆算してください。
ステップ2:APIキーの発行と環境変数への格納
# APIキーは console.x.ai の API Keys ページで発行する
# コードに直書きせず、環境変数か .env に置く
export XAI_API_KEY="your_api_key"
# プロジェクト直下の .env に書く場合
# XAI_API_KEY=your_api_key
ステップ3:最初のリクエスト(curl)
curl https://api.x.ai/v1/responses
-H "Authorization: Bearer $XAI_API_KEY"
-H "Content-Type: application/json"
-d '{
"model": "grok-4.7",
"input": "Fix this function and explain the bug: function median(a){a.sort();return a[a.length/2]}"
}'
ステップ4:OpenAI SDKから呼ぶ(既存コードの移行)
GrokはOpenAI互換のインターフェースを提供しているので、base_url と api_key を差し替えるだけで既存コードが動きます。以下は公式ドキュメントに載っている例です。
from openai import OpenAI
client = OpenAI(
api_key="",
base_url="https://api.x.ai/v1",
)
response = client.responses.create(
model="grok-4.7",
input="Fix this function and explain the bug: function median(a){a.sort();return a[a.length/2]}",
)
print(response.output_text)
ステップ5:キャッシュのキーを必ず付ける
公式が「強く推奨する」と書いている設定です。Responses APIなら prompt_cache_key、Chat Completionsなら x-grok-conv-id ヘッダーを付けると、同じ会話のリクエストが同じサーバーにルーティングされ、キャッシュヒットが安定します。付けないとキャッシュが冷えたサーバーに当たって入力を満額で払うことが頻繁に起きる、とドキュメントに書かれています(出典: Grok 4.7 ドキュメント「Important details」)。
# 同じ会話のリクエストを同じサーバーへ寄せ、キャッシュを効かせる
response = client.responses.create(
model="grok-4.7",
input="前回の続きをお願いします",
prompt_cache_key="tenant-42-thread-1180", # 会話ごとに一意な文字列
)
# Chat Completions を使う場合はヘッダーで指定する
# -H "x-grok-conv-id: tenant-42-thread-1180"

この記事の内容を社内で使うなら
要点と手順をまとめた資料を無料で受け取れます。研修4,000名以上・支援100社以上の実績をもとに、自社の業務に当てはめる相談も30分から受け付けています。
X検索とWeb検索をAPIから使う
Grokの差別化はここです。ただし呼び出し方が変わっている点に注意してください。以前の search_parameters をリクエストボディに直接入れる書き方ではなく、2026年9月時点ではサーバー側ツールとして tools に指定します。
前提として、公式Modelsページには「Grokは学習データより後の出来事を知らない。リアルタイムのデータを使うにはサーバー側の検索ツール(Web Search / X Search)を有効にすること」と書かれています。ツールを付けずに最新情報を聞くのは設計ミスです。
import os
from openai import OpenAI
client = OpenAI(api_key=os.getenv("XAI_API_KEY"), base_url="https://api.x.ai/v1")
response = client.responses.create(
model="grok-4.7",
input=[{"role": "user", "content": "この製品名について、Xで直近48時間に何が言われているか整理して"}],
tools=[
{
"type": "x_search",
"from_date": "2026-09-22",
"to_date": "2026-09-24",
"allowed_x_handles": ["example_official"], # 最大20件
},
],
)
print(response)
X検索で指定できるパラメータは公式に6つ。allowed_x_handles(対象を特定アカウントに限定・最大20)、excluded_x_handles(除外・最大20)、from_date / to_date(ISO8601の日付で期間指定)、enable_image_understanding(投稿内の画像を解析)、enable_video_understanding(投稿内の動画を解析・X検索のみ)。許可と除外は同じリクエストで併用できません。
Web検索は {"type": "web_search"} で、allowed_domains / excluded_domains(各最大5)、画像理解・画像検索の有効化が指定できます。ドメインを5つに絞れるので、社内で認めた情報源だけを見に行かせる運用ができます。
業務で使う指示文の例
【自社製品の言及モニタリング】
直近48時間のXの投稿から、{製品名}に関する言及を集め、
1) 肯定的な言及 2) 不具合・不満の報告 3) 使い方の質問
の3分類でまとめてください。
各項目に投稿の引用元URLを付け、投稿が見つからなかった分類は
「該当なし」と明記してください。推測で補完しないでください。
【公式情報の更新確認】
allowed_domains で指定した公式サイトのみを対象に、
{製品名}の料金ページが前回確認時({日付})から変わっているかを調べ、
変わっていれば「項目・旧値・新値・出典URL」の表で出してください。
変わっていなければ「変更なし」とだけ答えてください。
出力を社外資料に使うなら、citations で返る出典を必ず確認してください。X上の投稿は真偽が保証されないため、一次情報での裏取りを前提にした運用ルールとセットで導入するのが前提です。
法人で使う前に決めること:データの扱い・保存期間・リージョン
情シスの審査で必ず聞かれる部分です。すべて公式FAQ Securityに記載があります。
既定の扱い:30日保存・学習には使わない
公式の表現は「xAI never trains on your API inputs or outputs without your explicit permission.」――明示的な許可なしにAPIの入出力を学習に使うことはない、です。そのうえで既定ではリクエストとレスポンスが暗号化されて30日間保存され(不正利用の調査目的)、30日後に自動削除されます。
ZDR(Zero Data Retention):入れるなら失うものを先に確認する
より厳しい要件にはZDRがあり、チーム管理者がコンソールから自分で有効化できます(チーム単位。APIキーごとの設定は不可)。有効化するとプロンプトと出力がディスクに書かれず、30日の監査保存も適用されません。
ただし公式は「ほとんどのお客様にはZDRを推奨しません」と明記しています。保存に依存する機能が一式使えなくなるためです。
| ZDRで使えなくなるもの | 影響 |
|---|---|
| APIキー別のリクエストログ | コンソールで中身を後から見返せない。既存のログ設定も解除される |
| ステートフルなResponses API | store_messages・previous_response_id が使えず、会話履歴はクライアント側で保持する必要がある |
| Files API / Collections API | 新規アップロードと file_id 参照が不可。RAG構成は作れない |
| Batch API・Deferred completions | 結果を保存する方式のため利用不可。20%割引も使えない |
| 画像・動画の生成結果の保存 | 画像はbase64のみ、動画は自前の output.upload_url が必須 |
| 音声エージェントの会話履歴 | 保持されない |
有効化の手順も公式に載っています。管理者でサインイン、対象チームの Files と Collections を削除(残っていると有効化がブロックされる)、Team Settings の Zero Data Retention 行で Enable、確認ダイアログでエンタープライズ規約とプライバシーポリシーに同意。有効かどうかは全APIレスポンスに付く x-zero-data-retention ヘッダーで機械的に確認できます。
処理を米国内に閉じたい場合
既定のエンドポイント https://api.x.ai は処理リージョンを保証しません。米国内での処理を求められる場合は https://us.api.x.ai/v1 を使います。対象は grok-4.7 と grok-4.6 のみ、画像生成・動画生成・音声APIは非対応、トークン単価は1.1倍。ファイル・コレクション・サーバー側ツール、および自社からエンドポイントまでの経路は保証の対象外、と公式が明記しています。
日本国内でのデータ処理を保証するリージョンは、2026年9月24日時点の公式ドキュメントに記載がありません。国内保管が要件の案件では、この一点で採否が決まります。
監査・認証・鍵の管理
- SOC 2 Type 2に準拠。NDAを締結した顧客は Trust Center で認証状況とデータガバナンスの最新情報を確認できる
- HIPAAはBAA(事業提携契約)の問い合わせフォームが用意されている
- 監査ログはコンソールのAudit Logで閲覧可能。Event ID・説明・ユーザーで絞り込みでき、期間指定もできる。ZDR有効時も管理操作のログは残る(リクエスト本文は残らない)
- 鍵の管理は環境変数かシークレット管理ツール。チーム内で共有しない。漏えいが疑われる場合はコンソールのAPI Keysから Disable か Delete。xAIはGitHubのSecret Scanningと連携しており、公開リポジトリへの流出を検知すると鍵を無効化してメールで通知する
- 利用規約・データ処理付帯契約(DPA)は Legal Resources、個別条件の相談は Grok for Businessのフォーム

レート制限のティアと上限の上げ方
本番に載せる前に必ず見る項目です。xAI APIのレート制限はRPS(1秒あたりリクエスト数)とTPM(1分あたりトークン数)の2軸で、チームの「ティア」によって変わります。ティアは2026年1月1日以降のAPI累計支払額で自動的に上がり、一度上がると下がりません。
| ティア | 累計支払額のしきい値 | grok-4.7 / 4.6 / 4.5 | grok-4.3 / 4.20系 / build-0.1 |
|---|---|---|---|
| Tier 0(既定) | 0米ドル | 150 RPS / 5,000万 TPM | 37 RPS / 1,000万 TPM |
| Tier 1 | 50米ドル(約7,500円) | 172 RPS / 5,300万 TPM | 50 RPS / 1,500万 TPM |
| Tier 2 | 250米ドル(約37,500円) | 208 RPS / 6,000万 TPM | 75 RPS / 2,500万 TPM |
| Tier 3 | 1,000米ドル(約15万円) | 312 RPS / 7,400万 TPM | 125 RPS / 4,500万 TPM |
| Tier 4 | 5,000米ドル(約75万円) | 500 RPS / 1億 TPM | 208 RPS / 8,500万 TPM |
| Enterprise | 要相談 | 個別対応(sales@x.ai) | |
出典: 公式Rate Limits(日本円は1米ドル=150円換算の概算)。grok-4.20-multi-agent-0309 だけは枠が大きく異なり、Tier 0で9 RPS・250万TPM、Tier 4で56 RPS・2,100万TPMです。マルチエージェントを本番の主力に据える設計は、ここで詰まりやすいので先に確認してください。
TPMにはキャッシュ済みトークンも含めて全部が数えられます(請求は割引されても、流量としてはカウントされる)。推論トークンも同様です。上限を超えると 429 Too Many Requests が返るので、指数バックオフを実装します。以下は公式ドキュメントの例です。
import os, time
from openai import OpenAI, RateLimitError
client = OpenAI(base_url="https://api.x.ai/v1", api_key=os.getenv("XAI_API_KEY"))
def request_with_backoff(messages, max_retries=5):
for attempt in range(max_retries):
try:
return client.chat.completions.create(model="grok-4.7", messages=messages)
except RateLimitError:
time.sleep(2 ** attempt) # 1, 2, 4, 8, 16 秒
raise RateLimitError("Max retries exceeded")
上限を上げる方法は3つ。支払いを積んでティアを上げる(自動)、コンソールから増枠を申請する、Tier 4を超える容量は sales@x.ai に相談する。なおティア制はテキスト・埋め込み・音声モデルが対象で、Imagine API(画像・動画)の増枠は営業窓口の担当だと明記されています。
月額コストの試算(前提と計算式を明記)
以下は試算例であり、実測値ではありません。前提を変えれば結果も変わるので、式ごと社内の見積書に転記して数字を差し替えてください。日本円は1米ドル=150円換算の概算です。
試算例1:社内問い合わせ応答(月5万件)
前提: 1件あたり入力800トークン・出力300トークン、キャッシュなし、ツール未使用。
| 項目 | 計算式 | grok-4.3 | grok-4.7 |
|---|---|---|---|
| 入力トークン | 50,000件 × 800 = 4,000万トークン | 40 × 1.25米ドル = 50.00米ドル | 40 × 2.00米ドル = 80.00米ドル |
| 出力トークン | 50,000件 × 300 = 1,500万トークン | 15 × 2.50米ドル = 37.50米ドル | 15 × 6.00米ドル = 90.00米ドル |
| 月額合計 | — | 87.50米ドル(約13,125円) | 170.00米ドル(約25,500円) |
試算例2:同じ条件でキャッシュを効かせた場合(grok-4.3)
前提: 入力800トークンのうち600トークンが全件共通の前置き(システムプロンプト・社内ルール)で、prompt_cache_key を付けてキャッシュヒットしたとする。
- キャッシュ済み入力: 50,000件 × 600 = 3,000万トークン → 30 × 0.20米ドル = 6.00米ドル
- 通常の入力: 50,000件 × 200 = 1,000万トークン → 10 × 1.25米ドル = 12.50米ドル
- 出力: 変わらず 37.50米ドル
- 月額合計 56.00米ドル(約8,400円) = 試算例1の87.50米ドルから約36%減
さらにBatch APIに載せられる処理(夜間バッチの要約・分類など)なら、grok-4.3は20%割引の対象です。試算例1の87.50米ドルは70.00米ドル(約10,500円)になります。
試算例3:X検索を使った定点観測
前提: 1日1回・月30回実行し、1回あたり40投稿を取得。トークン代は別途。
- 取得投稿数: 30回 × 40件 = 1,200投稿
- ツール料金: 1,200 ÷ 1,000 × 5.00米ドル = 6.00米ドル(約900円)
金額としては小さいのですが、エージェントが自分で検索回数を決める設計にすると、ここが読めなくなります。公式も「エージェントが自律的に何回ツールを呼ぶか決めるので、コストはクエリの複雑さに応じて増える」と書いています。本番投入前に server_side_tool_usage_details を数日分記録して、1リクエストあたりの平均呼び出し回数を掴んでおくのが安全です。
複数モデルを横断して比較したい場合は主要AIモデルAPI料金 横断比較、トークン数の数え方そのものはAIのトークンとは|文字数換算・料金への影響が対応する記事です。
【要注意】Grok API導入の失敗パターン4選
失敗1:20万トークンの境界を意識せずに長文を投げる
❌ 「500,000トークン入るモデルだから、資料を全部まとめて投げよう」
⭕ 20万トークン未満に収まるよう分割するか、超えることを前提に単価を再計算してから設計する
なぜ重要か: しきい値に届くと、そのリクエストの全トークンが長文脈単価になります。grok-4.7で19万トークンのプロンプトなら入力は 0.19 × 2.00 = 約0.38米ドルですが、25万トークンになると 0.25 × 4.00 = 約1.00米ドル。トークン数が約1.3倍なのに、入力の請求は約2.6倍です。
失敗2:キャッシュのキーを付けずに「キャッシュ単価」で見積もる
❌ 稟議書にキャッシュ済み入力0.50米ドルで試算を出したが、実際の請求は2.00米ドルで計算されていた
⭕ prompt_cache_key(Chat Completionsは x-grok-conv-id)を必ず設定し、請求明細のキャッシュ済みトークン数で答え合わせする
なぜ重要か: 公式が「これを設定しないと、キャッシュが冷えたサーバーに当たって入力を満額で払うことが多い」と書いています。キャッシュ前提の試算は、キーの設定とセットでなければ成立しません。
失敗3:ZDRを「とりあえず有効化」してRAGが止まる
❌ セキュリティ要件を満たすため先にZDRを有効化し、後からFiles・Collectionsを使う設計に進めなくなる
⭕ 使う機能を先に決め、ZDRで落ちる機能(Files・Collections・Batch・ステートフルResponses)と突き合わせてから判断する
なぜ重要か: 公式自身が「ほとんどの顧客にはZDRを推奨しない、既定の30日保存のほうが良い選択」と書いています。ZDRの有効化には既存のFiles・Collectionsの削除が必要で、ZDR下で削除された内容は復元できません。順番を間違えると戻れません。
失敗4:APIキーをコードやリポジトリに直書きする
❌ api_key="xai-xxxx" をソースに書いてGitHubにpushする
⭕ 環境変数(os.environ.get("XAI_API_KEY"))かシークレット管理ツールに置き、定期的にローテーションする
なぜ重要か: 鍵はチームに紐づくので、漏えいすると同じチームの請求が第三者に使われます。xAIはGitHubのSecret Scanningと連携しており、検知すると鍵を無効化して通知しますが、pushしてから無効化までの間の利用は止められません。既定の invoiced billing limit を0米ドルのままにしておくと、被害額が前払いクレジットの残高で頭打ちになります。
ChatGPT・Claude・Geminiとどう使い分けるか
「Grokに寄せるべきか」ではなく「どの処理をGrokに回すか」で考えます。2026年9月時点の公式仕様から言える判断軸は3つです。
| 判断軸 | Grok APIを選ぶ根拠 | 他を選ぶほうがよい場合 |
|---|---|---|
| Xの投稿を扱うか | x_search がサーバー側ツールとして提供され、期間・アカウント指定・画像動画の解析まで公式仕様にある | Xを見ないなら、この優位は効かない |
| 大量処理の単価 | grok-4.3は出力2.50米ドルでコンテキスト1,000,000。Batch API 20%割引の対象 | 文章品質・日本語の細部を最優先する工程 |
| データ処理のリージョン | 米国内処理を保証するエンドポイントが公式に用意されている | 日本国内での処理保証が要件の案件(2026年9月24日時点で公式の記載なし) |
モデル横断の数値比較は主要AIモデルAPI料金 横断比較と主要AIモデル コンテキスト長 横断比較を毎月更新しています。AIエージェントの活用基盤について体系的に理解したい方は、AIエージェント導入完全ガイドもあわせてご覧ください。
【追記 2026年9月22日】Grok 4.7 の料金・仕様・使い方を別記事にまとめました
SpaceXAI は 2026年9月21日(米国時間)に Grok 4.7 を公開しました。API 料金は 100 万トークンあたり入力 2 ドル・出力 6 ドルで Grok 4.6 と同額、コンテキストは 500,000 トークンです。単価表・仕様・4 つの入口(API・Grok Build・Cursor・GitHub Copilot)・管理者が先に決めることは別記事にまとめました。 → Grok 4.7とは|料金・仕様・使い方と4.6からの変化【2026年9月】
Uravationならこう判断する
法人のAI導入支援の現場で、Grok APIの採否を聞かれたときに確認している順番です。
- Xの投稿を業務で扱う要件があるか。あるなら、
x_searchが公式ツールとして提供されているGrok APIは有力です。ないなら、Grokを選ぶ理由は単価とコンテキスト長の勝負になり、他社と横並びで比較すべきです - データの国内処理が要件か。要件なら2026年9月24日時点では条件を満たせません。米国内処理でよければUSリージョンエンドポイントが使えます
- RAGやバッチ処理を使うか。使うならZDRは選べません。既定の30日保存で社内の規程を通せるかを、先に法務と詰めます
- まずは grok-4.3 で試す。出力単価が grok-4.7 の半分以下でコンテキストが1,000,000、Batch割引も効くため、精度要件が確定していない検証段階の器として扱いやすい構成です。精度が足りなければ grok-4.7 に上げる、という順序のほうが予算の説明がつきます
- invoiced billing limit は0米ドルのまま始める。前払いクレジットが尽きたら止まる状態にしておけば、想定外の請求が起きません。運用が安定してから月次請求へ切り替えます
社内での合意形成が難しいのは、たいてい技術ではなく「データの扱いをどう説明するか」の部分です。本記事の公式リンクをそのまま稟議の添付にできるよう、出典は全て一次情報に絞っています。
よくある質問
Grok APIの料金はいくらですか?
主力の grok-4.7 で、プロンプトが20万トークン未満なら100万トークンあたり入力2.00米ドル・キャッシュ済み入力0.50米ドル・出力6.00米ドル。20万トークン以上では入力4.00米ドル・キャッシュ1.00米ドル・出力12.00米ドルです。最安は grok-build-0.1 の入力1.00米ドル・出力2.00米ドル(コンテキスト256,000)。日本円は1米ドル=150円換算で、grok-4.7の入力が約300円・出力が約900円の目安です(出典: 公式Pricing・2026年9月21日更新)。
Grok APIは無料で使えますか?
2026年9月24日時点の公式ドキュメントに、APIの無料枠の記載はありません。Quickstartは「アカウントを作り、クレジットを入れて使い始める」と案内しており、前払いクレジットが尽きるとリクエストは自動的に拒否されます。自動チャージの最低金額は5.00米ドル(約750円)なので、小額から試すことはできます。grok.comやXアプリの無料利用枠とは別勘定です。
Grok APIのキーはどこで取得しますか?
console.x.ai でアカウントを作成し、API Keysページで発行します。キーはチームに紐づくため、コンソールで対象チームを選んでいるか確認してください。漏えいが疑われる場合は同じ画面から Disable(一時停止)か Delete(削除)を実行し、新しいキーを発行します。
20万トークンを超えると料金はどうなりますか?
そのリクエストの全トークンが長文脈単価で請求されます。先頭の20万トークンだけ短文脈単価、という段階制ではありません。grok-4.7なら入力が2.00米ドルから4.00米ドル、出力が6.00米ドルから12.00米ドルへ切り替わります(100万トークンあたり)。
Grok APIに送ったデータは学習に使われますか?
公式FAQは「明示的な許可なしにAPIの入出力を学習に使うことはない」としています。既定では不正利用の調査目的で入出力が暗号化されて30日間保存され、その後自動削除されます。保存自体を避けたい場合は、チーム単位でZDR(Zero Data Retention)を有効化できますが、Files・Collections・Batch API・ステートフルResponses APIが使えなくなります。
X(Twitter)のデータはAPIから使えますか?
使えます。ただし2026年9月時点の呼び出し方は、サーバー側ツールとして tools に {"type": "x_search"} を指定する方式です。期間指定(from_date / to_date)、対象アカウントの限定・除外(各最大20)、投稿内の画像・動画の解析が指定できます。料金は取得件数ベースで、1,000投稿あたり5.00米ドル・1,000プロフィールあたり10.00米ドルです。
Grok APIのレート制限はどれくらいですか?
ティア制で、2026年1月1日以降の累計支払額に応じて自動的に上がります。grok-4.7はTier 0(支払額0米ドル)で150 RPS・5,000万TPM、Tier 4(5,000米ドル)で500 RPS・1億TPM。grok-4.20-multi-agent-0309 だけは枠が小さく、Tier 0で9 RPS・250万TPMです。上限を超えると 429 が返るので、指数バックオフを実装してください。
データを日本国内で処理してもらえますか?
2026年9月24日時点の公式ドキュメントに、日本国内での処理を保証するリージョンの記載はありません。米国内処理であれば https://us.api.x.ai/v1 が用意されており、対象は grok-4.7 と grok-4.6、単価は1.1倍です。ファイル・コレクション・サーバー側ツールと通信経路は保証の対象外と明記されています。
Grok APIをオンプレミスで動かせますか?
xAI APIはクラウドサービスであり、2026年9月24日時点の公式ドキュメントにオンプレミス提供の記載はありません。過去に公開されたオープンソース版の現状はGrokをローカルで動かす方法で整理しています。オンプレミスが要件の案件は、個別条件として Grok for Businessのフォームから相談する流れになります。
まとめ:今日から始める3つのアクション
- 今日: 自社の想定利用量(月間件数・1件あたりの入出力トークン)を書き出し、本記事の試算例の式に当てはめて grok-4.3 と grok-4.7 の2案で月額を出す
- 今週: console.x.ai でアカウントを作り、invoiced billing limit を0米ドルのまま最小額のクレジットで検証する。
prompt_cache_keyを付けた場合と付けない場合で、請求明細のキャッシュ済みトークン数を比べる - 今月: データの扱い(既定の30日保存/ZDR/USリージョン)のどれで社内規程を通すかを法務・情シスと決め、モデル名の指定方式(日付固定か
-latestか)を社内標準として文書化する
あわせて読みたい:
AI導入戦略の立て方|中小企業が失敗しない3つの原則
AIエージェント導入完全ガイド|2026年版
参考・出典
- API Pricing | SpaceXAI Docs — 全モデルの単価・ツール料金・Batch・Priority・USリージョン・保管料(最終更新 2026-09-21/参照日: 2026-09-24)
- Grok Models & Pricing | SpaceXAI Docs — モデル一覧・コンテキスト長・エイリアスの規則・知識カットオフ(最終更新 2026-09-21/参照日: 2026-09-24)
- Grok 4.7 | SpaceXAI Docs — 仕様一覧・推論の強さ・キャッシュキーの推奨・Fast変種の提供範囲(最終更新 2026-09-21/参照日: 2026-09-24)
- Rate Limits | SpaceXAI Docs — ティアのしきい値・モデル別RPS/TPM・バックオフの実装例(参照日: 2026-09-24)
- FAQ: Security | SpaceXAI Docs — 学習への不使用・30日保存・ZDRの制約一覧・USリージョン・SOC 2 Type 2・監査ログ(参照日: 2026-09-24)
- X Search | SpaceXAI Docs — ツール指定の書式・6つのパラメータ・取得件数の数え方(参照日: 2026-09-24)
- Quickstart | SpaceXAI Docs — アカウント作成とクレジット投入・最初のリクエスト(参照日: 2026-09-24)
- Manage Billing | SpaceXAI Docs — 前払いクレジット・自動チャージ最低5.00米ドル・invoiced billing limit 既定0米ドル(参照日: 2026-09-24)
著者: 佐藤傑(さとう・すぐる)
株式会社Uravation代表取締役。X(@SuguruKun_ai)フォロワー約10万人。100社以上の企業向けAI研修・導入支援。著書『AIエージェント仕事術』『Claude仕事術』(SBクリエイティブ・シリーズ累計約6万部)。SBクリエイティブ「ビジネス+IT」ほかで生成AI連載を執筆(NewsPicks最大1,125ピックス)。
ご質問・ご相談は お問い合わせフォーム からお気軽にどうぞ。自社の利用量での試算、データの扱いの社内説明、モデル選定の判断基準づくりまで対応しています。
この記事の内容を社内展開する方へ: 経営者のためのAIエージェント活用ガイド(講演完全版Web資料)(無料・Web資料) をダウンロードできます。



