💡 自分のプランでOpus 5が使えるかを知りたい方は Claude Opus 5 プラン別可否一覧 へ。本記事は料金・APIコストの解説です。
【2026年10月2日更新】2026年9月22日にClaude Opus 5.5が公開され、Opusの現行版のAPI単価は入力$4・出力$20(百万トークンあたり)に下がりました。この記事の料金表・日本円換算・損益分岐・月額シミュレーションは、Opus 5.5の単価で計算し直しています(円換算は1ドル=150円の概算)。旧世代のOpus 5(入力$5・出力$25)はAPIで提供が続いており、公式の廃止予定表では退役は「2027年7月24日より前には行わない(Not sooner than July 24, 2027)」とされています。
【2026年9月7日更新】Sonnet 5の値上げ予定($3/$15)の撤回を反映しました(公式料金ページの記載による)。この時点の円換算は、1ドル=155.68円(2026年9月4日の三菱UFJ銀行公表TTM)でした。
結論: Claude Opusの現行版はOpus 5.5で、API料金は「入力$4・出力$20(百万トークンあたり)」。旧世代のOpus 5(入力$5・出力$25)より2割安い(2026年10月2日時点の公式料金表)。ただし実際の請求額は、プロンプトキャッシュ・バッチAPI・effort(推論の深さ)の使い方次第で数倍変わる。日本円換算・他モデル比較・損益分岐の考え方まで、公式データだけで数字を解体する。
この記事の要点
- 公式APIレート表: 入力$4/MTok・出力$20/MTok。円換算で入力約600円・出力約3,000円(1ドル=150円の概算レートで換算)
- プロンプトキャッシュの読み込みは、Opus 5.5では通常入力の1/20の価格($0.20/MTok)。バッチAPIは入出力とも50%割引。本記事の月額シミュレーションでは、組み合わせで約20〜34%の削減になった
- Claude.aiでは、Opusは無料プランでは使えず、Pro・Max・Team・Enterpriseで使える(claude.com/pricingの比較表・2026年10月2日時点)。Claude Codeでは、これらの有料プランの既定モデルがOpus 5.5
対象読者: Claude APIでOpus 5.5の業務導入・コスト管理を検討している開発責任者、情報システム部門、AI活用の予算策定担当者
読了後にできること: 自社の月間トークン使用量を見積もり、本記事の日本円換算表・損益分岐表と照合して、API従量課金かClaude.aiサブスクかを判断できる
「Opusにしたら、結局いくらになるんですか?」
AI顧問先や研修先のエンジニアチームから、こういう質問を受ける機会が最近増えました。新しいモデルが出るたびに単価が話題になりますが、経営側やIT予算の担当者が本当に知りたいのは単価そのものではなく、「自社の使い方だと月にいくら請求が来るのか」という話です。
2026年9月22日に公開されたClaude Opus 5.5は、公式発表で「入力$4・出力$20(百万トークンあたり)で、Opus 5より20%安い」とされています。ただし実務でのコストは、プロンプトキャッシュを使うか、バッチAPIを使うか、effort(推論の深さ)をどう設定するかで大きく変わります。同じ作業量でも、設定次第で請求額が2倍近く違ってくることは珍しくありません。
姉妹記事のClaude Opus 5登場|料金据え置きで最高性能にではモデル全体の位置づけやベンチマーク、法人導入の実務観点を扱いました。この記事はそこから料金の話だけを切り出し、公式ドキュメントの数字だけを使って徹底的に解体します。
この記事でわかること: 公式APIレート表の全項目、日本円換算表、Fable 5.1・Sonnet 5.5・Haiku 4.5・旧Opus 5との1枚比較表、プロンプトキャッシュとバッチAPIの節約効果、Claude.aiサブスクとの損益分岐の考え方、月額シミュレーション3パターン、そして今日から使える社内向けコピペプロンプトです。
【追記 2026年9月23日】Opus 5.5 の料金は入力 $4/出力 $20(Opus 5 比 20% 減)
2026年9月22日公開の Claude Opus 5.5 は Opus 5 より単価が下がり、キャッシュ読み取りは $0.20(60% 減)です。日本円の目安と fast mode の料金は次の記事で整理しました。 → Claude Opus 5.5とは|料金・性能・Opus 5との違い【2026年9月】
Claude Opus 5.5のAPI料金 — 公式レート表を一次ソースから確認
まず公式ドキュメント(platform.claude.com)の料金表から、Claude Opus 5.5に関わる項目を全て転記します(2026年10月2日確認)。
| 項目 | 単価(USD/百万トークン) | 倍率 |
|---|---|---|
| 入力トークン(基本) | $4.00 | 基準(1.0x) |
| プロンプトキャッシュ書き込み(5分キャッシュ) | $5.00 | 入力の1.25倍 |
| プロンプトキャッシュ書き込み(1時間キャッシュ) | $8.00 | 入力の2.0倍 |
| プロンプトキャッシュ読み込み(ヒット) | $0.20 | 入力の0.05倍 |
| 出力トークン(基本) | $20.00 | 基準(1.0x) |
| バッチAPI 入力 | $2.00 | 入力の0.5倍 |
| バッチAPI 出力 | $10.00 | 出力の0.5倍 |
| Fast mode 入力(研究プレビュー) | $8.00 | 入力の2.0倍 |
| Fast mode 出力(研究プレビュー) | $40.00 | 出力の2.0倍 |
| 1Mトークンのコンテキスト(200kトークン超の入力) | 標準単価のまま | 加算なし(1.0x) |
| 米国内のみでの推論(inference_geo: us) | 各単価の1.1倍 | 入力・出力・キャッシュのすべてに1.1倍 |

この単価は旧世代のClaude Opus 5(入力$5・出力$25)より、入出力とも2割安い水準です。Anthropicの発表ページでも「Input and output tokens are $4 and $20 per million, 20% less than Opus 5」と明記されており、キャッシュ読み込みは$0.50から$0.20へ6割下がりました。公式は、タスクあたりのトークン数も減るため、デフォルト設定の一般的なワークロードではOpus 5より40%安くなるとしています。Opus 5も$5/$25のままAPIで提供が続いています(公式の廃止予定表で、claude-opus-5の退役は「Not sooner than July 24, 2027」)。
モデル仕様も公式ドキュメントで確認しました。コンテキストウィンドウは1Mトークン(デフォルト・最大とも)、最大出力は128,000トークン(Message Batches APIでベータヘッダーを使うと300,000トークンまで拡張可)、信頼できる知識のカットオフは2026年6月です。1Mトークンのコンテキストは標準単価のままで、長い入力への加算はありません。詳しいコンテキスト長の話は主要AIモデル コンテキスト長 横断比較で他モデルとまとめて確認できます。
無料ツール・登録不要
自分の使う量で円換算する
この先の換算表は代表的なスケールでの例です。実際に投げるテキストを貼ると、Opus 5・Opus 4.8・Fable 5・Sonnet 5・Haiku 4.5・GPT-5.6系の料金を日本円で並べて比較できます。為替レートも変更できます。
日本円換算表 — 実務スケールでいくらかかるか
API料金はUSD建てのため、日本の会社が予算を組むときは円換算が必要です。以下は1ドル=150円の概算レートで換算した数字です(2026年10月2日更新。計算しやすいよう固定した目安で、実勢レートではありません。2026年9月7日の版では三菱UFJ銀行公表のTTM・1ドル=155.68円、初出時は1ドル=164円で換算していました)。実際の請求額はクレジットカード会社・決済代行の為替レート、消費税(サーバーの所在地によっては対象外)により変動するため、あくまで概算としてご利用ください。
| 項目 | USD/百万トークン | 円換算(1$=150円) |
|---|---|---|
| 入力(基本) | $4.00 | 約600円 |
| 出力(基本) | $20.00 | 約3,000円 |
| キャッシュ読み込み | $0.20 | 約30円 |
| バッチ入力 | $2.00 | 約300円 |
| バッチ出力 | $10.00 | 約1,500円 |
これだけだと感覚がつかみにくいので、「1,000万トークン(=10百万トークン)を処理したらいくらか」を、入力と出力の比率別に試算しました。
| 処理内容(合計1,000万トークン) | USD | 円換算 |
|---|---|---|
| 入力のみ1,000万トークン(大量ドキュメント読み込み等) | $40 | 約6,000円 |
| 入力800万+出力200万(資料参照・要約が中心) | $72 | 約10,800円 |
| 入力500万+出力500万(対話・レビューが中心) | $120 | 約18,000円 |
| 入力200万+出力800万(コード生成・エージェント処理が中心) | $168 | 約25,200円 |
| 出力のみ1,000万トークン(大量コンテンツ生成) | $200 | 約30,000円 |
出力トークンは入力の5倍単価なので、コーディングエージェントのように出力が多いタスクほど、同じ「合計トークン数」でも請求額は跳ね上がります。ここが「トークン数だけ見て予算を組むと痛い目を見る」ポイントです。
Fable 5.1・Sonnet 5.5・Haiku 4.5・旧Opus 5との料金比較表
Claude Opus 5.5単体の数字だけでは「高いのか安いのか」が判断できません。現行の4モデルと、旧世代のOpus 5を並べた早見表を作りました(2026年10月2日時点の公式料金表)。
| モデル | 入力/MTok | 出力/MTok | バッチ入力 | バッチ出力 | コンテキスト | 最大出力 |
|---|---|---|---|---|---|---|
| Claude Fable 5.1 | $10.00 | $50.00 | $5.00 | $25.00 | 1Mトークン | 128kトークン |
| Claude Opus 5.5 | $4.00 | $20.00 | $2.00 | $10.00 | 1Mトークン | 128kトークン |
| Claude Opus 5(旧世代・提供継続) | $5.00 | $25.00 | $2.50 | $12.50 | 1Mトークン | 128kトークン |
| Claude Sonnet 5.5 | $2.00 | $10.00 | $1.00 | $5.00 | 1Mトークン | 128kトークン |
| Claude Haiku 4.5 | $1.00 | $5.00 | $0.50 | $2.50 | 200kトークン | 64kトークン |

ここから読み取れるポイントは3つです。
- Opus 5.5は旧世代のOpus 5より入力・出力とも2割安い($5/$25→$4/$20)。Opus 5とOpus 4.8は$5/$25のまま提供が続いている(4.8側の機能整理はClaude Opus 4.8完全ガイドを参照)
- 最上位のFable 5.1はOpus 5.5の2.5倍(入力$10/出力$50)。「最も賢いモデル」を使う代償は明確に価格へ反映されている
- Sonnet 5.5はOpus 5.5の半額(入力$2/出力$10)。旧世代のSonnet 5も同額で、Anthropicの公式料金ページは「$2/$10が標準価格となり、2026年9月1日に予定していた$3/$15への値上げは実施しない」と明記している(2026年10月2日確認)。Opus 5のころ2.5倍だったOpusとSonnetの価格差は、2倍に縮まった
Claude Codeの料金プラン(Pro/Max/Team/Enterprise)込みでの比較はClaude Code料金完全ガイド、他社モデルも含めた横断比較は主要AIモデルAPI料金 横断比較にまとめています。
プロンプトキャッシュで安くする仕組み
公式ドキュメントによると、プロンプトキャッシュは「同じシステムプロンプト・大きなドキュメント・会話履歴を毎回送信するコストを、キャッシュから読み込むことで削減する」機能です。仕組みはシンプルで、初回はキャッシュへの「書き込み」コストがかかりますが、2回目以降の「読み込み(ヒット)」は、Opus 5.5では基本入力価格の20分の1($0.20/MTok)まで下がります(多くのモデルは10分の1)。
| 操作 | 倍率 | 有効期間 |
|---|---|---|
| 5分キャッシュ書き込み | 基本入力の1.25倍 | 5分間有効 |
| 1時間キャッシュ書き込み | 基本入力の2.0倍 | 1時間有効 |
| キャッシュ読み込み(ヒット) | 基本入力の0.05倍(Opus 5.5。多くのモデルは0.1倍) | 直前の書き込みと同じ期間 |
公式ドキュメントの説明をそのまま使うと、「5分キャッシュは1回読み込めば元が取れ、1時間キャッシュは2回読み込めば元が取れる」設計になっています。長いシステムプロンプトや仕様書を何度も使い回すエージェント運用・社内チャットボットでは、キャッシュを有効にするだけで入力コストが大きく下がります。バッチAPIの割引とも併用可能です。
バッチAPIの50%割引 — 使える条件と注意点
Batch APIは、大量のリクエストを非同期でまとめて処理する仕組みで、入出力とも一律50%割引です。夜間バッチでの大量文書要約、社内ナレッジの一括分類、月次レポートの自動生成など、「即時レスポンスが不要な処理」であれば適用候補になります。
注意点は2つあります。まず、Fast mode(後述)とは併用できません。次に、非同期処理のためレイテンシは保証されず、リアルタイムのチャットUIには向きません。「今すぐ返事が欲しい」タスクと「バックグラウンドで回せばいいタスク」を切り分けて、後者だけバッチに寄せるのが実務での使い方です。
この記事の内容を社内で使うなら
要点と手順をまとめた資料を無料で受け取れます。研修4,000名以上・支援100社以上の実績をもとに、自社の業務に当てはめる相談も30分から受け付けています。
Fast mode(研究プレビュー) — 2.5倍速・2倍額の使いどころ
Claude Opus 5.5・Opus 5・Opus 4.8には「Fast mode」という研究プレビュー機能があります。公式ドキュメントによると、出力速度が最大2.5倍になる代わりに割増の単価が適用され、Opus 5.5では入出力とも標準の2倍(入力$8・出力$40)です(Opus 5・Opus 4.8は入力$10・出力$50)。200kトークンを超える大きな入力でもFast modeの単価が適用され、Claude API(第一者提供)限定でAmazon Bedrock・Claude Platform on AWS・Google Cloud・Microsoft Foundryでは利用できません。バッチAPIとの併用も不可です。利用にはアカウント担当者への申請か、ウェイトリストへの登録が必要です。
「速度がボトルネックになっている顧客向けリアルタイム機能」など、レイテンシがビジネス価値に直結する用途では検討の価値がありますが、バックエンドのバッチ処理や社内ツールでコストを最優先するなら基本モードのままで十分です。
effort(推論の深さ)がコストに与える影響
Opus 5.5はeffortパラメータで「推論にどれだけトークンを使うか」を5段階(max / xhigh / high / medium / low)で調整できます。Opus 5.5では思考(adaptive thinking)が常に有効でオフにできないため、effortが推論量とコストを調整する主な手段です。thinking(思考ブロック)を含め、応答に使われるすべてのトークンが対象になるため、effortを下げるとツール呼び出しの回数まで減り、出力トークン(=単価が高い方)が抑えられます。
| レベル | 公式説明 | 用途の目安 |
|---|---|---|
max | トークン消費に制約を設けない最大capability | 最も深い推論・最も徹底した分析が必要なタスク |
xhigh | 長時間稼働するエージェント・コーディング向けの拡張capability | 30分超のエージェント作業、数百万トークン規模のタスク |
high | 高いcapability。Opus 5.5以外の対応モデルではデフォルト(Opus 5.5では明示して指定する) | 複雑な推論、難しいコーディング、エージェントタスク |
medium(Opus 5.5のデフォルト) | バランス型で中程度のトークン節約。Opus 5.5ではパラメータ省略時と同じ挙動 | 速度・コスト・性能のバランスが必要なエージェントタスク |
low | 最も効率的。capabilityは一部低下するが大幅なトークン節約 | サブエージェント等、速度とコストを最優先するシンプルなタスク |
公式ドキュメントでは、Opus 5.5は5段階すべてに対応し、デフォルトはmediumです(Opus 5以前のOpusはhighがデフォルトだったため、effortを省略したリクエストはOpus 5のときより1段階低く動きます)。推奨は「以前のモデルの設定を持ち越さず、自社の評価(eval)でeffortを振り直すこと」と「高いレベルではmax_tokensを大きめに取ること」です。API・Claude Codeではデフォルトがmediumである点は明記されていますが、claude.ai上でのデフォルト挙動は、2026年10月2日時点で確認した公式資料に記載がありません。
1点実務上の注意があります。公式ドキュメントによれば、リクエスト全体に掛かるトップレベルのeffortを会話の途中で変えると、それまでのキャッシュは引き継がれません。Opus 5.5はメッセージ単位でeffortを切り替える方法(ベータ)に対応しており、こちらはキャッシュを保ったまま変更できます。この方法を使わない場合は、会話の最初にeffortを決めたら固定し、ワークロードごとに使い分ける(会話内で頻繁に切り替えない)のが公式の推奨です。
従量課金 vs Claude.aiサブスク — 損益分岐の考え方
API従量課金とClaude.aiサブスク(Pro/Max/Team/Enterprise)のどちらが得かは、月間の利用量とトークンの入出力比率で変わります。
まず公式で確認できた提供状況を正直にまとめます。claude.com/pricingのプラン比較表(2026年10月2日確認)では、「Opus」の行は無料プランが「No」、Pro・Max 5x・Max 20xが「Yes」、Team・Enterpriseも「Yes」です。この表は「Opus」とだけ書いており、世代やプランごとの既定モデルは同ページに記載がありません。Claude Codeについては、公式ドキュメントに「Pro, Max, Team, Enterprise, and Anthropic API: defaults to Opus 5.5」と明記されています。Opus 5.5の発表では、Pro・Max・Team・シート制のEnterpriseで5時間あたりの利用上限を引き上げることも告知されました。法人プランの詳細はClaude法人プラン完全比較|Team/Enterpriseもあわせてご確認ください。
Claude.aiの利用上限は、5時間ごとにリセットされる枠と、有料プランではそれに加わる週次の上限で管理されています。どれだけ使えるかは会話の長さ・モデル・使う機能で変わり、決まったメッセージ数やトークン換算値は公開されていません(claude.com/pricingのFAQ・2026年10月2日確認)。そのため以下の試算は、「もし同じ使用量をAPI従量課金で賄ったら、理論上いくらになるか」という仮想モデルです。実際のClaude.aiの上限とは一致しない前提でご覧ください。月額はPro $20・Max 5x $100・Max 20x $200(月払い・Web契約の価格)、単価はOpus 5.5で計算しています。
| プラン | 月額 | 入力8:出力2 の損益分岐点 | 入力5:出力5 の損益分岐点 | 入力2:出力8 の損益分岐点 |
|---|---|---|---|---|
| Pro($20/月) | 約3,000円 | 月間約278万トークン | 月間約167万トークン | 月間約119万トークン |
| Max 5x($100/月) | 約15,000円 | 月間約1,389万トークン | 月間約833万トークン | 月間約595万トークン |
| Max 20x($200/月) | 約30,000円 | 月間約2,778万トークン | 月間約1,667万トークン | 月間約1,190万トークン |
読み方: 「入力2:出力8」列は、コード生成のように出力が多いエージェント的な使い方を想定しています。出力トークンは入力の5倍単価なので、同じ月額のサブスクでも出力比率が高い使い方をするほど、API換算コストは早く跳ね上がります(=サブスクの方が相対的に得になりやすい)。逆に「入力8:出力2」のように大量の資料を読ませて短い要約だけ受け取る使い方では、API換算コストが低く抑えられます。
月額シミュレーション3パターン
ここからは想定利用量に基づく試算シナリオです。実測データではなく、あくまで「このくらいの規模だとこの程度」という目安として使ってください。プロンプトキャッシュ適用後の数字は「入力の50%が繰り返しコンテキストとしてキャッシュヒットする」という仮定を置いています。単価はOpus 5.5(入力$4・出力$20・キャッシュ読み込み$0.20・バッチは半額)、円換算は1ドル=150円です。
| シナリオ | 想定月間トークン | 標準料金 | キャッシュ/バッチ活用後 | 削減率 |
|---|---|---|---|---|
| 少量: 個人・小規模チームの補助利用 (週数回の設計相談・コードレビュー) | 入力300万+出力80万 | $28(約4,200円) | $22.3(約3,345円) | 約20% |
| 中量: 開発チーム5名が日常的にコーディングエージェントとして使用 | 入力3,000万+出力800万 | $280(約42,000円) | $223(約33,450円) | 約20% |
| 大量: 複数プロダクトへのAPI組み込み・大規模バッチ処理 (非同期処理可能なタスクが4割) | 入力1億5,000万+出力3,000万 | $1,200(約180,000円) | $789(約118,350円) | 約34% |

大量利用シナリオでは、バッチAPI(非同期処理可能な4割の作業)とプロンプトキャッシュ(残り6割の入力の半分)を組み合わせることで、削減率が少量・中量シナリオの20%から34%まで伸びています。利用規模が大きくなるほど、最適化の投資対効果も大きくなるという点は、コスト管理担当者が押さえておくべきポイントです。
【要注意】見落としがちな追加コスト
トークン単価だけを見ていると見落としがちな、公式ドキュメント記載の追加コストを3つ挙げます。
1. ツール利用のシステムプロンプト分
❌ ツールを使わせても入出力トークンだけで済むと思い込む
⭕ ツールを1つ以上定義すると、Opus 5.5では286トークンの追加入力が毎回発生する(tool_choiceがauto・noneの場合。any・toolによる強制はOpus 5.5では非対応で、400エラーになる)。ツール定義そのもののトークンも別に加算され、定義や呼び出し回数が増えるほど積み上がる
2. Web検索は従量課金が別建て
❌ Web検索ツールもトークン課金だけだと思い込む
⭕ 公式ドキュメントでは「Web検索は1,000回あたり$10」が生成トークンとは別に課金されると明記されている。検索を多用するエージェントは合算して見積もる必要がある
3. コード実行は無料枠を超えると時間課金
❌ コード実行(Code execution)もトークンだけだと思い込む
⭕ Web検索・Web取得ツールと併用する場合は無料だが、単体利用時は組織あたり月1,550時間の無料枠を超えると1時間・1コンテナあたり$0.05が別途課金される
関連記事
Claude Opus 5の発表全体は「Claude Opus 5登場|料金据え置きで最高性能に」でまとめています。
コストを下げる公式4つの手段まとめ
- 適切なモデルへの振り分け: 単純なタスクはHaiku 4.5、通常の本番ワークロードはSonnet 5.5、最も複雑な推論だけOpus 5.5に回す(公式ドキュメントの推奨戦略)
- プロンプトキャッシュの活用: 繰り返し使うシステムプロンプト・大きな文書は必ずキャッシュ化。読み込みはOpus 5.5なら基本入力の20分の1
- バッチAPIの活用: 即時性が不要な処理は入出力とも50%割引のバッチAPIに寄せる
- effort・使用パターンの監視: effortを
low/mediumに下げられるタスクを評価(eval)で見極め、トークン消費パターンを定期的にモニタリングする
よくある質問
Q. Claude Opus 5.5のAPI料金はOpus 5より上がった?
下がりました。Opus 5の入力$5/出力$25に対し、Opus 5.5は入力$4/出力$20(百万トークンあたり)で、2割安くなっています。Anthropic公式発表でも「20% less than Opus 5」と明記されています。キャッシュ読み込みも$0.50から$0.20へ下がりました。
Q. Claude ProプランでOpus 5.5は使える?
claude.com/pricingのプラン比較表では、「Opus」の行はProが「Yes」、無料プランが「No」です(2026年10月2日確認)。表に世代の記載はありませんが、Claude Codeの公式ドキュメントは、Proを含む有料プランの既定モデルをOpus 5.5と明記しています。Proの利用上限の範囲で使う形で、上限に達した後は、利用クレジットを有効にすると標準のAPI料金で続けられます。
Q. プロンプトキャッシュはどのくらい安くなる?
キャッシュ読み込み(ヒット)は、Opus 5.5では基本入力価格の20分の1($0.20/MTok)です(多くのモデルは10分の1)。5分キャッシュは1回読み込むだけで書き込みコストの元が取れ、1時間キャッシュは2回読み込めば元が取れる設計になっています。
Q. バッチAPIとFast modeは併用できる?
できません。公式ドキュメントに「Fast mode is not available with the Batch API」と明記されています。即時性が必要な処理はFast mode、非同期でよい処理はバッチAPIと、用途で明確に分けて使う必要があります。
Q. 1Mトークンのコンテキストウィンドウを目一杯使うといくらかかる?
1回のリクエストで100万トークンをすべて入力に使うと、単純計算で$4(約600円)です。ただし同じ大きな文書を複数回のリクエストにまたがって使う場合は、プロンプトキャッシュを使わないと毎回$4が発生してしまう点に注意が必要です。
Q. Sonnet 5の値上げ予定はどうなった?Opus 5.5選択の判断に影響する?
撤回されました。Anthropicの公式料金ページは、Sonnet 5の$2/$10を標準価格とし、2026年9月1日に予定していた$3/$15への値上げは実施しないと明記しています(2026年10月2日確認)。後継のSonnet 5.5も同じ$2/$10です。Opus 5.5($4/$20)とのコスト比は2倍なので、コスト重視の処理はSonnet 5.5、複雑な推論だけOpus 5.5に振り分ける方針でよいでしょう。
参考・出典
- Introducing Claude Opus 5 — Anthropic公式発表(参照日: 2026-07-25、2026-09-07に再確認)
- Introducing Claude Opus 5.5 — Anthropic公式発表(参照日: 2026-10-02。単価、Opus 5との差、Fast modeの単価を確認)
- Pricing — Anthropic公式ドキュメント・モデル料金表(参照日: 2026-07-25、2026-10-02に再確認。Opus 5.5の単価と各種の割引・加算、Sonnet 5の値上げ撤回に関するNoteを含む)
- 外国為替相場(三菱UFJ銀行公表) — 三菱UFJリサーチ&コンサルティング(2026年9月7日の版で、2026年9月4日公表のTTM 1ドル=155.68円を円換算に使用・参照日: 2026-09-07。2026年10月2日の版からは1ドル=150円の概算で換算)
- Models overview — Anthropic公式ドキュメント・モデル仕様比較表(参照日: 2026-07-25、2026-10-02に再確認)
- Claude Opus 5.5 — Anthropic公式ドキュメント・モデルページ(参照日: 2026-10-02。単価・公開日・デフォルトeffortを確認)
- Model deprecations — Anthropic公式ドキュメント・モデルの提供状況と退役予定(参照日: 2026-10-02)
- Fast mode (research preview) — Anthropic公式ドキュメント(参照日: 2026-10-02)
- Effort — Anthropic公式ドキュメント・effortパラメータ仕様(参照日: 2026-07-25、2026-10-02に再確認)
- Claude Pricing — Anthropic公式・Claude.aiプラン料金(参照日: 2026-07-25、2026-10-02に再確認)
- Model configuration — Claude Code公式ドキュメント・プランごとの既定モデル(参照日: 2026-10-02)
- What is the Max plan? — Claudeヘルプセンター・Maxプランの月額(参照日: 2026-10-02)
まとめ:今日から始める3つのアクション
- 今日やること: 自社の直近1ヶ月のClaude API利用量(トークン数)をConsoleで確認し、本記事の日本円換算表と照合して概算コストを把握する
- 今週中: 繰り返し使っているシステムプロンプト・仕様書がキャッシュ化されているか確認し、未対応ならプロンプトキャッシュを有効化する
- 今月中: 即時性が不要なバッチ処理をBatch APIへ移行できないか棚卸しし、effortレベルをタスク別に評価(eval)して過剰なコスト設定がないか点検する
著者: 佐藤傑(さとう・すぐる)
株式会社Uravation代表取締役。X(@SuguruKun_ai)フォロワー約10万人。
100社以上の企業向けAI研修・導入支援。著書『AIエージェント仕事術』(SBクリエイティブ)。
SoftBank IT連載7回執筆(NewsPicks最大1,125ピックス)。
ご質問・ご相談はお問い合わせフォームからお気軽にどうぞ。Claude導入のコスト設計や社内研修については、AIエージェント導入完全ガイドもあわせてご覧ください。
あわせて読みたい
- Claude Opus 5登場|料金据え置きで最高性能に — モデル全体の位置づけとベンチマーク
- Fable 5「利用クレジット」とは — 最上位モデルの従量課金の仕組み
- Claude Code料金完全ガイド — 開発ツールとしての料金プラン比較
今日から使える社内向けコピペプロンプト
Opus 5.5導入のコスト検討でそのまま使えるプロンプトを5つ用意しました。[ ]部分を自社の数字に置き換えてご利用ください。
1. 月間コスト試算プロンプト
あなたは法人向けAPIコストの試算担当です。
以下の情報から、Claude Opus 5.5(入力$4/MTok・出力$20/MTok)を利用した場合の月間概算コストをUSDと日本円の両方で試算してください。
【入力してください】
- 想定利用人数: [人数]
- 1人あたりの月間想定利用回数: [回数]
- 1回あたりの想定入力トークン数(目安。わからなければ「不明」と記入): [数値]
- 1回あたりの想定出力トークン数(目安): [数値]
- プロンプトキャッシュを使う予定か: [はい/いいえ/未定]
- 想定為替レート(1ドルあたり円): [数値]
試算は「キャッシュなしの標準ケース」と「入力の50%がキャッシュヒットすると仮定したケース」の2パターンを出し、前提条件を明記してください。
2. サブスク vs API従量課金の比較検討メモ
あなたは社内IT予算の比較検討資料作成担当です。
以下の条件で、「Claude.aiサブスク(Pro/Max)」と「API従量課金(Opus 5.5)」のどちらが自社にとって有利かを整理した比較メモを作成してください。
【背景】
- 現在の利用人数: [人数]
- 主な用途: [コーディング支援/資料作成/リサーチ/その他: 具体的に]
- 出力が多いタスクか、入力(資料読み込み)が多いタスクか: [どちらか、または比率]
- 検討中のプラン: [Pro $20/月 / Max 5x $100/月 / Max 20x $200/月]
比較メモには「月額固定費」「想定トークン量でのAPI換算コスト」「どちらが得になる分岐点」「非金銭的な考慮点(利用上限のリセット、チーム管理のしやすさ等)」を含めてください。
3. プロンプトキャッシュ導入の技術検討メモ
あなたは開発チームのテックリードです。
以下の条件で、Claude Opus 5.5のAPI呼び出しにプロンプトキャッシュを導入する技術検討メモを作成してください。
【現状】
- 繰り返し送信しているシステムプロンプト・ドキュメントの概要: [説明]
- 想定文字数(またはトークン数): [数値]
- リクエスト頻度: [例: 1日◯回]
- 5分キャッシュと1時間キャッシュ、どちらが用途に合うか判断してほしい
期待される削減効果(概算)、実装上の注意点(キャッシュの有効期限、トップレベルのeffortを変更するとキャッシュが無効になる点)を含めてメモを作成してください。
4. Opus 5.5切替の社内稟議書ドラフト
あなたは法人向けIT予算申請の資料作成担当です。
以下の条件で、Claude Opus 5.5導入(または既存モデルからの切替)に関する社内稟議書のドラフトを作成してください。
【申請内容】
- 対象部署・利用人数: [部署名、人数]
- 現在使用中のモデル(該当する場合): [Opus 5 / Opus 4.8 / Sonnet 5.5 / その他]
- 想定月間コスト(概算): [金額]
- 導入理由: [具体的な業務課題と期待効果]
- 稟議の承認ライン: [役職名]
稟議書には「目的」「現状の課題」「導入によるコスト」「期待効果」「リスクと対策(コスト超過時の運用ルール等)」の見出しを含めてください。
5. コスト超過アラートの運用ルール文書
あなたは開発チームのコスト管理担当です。
以下の条件で、Claude Opus 5.5のAPI利用におけるコスト超過アラートの運用ルール文書を作成してください。
【条件】
- 月間予算上限: [金額]
- アラートを出す閾値(例: 予算の80%到達時): [割合]
- 主な利用チーム: [チーム名]
- 予算超過が見込まれる場合の対応方針: [例: effortをlowに下げる/Sonnet 5.5に切り替える/利用を一時停止する 等、該当するもの]
運用ルールには「モニタリング方法」「アラート発生時の連絡フロー」「コスト削減の優先順位(キャッシュ活用→バッチ移行→モデル変更等)」を含めてください。
監修:株式会社Uravation(生成AI活用書籍シリーズ累計59,900部の著者チームが運営。自社7メディアの実運用でAI検索からの引用・流入を継続計測し、その知見に基づいて編集しています。仕様・料金が変わりやすい領域のため、重要な意思決定の前には各公式情報の最新版をご確認ください)
この記事の内容を社内展開する方へ: 生成AI 料金・プラン早見表 2026年10月版(無料・PDF 35ページ+Excel) をダウンロードできます。



