見出し画像

Claude Codeの利用制限とモデル|Fableの並列は12分で尽きる。作業ごとの使い分けと設定


Claude Codeで大きな仕組みを作ろうと、いちばん賢いFableに切り替えて並列で動かしたら、5時間の枠が12分でなくなりました。公式の説明は「会話の長さ、モデル、effortで使用量が変わる」までで、何をどれだけやると尽きるのかは書かれていません。そこで、6月から9月の僕の記録に残っていた、上限に達した27回を数え直しました。5時間の枠は時間ではなく量で、減る速さはモデルと並列の数で何十倍も変わります。普段はOpusで回し、Fableは設計の要所だけに使い、その使い分けを先にCLAUDE.mdに書いておく。これが、枠を持たせるいちばんの近道です。

まず5行でまとめると

  • 減る速さ: 僕のMax 5xの記録では、Opus中心なら上限まで約4時間、Opusを並列で大量に回すと約1時間、Fableを並列で回すと12〜26分でした。

  • モデルの役割: Fableは答えが決まっていない調査と設計、Opus 5.5は長いコーディング、Sonnet 5は日々の作業、Haiku 4.5はサブエージェントの下働きに向きます。

  • 差の大きさ: 公式の試験では、Opus 5.5にFableを相談役で付けても、Opus単独より1.7ポイント上がるだけで、費用は約2倍でした。

  • 大きい基盤: Fableに全部やらせず、設計と判断だけを任せます。公式の実測では、Fableが指揮してSonnetを25体動かすと、費用は約半分、15〜20時間の仕事が約2.3時間になりました。

  • 先に決めておく: 作業ごとのモデルと並列の条件をCLAUDE.mdに書き、よく頼む作業はモデルまで決めたスキルにして、設定ファイルで並列の大きさを決めておきます。

5時間制限は、時間ではなく「量」

Claude Codeの有料プランには、5時間ごとにリセットされる上限と、週ごとの上限があります。5時間ずっと使えるという意味ではありません。5時間ごとに決まった量が配られ、それを使い切ると、次のリセットまで止まります。

この量は、claude.aiのチャット、Claude Code、デスクトップアプリで共通です。Max 5xはProの5倍、Max 20xは20倍の量が、5時間ごとに配られます。公式の説明では、減り方を左右するのは会話の長さと複雑さ、使う機能、モデル、そしてeffort(どれだけ深く考えさせるか)です。

どこで減っているかは、Claude Codeで `/usage` と打つと見られます。5時間の枠と週の枠の残りに加えて、スキル、サブエージェント、MCPサーバーごとの割合が出ます。長い会話やキャッシュの取り直しが使用量の1割をこえると、そのことも表示されます。

上限は全モデル共通なので、上限に達してから `/model` で別のモデルに替えても、続きはできません。先に減り方を知っておくしかない、ということです。

上限に達した27回を、数え直した

僕のClaude Codeの記録には、6月から9月までに「session limit(5時間の上限)に達した」という表示が27回、週の上限に達した表示が2回残っていました。プランはMax 5xです。コマンドを動かしてデータを取り、集計する作業が中心です。

いまのモデル(Opus 5、Opus 5.5、Fable 5.1)を使っていた8月と9月の19回を、使い方で分けました。

  • Opus中心(10回): 上限まで168〜294分、真ん中の値は258分でした。その間にAPIを636〜1,717回呼び、コマンドを422〜1,658回動かしています。出力は43万〜194万トークンで、真ん中の値は約106万でした。

  • Opusを並列で大量に(2回): 上限まで54〜59分。1時間足らずでAPIを1,387〜1,943回呼び、コマンドを1,318〜1,865回動かしていました。

  • Fableを並列で(2回): 上限まで12〜26分。APIの呼び出しは164〜259回、ワークフロー(多数のサブエージェントを動かす仕組み)を2〜4回立ち上げていました。

  • OpusとFableを混ぜた日(5回): 上限まで123〜285分。上限に届いたときの出力は36万〜62万トークンでした。

Fableが入ると、上限に届く出力の量は、Opus中心の日の3分の1ほどです。並列は、同じ量の仕事を短い時間に詰め込むので、時間あたりの減り方が何倍にもなります。

12分で尽きた日に、何が起きていたか

9月6日は、Fableでultracodeを使い、ワークフローを回していた日です。午前は26分、午後は12分で上限に達しました。午後の12分のあいだにワークフローが4回立ち上がり、出力の9割以上はサブエージェントが出したものでした。

ultracodeは、xhighという深い推論で、頼みごとのたびにワークフローを組む設定です。公式の説明にも、頼みごとのたびにトークンが増え、時間も長くなると書かれています。ワークフローは同時に16体まで動くので、Fableの単価に、深い推論と、並列の数がかけ算で乗ります。

もうひとつ、知らないとはまる仕様があります。プロンプトに「ultracode」という単語を入れるだけで、その1件がワークフローになります。 話題にしただけでも反応するので、使わないなら `/config` の「Ultracode keyword trigger」を切っておくと安全です。入力中に気づいたら、MacならOption+Wで外せます。

Fableの使用量は、プランによっては5時間の枠ではなく、追加の使用量(有料のクレジット)から引かれます。`/model` のFableの行に「Requires usage credits」と出ていたら、その扱いです。僕も7月には、追加の使用量に付けていた月の上限額に何度か当たりました。

モデルの差は、どれくらいか

いまのClaudeは4つです。速さは、Haiku 4.5がいちばん速く、Sonnet 5、Opus 5.5、Fable 5.1の順に遅くなります。料金は100万トークンあたり、入力と出力でFableが10ドルと50ドル、Opus 5.5が4ドルと20ドル、Sonnet 5が2ドルと10ドル、Haikuが1ドルと5ドルです。FableはOpus 5.5の2.5倍になります。

では、賢さの差はどれくらいか。Anthropicが公開している社内のコーディング試験では、Opus 5.5(effortはhigh)にFable 5.1を相談役として付けた組み合わせが90.1%で、1回あたり2.92ドルでした。Opus 5.5だけのhighとの差は1.7ポイントで、試験のぶれの範囲です。それで費用は約2.1倍でした。

Opus 5.5だけでもeffortをxhighに上げると、91.1%で1回4.11ドルでした。公式は、モデルを替えるより、effortを調整するほうが効くことが多い、とはっきり書いています。Claude CodeでのOpus 5.5の既定はmediumで、FableとSonnet 5はhighです。

いちばん賢いモデルに替えるより、いまのモデルを少し深く考えさせるほうが効きます。

Fable 5を最初に開放したときの騒ぎと、何ができるようになったかは、こちらにまとめています。

どんな作業に、どのモデルが活きるか

公式の選び方の表と、僕の記録を合わせると、4つのモデルの持ち場はこう分かれます。

  • Fable 5.1: 答えが決まっていない問題です。原因の調査、障害の切り分け、設計の判断、何時間もかかる大きな仕事、調べて最後まで仕上げる仕事に向きます。公式のコツは、手順ではなく欲しい結果を伝えること、確認の念押しをしないこと、普段なら分けて頼む大きさで渡すことです。

  • Opus 5.5: 何時間もかかるコーディング、大きな作り替え、仕組み全体の設計、画像の多い作業に向きます。Claude Codeの既定のモデルです。

  • Sonnet 5: 日々のコーディング、データの集計、画像の読み取り、ツールを使う作業です。Opusより速く、単価は半分です。

  • Haiku 4.5: サブエージェントの下働きです。ファイルを探す、一覧を作る、同じ処理を大量に回す、といった作業に向きます。

逆に、手順が決まっている作業をFableで繰り返すと、高いうえに遅いだけです。

大きい基盤を作るときは、Fableを「頭」にだけ使う

大きな仕組みを最初から作るとき、全部をFableにやらせたくなります。けれど公式の実測は、別のやり方を勧めています。

2,160万トークンの題材(Pythonのパッケージ14個に、130の欠陥を仕込んだもの)で、Fable 5.1が1体で全部読むと、1回468〜552ドル、15〜20時間かかりました。Fable 5.1が指揮してSonnet 5を25体動かすと、費用は47〜55%下がり、時間は約2.3時間になりました。正確さは10〜12ポイント下がりましたが、Sonnet 5が1体でやるよりは上です。

Claude Codeでは、次の順番にすると枠を持たせやすくなります。

  • 設計はFableと計画モードで: `/model fable` にして、Shift+Tabで計画モードに入ります。決まった設計は、docs/plan.md のようなファイルに書き出させます。

  • 実装はOpusに戻す: `/model opus` で戻します。迷いどころだけFableに聞くなら、`/advisor fable` で相談役にします。Claudeは方針を決める前、同じエラーが続くとき、完了と言う前に相談します。

  • 並列は1件ずつ、小さく: その1件にだけultracodeを付けて、下働きはSonnetで、と頼みます。まず1つのフォルダなど、小さい範囲で試します。

  • 途中で止める: `/workflows` で、エージェントごとのトークンが見られます。膨らんだらxで止められます。止めても、終わった分はたいてい残ります。

Fableは考える担当です。手を動かすのは、OpusとSonnetに任せます。

設計をファイルに書き出してからAIに渡す考え方は、こちらで書きました。

使い分けは、先にCLAUDE.mdに書いておく

ここまでの使い分けを、頼むたびに自分で考えるのは手間です。CLAUDE.md(Claude Codeが会話の最初に読む、プロジェクトの説明書)に、作業ごとのモデルと、並列を使ってよい条件を先に書いておくと、Claudeのほうから合わせてくれます。

書く前に、知っておきたいことが3つあります。Claudeは、自分が動いているモデルを自分では切り替えられません。なので、表と違うモデルで大きな作業を頼まれたら、止まって切り替えを頼むように書きます。一方、サブエージェントのモデルはClaudeが選べるので、書いたとおりに動きます。ワークフローは、頼まれないと始まりません。条件に合ったら、何体・どのモデル・何段で動かすかを出して、聞くように書きます。

たとえば、こう書いておきます。

■ モデルと並列の使い分け

【作業ごとのモデル(メインの会話)】
- 基盤づくり・設計・原因のわからない不具合の調査 → fable(effort high)
- コードの修正・機能追加・作り替え → opus(effort medium、難所だけ high)
- 決まった手順の作業・データの集計 → sonnet
- ファイル探し・一覧づくり・単純な置き換え → haiku
- 依頼を受けたら、まず上の表で作業の種類を決め、今のモデルと比べる
- 違うとき:基盤づくり・設計なら、始めずに「/model fable に切り替えてください」と1行で止まる。それ以外は1行で提案して、今のモデルで進める
- 切り替えの提案は作業の区切りだけ。会話の途中では出さない

【サブエージェント(モデルを指定して実行する)】
- 調べもの・ファイル探し・一覧づくり → haiku
- 決まった修正を複数のファイルに当てる → sonnet
- 設計や修正が正しいかの確認 → opus
- fable はサブエージェントに使わない

【ワークフロー(並列)】
- 使ってよい条件:互いに独立した作業が10件以上あり、1つの会話に収まらないとき
- 始める前に「何体・どのモデル・何段」を1行で出し、OKをもらってから走らせる
- 下働きは sonnet か haiku、まとめと判定だけ opus。fable は指揮だけ
- 最初は5体未満・1フォルダ分で試し、結果を見てから広げる
- 使わない:1本の手順で終わる作業、会話に収まる量、枠が残り少ないと言われたとき

【よく頼む作業】
- 同じ種類の依頼が3回目になったら、スキルにするよう提案する。SKILL.md の案に、手順と model・effort を書く
- 同じ形の並列作業は、ワークフローを保存して /名前 で呼べるようにするよう提案する

会話の途中で切り替えを勧めないのは、モデルを替えると、それまでの会話のキャッシュが作り直しになるからです。区切りで替えたほうが、使用量は少なくすみます。

決まった形の並列作業なら、一度走らせたワークフローを `/workflows` で選んでsを押すと保存できます。次からは `/名前` で呼ぶだけで、同じ形で動きます。

よく頼む作業は、スキルにしてモデルまで決めておく

毎週の集計のように、同じ依頼を何度もするなら、スキルにしておくのがいちばん効きます。スキルは、手順を書いたSKILL.mdというファイルで、`/名前` で呼ぶか、Claudeが依頼の中身から判断して使います。公式も、同じ指示や手順を何度も貼っているならスキルにするように、と勧めています。

効き目は2つあります。CLAUDE.mdは毎回読み込まれますが、スキルの中身は使うときだけ読まれるので、手順が長くても普段の使用量は増えません。そしてスキルには、使うモデルとeffortを書いておけます。

---
name: shukei
description: 毎週のデータを集計して表にする。集計を頼まれたときに使う
model: sonnet
effort: medium
---
(ここに手順を書く)

こう書いておくと、そのスキルを使うときだけ、Sonnetのmediumで動きます。Claudeは自分でモデルを切り替えられませんが、スキルに書いたモデルは、その作業のあいだだけ自動で切り替わります。よく頼む作業ほど、モデルまで決めたスキルにしておくと、枠が長持ちします。

置き場所は、全部のプロジェクトで使うなら ~/.claude/skills/、そのプロジェクトだけなら .claude/skills/ です。先ほどのCLAUDE.mdの例に「3回目で提案する」と入れておけば、スキルにしどきもClaudeが教えてくれます。

設定ファイルには、4行だけ入れておく

CLAUDE.mdが「どう使うか」なら、設定ファイルは「どこまで使うか」の決めごとです。

設定ファイル(~/.claude/settings.json)に入れておくと効くのは、次の4つです。

{
  "model": "opus",
  "workflowSizeGuideline": "small",
  "autoContinueAtUsageLimit": true,
  "env": { "CLAUDE_CODE_SUBAGENT_MODEL": "sonnet" }
}
  • model: 普段のモデルです。opusにするとOpus 5.5になります。effortは既定のmediumのままにして、難しいところだけ `/effort high` に上げます。その1回だけ深く考えさせたいなら、プロンプトに「ultrathink」と入れます。

  • workflowSizeGuideline: ワークフローの大きさの目安です。smallは5体未満、既定のmediumは10体未満、largeは50体未満を目指します。`/config` の「Dynamic workflow size」でも変えられます。

  • autoContinueAtUsageLimit: 5時間の上限に当たったら、リセットを待って続きから再開します。

  • CLAUDE_CODE_SUBAGENT_MODEL: サブエージェントのモデルです。何も決めないとメインと同じモデルで動くので、Sonnetにしておくと、並列にしたときの減りがかなり抑えられます。

設定のほかにも、減りを抑える習慣があります。関係のない作業に移るときは `/clear` で会話を消します。消すのに使用量はかかりません。CLAUDE.mdは200行以内に収めて、細かい手順はスキルに移します。どこで減っているかは、ときどき `/usage` で確かめます。

クラウドセッションの、いい使い方

クラウドセッションは、Claude Codeを手元のパソコンではなく、Anthropicのクラウドで動かす仕組みです。ノートパソコンを閉じても動き続け、ブラウザのclaude.ai/codeや、スマホのClaudeアプリから様子を見て指示できます。

いちばんいい使い方は、手元で計画して、クラウドで実行することです。公式もこの順番を勧めています。手元の計画モードで方針を決め、計画をファイルにしてGitHubに上げてから、`claude --cloud "docs/plan.md の計画を実行して"` のように渡します。

独立した小さい作業なら、`claude --cloud` を何本も打って、同時に進められます。ただし、クラウドの分も同じ5時間の枠から引かれます。本数を増やせば、そのぶん早く減ります。

終わった作業は、`claude --teleport` で手元に引き取れます。プルリクエストを作れば、テストの失敗やレビューのコメントに自動で直しを入れる「Auto-fix」も使えます。

使う前に知っておきたいことが3つあります。基本はGitHubにあるリポジトリが前提で、クラウドは今のブランチを取ってくるので、先に上げておく必要があります。`/clear` は使えないので、作業が変わったら新しいセッションを作ります。しばらく放っておくと仮想マシンが片づけられ、会話は戻りますが、途中の作業は戻りません。

僕が、この数字から思うこと

僕は、Fableは「何を作るか」を決める時間にだけ使うのがいいと思っています。8月と9月の記録を見ると、1時間もたずに上限に届いた日は、どれもFableか並列を回していた日でした。反対に、Opus中心の日は、真ん中の値で4時間以上もっています。

5時間の枠を気にしながら作業するのは、正直つらいものです。それでも、減り方がモデルと並列の数で決まると分かっていれば、使いどころは選べます。Fableを1時間使うなら、そのあと3時間はOpusで手を動かす。枠の配分を先に決めておくと、大事なところで止まらずにすみます。

AIの選び方をもっと広く、性格で比べた記事もあります。

このデータで分からないこと

  • 数えたのは、手元のClaude Codeの記録だけです。claude.aiのチャット、クラウドセッション、ほかの端末で使った分は入っていないので、実際にはもう少し多く使っています。

  • プランはMax 5xです。Proはこの5分の1、Max 20xは4倍の量が配られます。

  • 5時間の枠の量は、公式に数字が出ていません。変わることもあります。

  • 7月までは今と違うモデルを使っていたので、使い方の型は8月と9月の19回だけで分けました。

まとめ

  • 5時間制限は、5時間ごとに配られる量です。減る速さは、モデルと並列の数とeffortで何十倍も変わります。

  • 僕のMax 5xでは、Opus中心で約4時間、Opusの並列で約1時間、Fableの並列で12〜26分でした。

  • Fableは答えが決まっていない調査と設計、Opusは長いコーディング、Sonnetは日々の作業、Haikuは下働きに向きます。

  • モデルの差は数ポイントで、費用は倍単位です。モデルを替える前に、effortを調整します。

  • 大きい基盤は、Fableに設計させて、OpusとSonnetに作らせます。

  • その使い分けを、CLAUDE.mdと設定ファイルに先に書いておきます。よく頼む作業は、モデルとeffortまで決めたスキルにします。クラウドには、計画を固めた作業を渡します。

あなたの5時間の枠は、いつもどこで尽きていますか。`/usage` の内訳を一度開いてみると、減り方の癖が見えてきます。

出典

身近な「なぜ?」を、数字でほどいています。ポケモンカードの相場・環境データは、下記で毎日更新中。

ポケミミ:pokemimi.com
ポケミミTools:pokemimi.com/tools/
ポケミミDesign:pokemimi.com/design/
シティリーグキャンセル待ち:discord.gg/GzZTXRkjAg

スキ ♡ とフォローは、 次の記事を作る時の励みになります。

いいなと思ったら応援しよう!

YG|元編集者・クリエイティブディレクター 引き続き記事を書いて欲しいと思ったら!頑張るよ。