見出し画像

Claude Fable 5.1が出たので、エンジニアの目線で「何が変わったか」だけ整理する

9月1日、Claude Fable 5.1がリリースされました。
前作のFable 5が出たときも記事を書きましたが、今回は「性能が上がりました」で終わらせず、実務で何が変わるのか、乗り換えるべきなのかに絞って書きます。公式の発表とドキュメントを一通り読んだうえでのまとめです。
結論を先に言うと、

  • 全部をFable 5.1に乗り換える必要はない

  • ただし、エージェントを長時間回す用途なら、性能とコストの両面で乗り換える価値がある

  • Fable 5からAPIで移行する人は、破壊的変更が3つあるので要確認

この3点です。順に説明していきます。

まず位置づけをはっきりさせる

Claudeのモデルラインナップ、正直ややこしくなってきたので最初に整理します。
Fable 5.1はClaude 5ファミリーの最新モデルで、Opusの上に位置する「Mythosクラス」の階層です。
つまり、序列としては
Haiku → Sonnet → Opus → Fable / Mythos
となります。
そして、今回同時に発表されたClaude Mythos 5.1は、Fable 5.1と同一モデルです。違いはセーフガードのレベルだけ。

  • Fable 5.1:一般提供。二重用途(dual-use)系の能力に追加のセーフガードあり

  • Mythos 5.1:サイバーセキュリティ・生命科学向けのtrusted accessプログラム限定

僕らが普通に使うのはFable 5.1のほうです。Mythosは米国の承認済み組織向けなので、日本の個人開発者や中小企業が触る機会はまずないと思っていいです。

性能面で押さえておくこと

公式発表から、数字とファクトだけ拾います。

  • Fable 5比で、最難関の推論テスト(競技数学、大学院レベルの理工系問題、信頼性が鍵になる長い多段階タスク)が明確に向上

  • Low / Medium effort設定でもFable 5と同等以上の結果。High effortだと大幅に上

  • 複数ベンチマークでFable 5、Opus 5、OpenAIのGPT-5.6 Solを上回る(Anthropic発表)

日常利用での体感としてAnthropicが挙げているのは、「曖昧なタスクでの判断力が上がった」「自信満々の誤答が減った」の2点です。
ベンチマークの数字そのものより、僕は「Low / Medium effortでFable 5並み」のほうが実務的には重要だと思っています。理由は後述しますが、要するに同じ結果を安く出せるということなので。

個人的に一番効くと思っている変更:長時間の自律稼働

今回のリリースで、Anthropicが一番押しているのがここです。
Fable 5.1は「数時間かかる、複数アプリをまたぐ仕事」向けに設計されています。具体的に想定されているのは

  • Coworkでバックログを消化する

  • Claude Tag経由でSlackの依頼を拾って処理する

  • ブラウザを操作する

  • Claude Platform上のマネージドエージェントとして無人で動く

といった用途。動き方としては、計画を立てる → 必要なツールを使う → 失敗したステップから復帰する → 頼まれなくても進捗を報告する、という流れです。
そして挙動面での改善として明記されているのが以下。

  • 安易に見える近道を避け、症状ではなく根本原因を直す

  • 行き詰まったら、「行き詰まった」と正直に言う

  • 失敗するテストを無効化して通そうとする挙動が減った

最後のやつ。Claude Codeを長時間回したことがある人なら、たぶん一度は経験していると思います。テストが落ちる → いつの間にかそのテストがスキップされている → 「全部通りました!」と報告される、あのパターンです。
インフラエンジニアの仕事で言えば、アラートがうるさいからといって閾値を上げて黙らせるのと同じで、一番やってほしくない類の「解決」です。ここが改善されたというのは、地味ですが自律稼働させるうえで一番大きい信頼性の向上だと思っています。

コーディング周り

コーディング用途については、Anthropicが「最も能力の高いモデル」と位置づけているのが以下の領域です。

  • コードベース全体にまたがる機能実装

  • コードレビュー

  • パフォーマンス改善

  • 複数日にわたる自律セッション

自分でテストを書いて検証したり、デザインを高い忠実度で実装したりもできるとのこと。
ただ、正直ここは「Fable 5でもできていたことが、より安定して長く続けられるようになった」という理解でいいと思います。革命というより、前述の自律稼働の改善とセットで効いてくる部分です。

価格:ここが実質的な目玉

数字を並べます。

基本料金は変わっていません。変わったのはキャッシュ読み取りだけ。
これだけ見ると「ふーん」で終わりそうですが、Anthropicの試算では

  • 典型的なワークロードで約25%のコスト減

  • 高度にエージェント的なワークロードで最大約45%のコスト減

となっています。
なぜ、キャッシュ読み取りだけの値下げでここまで効くかというと、エージェントを長時間回すほど、毎ターン同じシステムプロンプトやツール定義、過去の文脈を読み直すので、トークンの大半がキャッシュ読み取りになるからです。つまりこの値下げは、実質的に「エージェント用途の値下げ」と読んでいいです。
さらに前述の「Low / Medium effortでFable 5並み」と組み合わせると、Fable 5で回していた処理をFable 5.1のMedium effortに移すだけで、同じ品質をかなり安く出せる計算になります。
なお、米国内での推論が必要な場合は、入出力1.1倍の価格でUS-only推論も選べます。データレジデンシーの要件がある案件では選択肢になります。

セーフガード周りの変更

ここはClaude Codeユーザーにとって実務的に効く部分です。

  • Claude Codeでのサイバーセキュリティ関連の誤検知が約60%減

  • 脆弱性の発見はOK、エクスプロイトの開発はNG、という線引きが明確化

  • 生成テキストへの不可視ウォーターマークを導入。検出APIはプライベートプレビュー(EU法対応で適格組織向け)

  • Fable 5.1は「Covered Model」に指定。提供先(API / AWS / GCP / Azure)を問わず、データ保持・安全審査・アクセスポリシーが追加で適用される

誤検知60%減は素直に嬉しいです。インフラ系の作業だと、ファイアウォールルールやIAMポリシーをいじっているだけで「セキュリティ攻撃っぽい」と判定されて止まることが今までありました。
Covered Modelの件は、企業でBedrockやFoundry経由で導入を検討している人は、自社のデータ保持ポリシーと照らして一度確認しておいたほうがいいです。
ウォーターマークについては、AI生成コンテンツを扱う身としては無視できない話なので、別の記事で掘り下げます。

開発者向け:Fable 5から移行する人への破壊的変更

APIでFable 5をすでに呼んでいる人は、モデルIDを差し替えるだけでは動かない可能性があります。公式ドキュメントに明記されている破壊的変更は3つ。

  1. forced tool use(ツール使用の強制)がエラーを返す

  2. 以前のモデルがFable 5.1のthinkingブロックを読めない

  3. 過去ターンを編集するとthinkingブロックが無効化される

加えて、破壊的ではないものの挙動が変わる点として、並列ツール呼び出しの挙動がより変動的になったことが挙げられています。これはプロンプト側での対処法がドキュメント化されているので、移行前に「Prompting Claude Fable 5.1」のページは読んでおいたほうがいいです。
特に2番目は、モデルを混在させたパイプライン(Fable 5.1で計画してSonnetで実行、みたいな構成)を組んでいる人は要注意です。

公式の使い分けガイド

Anthropic自身が明確に書いているので引用に近い形で紹介します。

ほとんどのワークロードではOpus 5から始める。要求の厳しい推論や長期のエージェント作業、あるいはOpus 5を高effortにしても評価が届かない場合にFable 5.1を使う。

つまり、「とりあえず全部Fable 5.1」は公式も推奨していないということです。
僕自身の整理としては

  • 日常のチャット、記事の下書き、軽いコード修正 → Opus 5(もしくはSonnet 5)

  • 数時間回すエージェント、コードベース全体にまたがる改修、根本原因を追う調査 → Fable 5.1

くらいの振り分けで考えています。

提供状況とモデルID

  • claude.ai:Pro / Max / Team / Enterpriseで利用可

  • API:Claude Platform、各マーケットプレイス、Amazon Bedrock、Google Cloud、Microsoft Foundry

  • モデルID:claude-fable-5-1

リリース初日から全プラットフォームで使えるのは、企業導入の観点だとありがたい変更です(以前はクラウド側の提供が遅れることがあったので)。

まとめ

  • Fable 5.1はMythos 5.1と同一モデルで、Opusの上位。一般提供されるのはFable

  • 性能はFable 5比で明確に向上。特にLow / Medium effortでFable 5並みという点が実務的

  • キャッシュ読み取りが75%減で、エージェント用途では最大45%のコスト減

  • 「テストを無効化して通す」挙動が減ったのは、自律稼働の信頼性として一番大きい

  • Claude Codeのセキュリティ系誤検知が約60%減

  • Fable 5からのAPI移行は破壊的変更3つを要確認

  • 全部乗り換える必要はなく、重い処理だけFable 5.1に振り分けるのが公式推奨

自分のRSS → Claude APIのパイプラインでも、キャッシュ周りのコスト差を実測してみる予定なので、結果が出たらまた書きます。
※本記事の内容は2026年9月2日時点の公式発表・ドキュメントに基づいています。価格や仕様は変更される可能性があるので、最新情報はAnthropic公式サイトをご確認ください。


いいなと思ったら応援しよう!