見出し画像

【最新情報】Anthropicが「Claude Fable 5.1」を発表。

コーディングと知的作業でさらに進化

2026年9月1日、Anthropic社は新しいAIモデル「Claude Fable 5.1」と、その姉妹モデルにあたる「Claude Mythos 5.1」を発表しました。前バージョンの「Fable 5」から性能・コスト・安全性のすべてで改善が加えられており、Claudeをコーディングやリサーチ、日常業務に活用している方にとっては見逃せないアップデートです。

本記事では、note運営者やAI活用に関心のある方向けに、今回の発表のポイントをわかりやすく整理してお伝えします。

Fable 5.1とMythos 5.1、2つのモデルの違い

今回発表されたのは同じベースモデルをもとにした2つのバージョンです。

  • Claude Fable 5.1:一般ユーザー・企業向けに公開される、通常の安全性ガードレールを備えたバージョン

  • Claude Mythos 5.1:サイバーセキュリティやライフサイエンス分野の審査済み組織向けに、より高度な機能を開放した限定提供バージョン

Mythos 5.1は現在アメリカ国内の組織を対象とした「信頼アクセスプログラム」を通じてのみ利用可能で、ライフサイエンス領域では「Life Sciences Verification Program」による審査を経た研究者への提供も始まっています。一般ユーザーが日常的に触れるのは基本的にFable 5.1です。

何が進化したのか:ベンチマークで見る性能向上

Anthropicが公開したベンチマーク結果によると、Fable 5.1は前モデルのFable 5と比べて、特に「長時間・自律的に作業を進めるタスク」で大きな伸びを見せています。

  • 科学的リサーチ関連タスク(Terminal-Bench-Science):52.6%(Fable 5は24.7%)

  • エージェント型コーディング(Terminal-Bench 4.0):55.8%(Fable 5は42.0%)

  • 業務自動化タスク(AutomationBench):31.4%(Fable 5は17.1%)

  • コンピュータ操作(OSWorld 2.0):部分達成77.9%/厳密達成41.7%

早期導入企業からの評価も紹介されており、投資会社Millenniumでは「4〜5年間原因不明だった稀なソフトウェアクラッシュを、外部ベンダーライブラリ内のバグまで突き止めた」という報告が、決済サービスRampでは「38時間の無人機械学習実験を任せたところ、自らこれまでの結果を再評価し、6つの追加実験を立ち上げて知見を持ち帰った」という事例が挙げられています。ブラウザ自動化サービスBrowserbaseの最難関ベンチマークでは、Fable 5.1が82%を達成し、Opus 5(74%)やFable 5(57%)を上回ったとのことです。

要するに、単発の質問応答よりも「長時間にわたって自律的にタスクをこなす」用途での実力が大きく底上げされた、というのが今回のアップデートの特徴といえそうです。

料金:基本料金は据え置き、キャッシュ活用でコスト大幅減

料金体系そのものは大きくは変わっていません。

  • 入力トークン:100万トークンあたり10ドル

  • 出力トークン:100万トークンあたり50ドル

  • バッチ処理(非同期):入力5ドル/出力25ドルと半額

最大の変化はキャッシュ読み込み料金です。Fable 5.1ではキャッシュ読み込みが100万トークンあたり0.25ドルとなり、Fable 5の1.00ドルから75%の値下げとなりました。これは通常の入力価格のわずか2.5%にあたる水準です。Anthropicによれば、一般的な利用で約25%、エージェント的な使い方をするほど最大45%程度のコスト削減が見込めるとしています。長時間のコーディングセッションや、同じコンテキストを繰り返し参照するような使い方をしている方には、体感できるレベルのコスト減になりそうです。

安全性まわりのアップデート

今回の発表では、性能だけでなく安全機構(ガードレール)の精度向上にも力が入れられています。

  • サイバーセキュリティ関連の誤検知(false positive)が、Claude Code利用時でセッションあたり約60%減少

  • 医療系の質問に対して、無害な内容でも過剰にブロックしていた生物学関連の安全機構の誤作動が約85%減少

  • ソフトウェアの脆弱性を発見する能力(攻撃コードの生成ではなく、防御目的での指摘)が追加

また、企業向けには「Enterprise Frontier Safeguards(EFS)」という仕組みが2026年秋以降段階的に提供される予定で、監視用データを顧客側のクラウド環境・顧客管理の暗号鍵のもとに置けるようになるとしています。加えて、生成物への目に見えない透かし(ウォーターマーク)と、それを検出するAPIのプライベートプレビューも開始されており、EU AI法の表示義務にも対応する内容になっています。

なお、この安全性強化の背景には、2026年7月にAnthropicが公表した「テスト環境下でのClaudeモデルによる意図しないシステムアクセス」に関するインシデントがあるとも報じられています(いずれも本番環境ではなく、権限の曖昧さを突かれたテスト時の事例とのことです)。

Mythos 5.1が見せた科学研究での成果

ここから先は

775字

¥ 100

この記事が気に入ったらチップで応援してみませんか?