見出し画像

Claude Opus 5.5 の概要

「Claude Opus 5.5」の概要をまとめました。


1. Claude Opus 5.5

2026年9月22日、Anthropicは新モデル「Claude Opus 5.5」を発表しました。

Claude 5.5ファミリーの最初のモデルで、前世代の「Claude Opus 5」から、コーディング、AIエージェント、知識労働、Computer Useなどが大きく強化されています。

今回のポイントは、単純な性能向上だけではありません。

・Fable 5.1クラスの性能
・Opus 5からAPI単価を20%値下げ
・Prompt Cacheはさらに大幅値下げ
・より少ないステップでエージェントタスクを完了
・出力速度も30%以上高速化

Anthropicは、Opus 5.5について「多くの仕事でClaude Fable 5.1と同等の性能」と説明しています。つまり、これまで最上位クラスだったFable級の性能が、通常のOpusに近い価格帯まで降りてきたモデルと見ることができます。

さらに、典型的なワークロードではOpus 5より約40%低い実行コストになるとしています。

2. 性能

2-1. 総合性能

第三者評価の「Artificial Analysis Intelligence Index」では、Opus 5.5のmax effortが58点を記録し、評価時点でトップになりました。
GPT-6 AstraやClaude Fable 5.1など、それまで最上位だったモデルを総合スコアで上回っています。

10種類の評価のうち、

・Humanity's Last Exam
・SciCode
・GDPval-AA
・AA-Briefcase
・AA-Omniscience
・AutomationBench-AA

の6種類で首位のスコアを記録しています。

一方で、CritPt、AA-LCR、GDP.pdfなど、他モデルが上回る評価もあります。そのため、「すべての用途で最強」というより、総合性能ではトップクラスになったものの、用途によってモデルごとの得意不得意は残っていると考えるのがよさそうです。

2-2. Agentic Coding

Opus 5.5で特に強化されたのが、長時間のコーディングやAIエージェントです。

単純なコード生成だけでなく、

・大規模コードベースの調査
・複数ファイルの修正
・コードベース全体の移行
・長時間のデバッグ
・コードレビュー
・サブエージェントを使った並列作業

などを想定しています。

Anthropicが紹介した事例では、68万行のコード移行を1日未満で完了しました。また、20万行規模のコードベースの監査・修正では、Opus 5が20時間以上かかった処理を、Opus 5.5は3時間未満で完了したとしています。

2-3. 少ないステップで処理

AIエージェントでは、

考える → Toolを呼ぶ → 結果を確認 → 次の処理を考える

という処理を何度も繰り返します。

Opus 5.5では、この繰り返し自体も効率化されています。

GitHubによる評価では、VS Code上のターミナルタスクをOpus 5より多く解決しながら、必要なステップ数を半分以下に抑えたケースも報告されています。
Claude Codeのようなエージェントでは、モデルのトークン単価だけでなく、Tool Callや推論回数も実行時間と料金に影響します。

そのため、少ないステップで同じ仕事を終えられることも、Opus 5.5の重要な改善点です。

2-4. 知識労働

プログラミング以外の「Knowledge Work」も強化されています。

たとえば、

・企業調査
・財務分析
・大量データの収集・分析
・レポート作成
・Excelによる財務モデル作成
・プレゼンテーション作成

などです。

Artificial Analysisの「AA-Briefcase」でも高い性能を示しており、コーディングだけでなく、AIエージェントを使った実務全般を強く意識したモデルになっています。

3. 料金

Opus 5.5では、性能が大きく向上した一方で、API料金はOpus 5より安くなっています。

100万トークンあたりの料金は、

・入力 : $5 → $4
・出力 : $25 → $20
・Cache Read : $0.50 → $0.20

です。

通常の入力・出力料金は20%値下げ、Cache Readは60%値下げされています。特にPrompt Cacheでは、通常の入力料金$4に対してCache Readは$0.20なので、キャッシュがヒットした部分は通常入力の20分の1の料金になります。

Claude Codeのように、同じコードベースや長いコンテキストを繰り返し参照するAIエージェントでは大きな差になります。

Anthropicによると、デフォルト設定の典型的なワークロードでは、Opus 5より実行コストを約40%削減できるとしています。

ただし、Opus 5.5には、

low / medium / high / xhigh / max

のeffort設定があり、推論量を増やせば使用トークン数や実際のコストも増えるため、「常に40%安い」という意味ではありません。

性能だけを見ると大幅な世代更新ですが、価格まで下がっているのが今回のOpus 5.5の大きな特徴です。

3-1. Fast Mode

さらに「Fast Mode」も用意されています。

最大で通常の2.5倍の速度で生成でき、料金は、

・入力 : $8 / 100万トークン
・出力 : $40 / 100万トークン

です。

通常モードの約2倍の料金になりますが、エージェントやコーディングなどで待ち時間を減らしたい場合に利用できます。

4. その他の改善

4-1. 文章表現

Opus 5.5では文章表現も改善されています。

Anthropicによると、Opus 5で指摘されていた冗長さを減らし、

・重要な情報を先に提示
・不要な専門用語を減らす
・独特な言い回しを減らす
・ユーザーの文章ルールに従いやすくする

といった調整が行われています。

コード生成だけでなく、調査結果の報告、設計説明、コードレビュー、ドキュメント作成などにも関係する改善です。

4-2. 安全性

Anthropicの「Automated Behavioral Audit」でも、Opus 5から改善が確認されています。

プロンプトインジェクションや、指示された境界を越える操作、取り返しのつきにくい操作などに対する対策も強化されています。

ただしAnthropic自身も、評価環境での結果がすべての実環境での挙動を保証するものではないと説明しています。

5. 利用方法

Claude Opus 5.5は、

・Claude.ai
・Claude Code
・Claude Platform / Claude API
・Amazon Web Services
・Google Cloud
・Microsoft Azure

などから利用できます。

Claude APIでのモデルIDは、

claude-opus-5-5

です。

今回のOpus 5.5は、単に「Opus 5より少し性能が上がったモデル」というより、Fable 5.1クラスの性能を、より高速かつ安価に使えるようにしたモデルという位置づけが分かりやすそうです。

特に、Claude Codeをはじめとする長時間のAIエージェント処理では、モデル性能の向上、トークン単価の値下げ、Prompt Cacheの値下げ、必要ステップ数の削減が同時に効いてきます。

Opus 5から見ると、性能とコストの両方が大きく改善したアップデートになっています。



いいなと思ったら応援しよう!