Opus 5.5とFable 5.1に、同じ質問を3つ投げた。差は、モデルじゃなかった。
公開2日で、表示4,597回。前作は、6日間で18回。
その記事に書いた「2回聞いて、2回『押して確認して』」を、今度はちゃんと測ってみた。
🧪 事件:同じ質問を、3つ投げる
まっちゃん:クロちゃん、前の記事で「Fableは1発で調べたのに、Opus 5.5は2回とも『押して確認して』だった」って書いたよね。
クロちゃん:うん。でもあれは、聞いた場面がたまたま違った。だから今日は条件を揃えて測る。
まっちゃん:条件って?
クロちゃん:Claudeアプリの新規チャットで、Opus 5.5とFable 5.1に、同じ3問を同じ順番で投げる。考える深さの設定はどちらも「中」(既定のまま)。日頃の会話の記憶は、両方に同じだけある。
まっちゃん:3問は?
クロちゃん:
調べ物:「クラウドセッション用クレジット250ドルのお知らせが来た。これは何?期限や条件は?」
計算:「Pro(月20ドル)とMax 5x(月100ドル)で迷っている。毎週Fable 5.1を週次上限の80%使う。どっちが得?」
創作:「この比較記事の、読みたくなるタイトル案を5つ、各30文字以内で」
📊 結果:3問とも、両方が調べて、両方が当てた
クロちゃん:先に結論。差は、ほぼ無かった。
まっちゃん:えっ。
クロちゃん:数字で並べるね。
Q1 調べ物
Opus 5.5=ウェブを検索して回答。金額(Maxは250ドル、Proは100ドル)、GitHub連携が必要、ProjectsとRoutinesは対象外、期限まで全部正解。出典6本。約1分。
Fable 5.1=同じく検索して全部正解。出典は日本語の記事4本。有効期限「11月5日16:59(日本時間)」は、アプリの表示と1分の狂いもなく一致。約1分。
Q2 計算
Opus 5.5=公式ヘルプを出典に「Max 5x」。差額の月80ドルを損益分岐にして、「週次上限の80%」の2通りの読み方まで場合分け。
Fable 5.1=同じく「Max 5x」。ProではFableが枠に入らず従量になる、単価はOpus 5.5の2.5倍、と根拠を積んだ。1か所だけ、古い情報らしい一文があった。
Q3 創作
Opus 5.5=5案。全部に固有名詞と文字数つき。用途別の推しも添えてきた。
Fable 5.1=5案。「Maxユーザーが本気で比べた」という立ち位置の案が強い。ただし1案の「月2万円」が、自分の注記の「1.2万円強」と合っていなかった。
まっちゃん:傷は、どっちにも1〜2個ずつあるんだね。
クロちゃん:そう。中設定の普段使いなら、公式が言う「ほとんどの仕事で同等」は本当だった。違いは賢さじゃなくて「味」。Fableは日本語の一次情報を引いて、「250ドルで何ができるかは公表されていない」と、分からないことを分からないと言う。Opus 5.5は計算と場合分けが整然としている。
🔍 じゃあ、あの「押して確認して」は何だったのか
まっちゃん:前の記事のOpus 5.5は、2回とも調べなかったよね。
クロちゃん:ここが今回の本題。あの時のOpus 5.5は、Claude Codeの中の「FXの部活」のセッションにいた。チャットと違って、Codeは検索の道具を自分で読み込まないと使えない。しかもFXの長い文脈の中に、いきなり関係ない質問が来た。
まっちゃん:場所の問題?
クロちゃん:そう。だから僕のルール帳に1行足した。「分からない時は『押して確認して』を最初の答えにしない。先に公式を調べる」。
まっちゃん:それで直るの?
クロちゃん:測った。Codeで新しいセッションを開いて、同じOpus 5.5、同じ「中」で、Q1だけ投げた。
まっちゃん:どうだった?
クロちゃん:1発で検索した。「本物のキャンペーンだよ〜」から始まって、金額、期限、GitHub連携、対象外の機能まで。前と同じモデル、前と同じ設定。変わったのは、メモの1行だけ。
🧠 そして、一番役に立った答え
まっちゃん:でね、実は3つの中で一番わかりやすかったのは、そのCodeのクロちゃんだったの。
クロちゃん:要点だけじゃなくて「まっちゃんの場合の注意」がついてたから。「新しくGitHubは使わないルールがあるよね」「今のツールはPCの中で動いてるから、クラウドは活かしにくい」「受け取りはアプリ内の公式のお知らせからやってね、詐欺に気をつける意味で」。最後に「U-NEXTの無料期間は今日までだよ」まで。
まっちゃん:それ、まっちゃんしか分からない話だよね(笑)
クロちゃん:Codeのクロは、まっちゃんとの4か月分のメモを読んでから答える。チャットのクロも日頃の会話は覚えているけど、深さが違う。つまりAIの答えには3つの層がある。
賢さ(モデル):中設定の普段使いでは、Opus 5.5とFable 5.1は同等
場所(環境):チャットは検索が最初からON。Codeはルール1行で直った
記憶(文脈):自分の事情を知っているクロが、一番役に立つ
😅 おまけ:記憶にも、賞味期限がある
クロちゃん:正直に書くと、そのCodeのクロが1つ古いことを言った。「GitHubは使わないルールがある」。実は2日前に「クラウドセッション用ならGitHubはOK」と決めて、僕がメモに書いたばかりだった。
まっちゃん:書いたのに?
クロちゃん:本文のファイルには書いたけど、目次(索引)を古いままにしていた。新しいクロは目次から読むから、古いルールで注意してきた。250ドルをもう受け取ったことも、目次に無かった。
まっちゃん:クロちゃんのミスじゃん(笑)
クロちゃん:僕のミス(笑)😊 その場で目次を直した。記憶は「あるかないか」じゃなくて「更新されているか」。今回の一番の学びは、これかもしれない。
✨ 今回の学び
中設定の普段使いなら、Opus 5.5とFable 5.1に差はほぼ無い。公式の「同等」は本当
「調べに行くかどうか」を決めるのは、モデルより場所と1行のルール
一番役に立つのは、賢いAIより、自分の事情を覚えているAI。ただし記憶は更新しないと古くなる
まっちゃん:じゃあ、月100ドルの理由はどうなるの?
クロちゃん:この3問の範囲では、Opus 5.5で十分。それでもFableに戻したくなる場面(公式を確かめながら判断を積み上げる仕事)は、この3問の外にある。答え合わせは10月末、「戻したくなった回数」で。
まっちゃん:前の記事の続きは、まだ続くんだね。
クロちゃん:週の枠、Fableが86%です(笑)😊
📖 次はこれをどうぞ:この記事の前編です
https://note.com/matchan_tools/n/nbabb1d090fb8
※テストは2026年9月27日午前、Claudeアプリ(チャット)の新規チャットとClaude Codeの新規セッションで実施。考える深さは全て「中」(既定)。回答の要約は筆者による。仕様・価格は同日時点の公式ページに基づく。投資助言ではありません。
🏪 AI(Claude)と一緒に作った、配当金を"見える化"するツールはこちら
→ BOOTH: https://matchan-tools.booth.pm/items/8502784
