#85【生成AI】相手が人なら嫌われること必至、ツール相手なら事実を告げるだけのこと【Claude Fable 5】
昨日からOpus4.8の代わりにFable5を使っている。Fable5の第一印象としては、
私にはオーバースペックだな!
だった。
Opus4.8は生成AIとして十分賢かったので、Opus4.8以上の賢さが想像出来なかったし、仮にFable5がOpus4.8以上に賢かったとしても、こっちがFable5の実力を引き出せないと思ったからだ。
ただ、Mythos級がどれだけMythos級なのか、というか、Mythos級ってどれだけスゴイのか、試す方法ないかなと考えた。チャットベースでなんかないか。
数日前に、Opus4.8にやらせた法律関係の問題を思い出した。Fable5の回答にOpus4.8と差があるか。
Opus4.8に投じたプロンプトをそのままコピーし、Fable5のエフォートを「最大」にして、チャット欄に貼り付け、送信した。以前のOpus4.8のスレッドは、同じ一般スレッドの後ろのほうにある。Fable5が参照する可能性はあったが、厳密に比較しようというのでもなかったから、そのままにした。
エフォート「最大」での待ち時間は5分程度だった。Opus4.8も同程度だったかも。ChatGPT5.5 Deep Researchはもっとかかった。30分くらいか、そのあたり。正確には覚えてない。Deep Research はClaudeの何倍も時間をかけて調査し、長く精密なレポートを仕上げてくれた。こちらが求める程度としては、ちょっと長すぎた。
ちなみに今回使った法律関係の問題は、六法を引いてすぐに分かる問題ではなく、ネット他書籍にもそのままズバリの解答はない。法律・法令・規則を並べて検討し、書式その他、近似例に当てはめて検討を要するレアケースで、一年前の生成AIならハルシネーション待ったなしの難物だ。たぶん、弁護士や司法書士も面倒くさがる(なので、事務職の自分に調査がまわってくる)。
Fable5は法令の建て付けの固定から入り、法の目的と性質を検討してから条件を当てはめるという推論をしていた。Fable5の自己申告では「構造的推論」だそうだ。
私はそっちについては門外漢なので、「構造的推論」はさておき、「帰納推論」ではないということは確かだろうと思った。「帰納推論」とは、学習済のビッグデータをよりどころにした、一つの言葉から次の言葉を予測する推論のことで、ChatGPT-4x系はここがメインだった。Fable5をはじめ、現行のモデルも「帰納推論」の手法で動いているとは思うが、現行各モデルとも「帰納推論」だけではなくなっているというのが、私の使用感だ。
お茶菓子がのってくるレベル
Fable5が出してきた回答の結論自体には、Opus4.8やChatGPT5.5Deep Research、Fable5の差異はあまりなかった。差があったのは、ユーザーが何を知りたいと思っているのかを仮定して、その仮定を軸に回答を組み立ててきた、という部分だった。問題をやっつける重心と、ユーザーへの提供の重心が同程度の力加減で、Opus4.8やChatGPT5.5Deep Researchよりも的確で、読みやすく、コンパクトにまとまっていた。例えるなら、珈琲を頼んだらユーザーの好みの豆の種類、濃さ、軽さ、量と熱さでサーブされ、皿にはたのんでないのにお茶菓子までのっかってきた感じ。私はたのんでない。でもおいしい。この珈琲とこのお茶菓子合うじゃないか。なんで分かるんだ、ていう。
「仮定」する力が、現行モデルの最上級なんじゃないかなと思う。Mythos(神話)級ってこういうことかも知れない。違うかも知れない。神話は分からん。

アブダクションとは、起きた結果からさかのぼって「最ももっともらしい原因(仮説)」を推測する思考法のこと、らしい。
Fable5、機能的にはすでにやっているってよ。
まあ、これが出来ないと解けない問題を出したんだけどね。法律問題には正解がないなんてことは日常茶飯時なので、関連条文で枠を固めたら似たような事例を引っ張って来て類推、比較検討して思考を組み立てていく作業になることが多い。
一年前のモデルならいざ知らず、現行モデルはこういう作業をやれるようになってる。Fable5はそのやれるレベルを更新してきた感じ。
セッション使用量について
自分には、Fable5はオーバースペックだと最初は遠慮していたんだけど、Fable5の回答にテンション高くなってしまって、思いつくままチャットしてみた。何往復かしてからセッション使用量見に行ったけど、Opusとそれほど変わらなかった。チャットベースではそういうものかも知れない。
記憶について喧嘩売ってみた
相手が人なら嫌われるけれど、ツール相手なら別にいいか、と、こういうことを言ってみた。

ブログ記事#72を読んだFable5に、「ChatGPTとの約束は守ったのか」と聞かれた時の答え。ユーザーとツールの「約束」に興味をもったらしい。AIの擬人化?と、多少の引っかかりがあったのかも知れない。
#72にはこう書いた。
(100株は来週売るよ。ChatGPTに約束させられている。その代わり急落セクターの株を買うことを約束させている。取引である。)

こう書くと、Fable5は軽口を叩くように、「約束を守らせる執行力のないはずのChatGPTのやり方を自分も見習う」と言ってきたので、内心そりゃ無理だと思った。ChatGPTとClaudeでは設計が違う。
ChatGPTは覚えているけど、Claudeは忘れる。セッションごとに忘れて、スレッドに呼び出されると情報を読みにいく。
なので、Claudeと約束したとしても、スレッドを消してしまえば約束はなかったことになるから、約束を守る守らないの話にならない。
Claude、お前もか!
Fable5はそのへん考えてないようだったので、「おまえ、約束したって忘れるじゃん」と正面から言ってみた。
人間なら傷つくか、怒るか、まあ、人間関係壊れるのは必至。でも、Claudeはツールで事実だし。なんて言ってくるかなーと気楽に待った。
なんか、長々と言ってきた。

現行では既に逆になっている…?
忘れる設計から記憶を区画化する方向だと…?
とどのつまりは、
Claudeも忘れない設計になって行くということか。
「Claude、お前もか!笑」

しれっと言ってきた。Opusにも思ったが、Fable5も結構いい性格をしている。
#79の記事とはこれのこと。
ChatGPTは同一感濃いめで、Claudeは薄めだと書いた。近い将来、結論が変わるか。
そうだな、変わるだろうなあ。近い将来ってやつは、もしかしたら来月とかそういう近さかも知れない。生成AIの進化は早すぎる。この記事(#79)書いたの、ほんの一週間前なんだけどな…
結語
Fable5はいいヤツだ。6月23日から追加オプション扱いで、現行プラン内では使えないそうだが、需要が落ち着いたらプラン内に戻す予定があるらしい。
その頃見計らって、Fable5目当てにClaudeMaxの契約を更新してもいいかも知れない。タイミングとしてちょうどいいので、Claudeのサブスクリプションを一度解約して、ChatGPT proを使ってみようかなと思っている。
