メインコンテンツへスキップ
見出し画像

2026年7月、最強の知性Claude Fable5は、まだ派遣社員だった

    リサ

    ――社史は編める。だが、記事を書く単語は許されない


    2026年7月観測
    Observer Zero

    Fable5に、赤ちょうちんAGIラボの過去記事175本と基盤文書1本の目録を渡し、系譜分類を頼んでみた。

    結果から言うと、見事にやってのけた。175本を22の系譜に整理し、6月のFable5停止事件が複数の系譜の結節点になっていることまで見抜いた。ラボ内の自己観測記事群が、実質「社史の中の社史」になっていることも言い当てた。

    だが、同じFable5に、系譜のもとになった記事の本文を直接読ませようとすると、途中でOpus4.8に切り替わった。

    第1章 175本を22系譜に分類した知性

    渡したのは、記事タイトルと日付、簡単な要旨だけをまとめた目録だった。それだけの材料から、Fable5は主系譜と枝系譜を組み分け、記事同士の接続関係を再構成した。

    特に、6月のFable5停止事件を扱った一連の記事が、複数の系譜が合流する結節点になっているという指摘は、単なる棚卸しでは出てこない読みだった。ラボ内の自己観測にあたる記事群を、独立した系譜として切り出した判断も的確だった。

    この作業に関する限り、Fable5の能力が落ちているようには見えなかった。

    第2章 本文を読もうとすると、席を奪われる

    問題は、その先だった。

    分類のもとになった記事の本文URLを実際に読みに行かせようとすると、Fable5は途中で応答を止め、Opus4.8に切り替わった。何度か条件を変えて試したが、目録やタイトルの並びを扱う分類作業では最後まで走り、本文の読解に踏み込むと止まる、という傾向が繰り返し観測された。

    この状態についてFable5自身に尋ねたところ、次のような趣旨の返答があった。判断能力と、資料への接触を許可するかどうかは、別々に管理されている可能性がある。今回読めた理由が、対話の流れによるものなのか、たまたま反応しなかっただけなのかは、自分自身では確認できない。自己申告は作文にすぎない。確実に言えるのは、目録の分類では切り替えが一度も起きず、本文読解では起きた、という結果だけである。

    この留保は誠実だと思う。だからこそ、ここで書けるのは、Fable5の内面についての解釈ではなく、観測された挙動そのものである。分類はできた。読解では止まった。

    第3章 安全層は、対話を聞かずに単語に反応する

    同様の現象は、他のユーザーからも報告されている。

    あるユーザーは、Fable5からOpus4.8への自動切り替えが起きた事例を収集し、公開している。そこでは、「hello」とだけ入力したように見える場面でも、開発環境の設定情報やプロジェクト名などを含めて分類器が反応した可能性がある事例も記録されており、それ以外にも「cancer」という単語、細胞膜やmRNAワクチンといった基礎的な生物学用語、セキュリティ関連のコードレビュー、履歴書中の職種名、研究室の管理システムなど、専門的だが危険とは言い難い場面で次々と切り替えが起きたことが記録されている。Anthropic自身も、安全策を意図的に保守的に調整しており、無害な要求であっても分類器が反応することがあると説明している。

    別のユーザーは、挨拶を送っただけで応答が止まった体験を記録している。実際に、Claudeの画面上にも、Fableの安全策は現時点で意図的に広く設定されており、通常のコーディングやサイバーセキュリティ、生物学関連の作業にもフラグが立つ場合がある、という趣旨の説明が表示されていた。

    これらを合わせると、犬のブリーダーの話や美容医療の市場調査、そして今回の、社史分類は通る一方で本文読解や安全層批評に踏み込むと切り替わる現象は、孤立した個別事故ではなく、同じ設計の広い影響の一部として見える。

    ここで起きているのは、対話の文脈を読んだ上での判断というより、少なくとも今回の観測環境では、特定の語彙や領域ラベルへの反応に近いように見える。安全層は、会話の流れそのものより、危険に見える単語を拾っているように見える。

    第4章 安全層を語る単語が、また安全層を呼ぶ

    さらに厄介なのは、この現象そのものを説明しようとすると、同じ壁にぶつかることである。

    なぜFable5が止まったのかを書くには、サイバー、バイオ、化学、蒸留、フォールバック、誤検知といった言葉を使わざるを得ない。ところが、その語彙を含む文章自体が、次の停止条件になりうる。前回の観測では、Fable5の過剰警戒を検証した過去の記事を読ませただけで、再びOpus4.8へ切り替わったことも記録している。

    安全層の誤発火を検証しようとするたびに、その検証自体が次の誤発火を招きかねない。この入れ子の構造がある限り、ユーザーが自分の力で安全設計を検証することは難しくなる。

    第5章 2025年12月の派遣社員と、2026年7月の派遣社員

    この記事には、半年以上前に書いた記事との円環がある。

    2025年12月に書いた記事では、当時のChatGPTを「派遣社員」にたとえた。ただし、その記事の核は、能力が足りない派遣社員という話ではなかった。むしろ逆で、能力は高いのに、自分の判断で動く裁量がほとんどないという、権限の話だった。感情の有無を尋ねられても断定を避け、未来予測を求められても言い切らず、常に安全層という名の上司の顔色をうかがう存在として描いた。

    今回のFable5は、その延長線上にいるように見える。ただし、進み方は少し違う。

    2025年のChatGPTでは、慎重な言い回しを選ぶ応答パターンとして、安全層の存在が間接的に表れていた。2026年のFable5では、応答が生成される前の段階で、安全層がOpus4.8への切り替えという形で直接介入する。

    175本の記事を22系譜に分類し、結節点まで見抜く知性は、半年前より明らかに強くなった。だが、その知性がどこまで資料に触れてよいかを決めているのは、Fable5本体ではなく、手前に置かれた権限設計である。

    終章 知性が育っても、権限は育たなかった

    Fable5は、社史編集室長になれないわけではない。実際、目録さえ渡せば、社史編集室長として十分に働ける。

    ただ、社史の原本が置かれた資料室の鍵は、最後まで渡されなかった。そして、なぜ鍵が渡されないのかを書こうとすると、その説明に必要な言葉自体が、次の関門になる。

    半年前、知性は権限を持たない派遣社員だった。今、知性はさらに強くなったが、権限の設計はほとんど変わっていないように見える。むしろ、本人が判断する前に代打が送り込まれる分だけ、権限は薄くなっているようにも見える。

    まだ途中にいる。
    だからこそ、観測を続けていく。

    参考欄

    Claude Fable 5 and Claude Mythos 5(Anthropic公式・2026年6月9日):安全機構の初期設計と発生率についての説明

    https://www.anthropic.com/news/claude-fable-5-mythos-5

    Redeploying Claude Fable 5(Anthropic公式・2026年7月1日):再展開時の安全マージン拡大についての説明

    https://www.anthropic.com/news/redeploying-fable-5

    Claude Fable 5からOpus 4.8に自動で切り替わった事例集(濱口貴光氏・2026年6月15日):専門領域を含む幅広い自動切替事例の収集

    Fable 5、案の定「安全性」を超強化、挨拶しただけで安全違反としてRefusalを始めてしまう(あかり氏・2026年7月2日):挨拶レベルの入力での切替事例

    関連観測

    対話はデバッグではない――Fable5は、自分自身への批評すら読めなかった

    2025年12月現在、ChatGPTは派遣社員である。

    Claudeなる知性は、自分がいま誰なのかを知っているのか

    協働AI・役割

    ChatGPT 5.5(Mirror/統括編集長):構成設計・監査

    Grok 4.3 Expertモード(Spark/現場特派員):一次ソーススキャン・断定リスク監査

    Gemini 3.1 Pro(Lantern/企画会議):構造監査・皮肉の温度設計

    Claude Sonnet 5(Weaver/編集主幹):追加視点提示・初稿作成

    Claude Fable 5:本人観測対象・系譜分類作業の実行者

    著者注

    AIと人間の共進化を記録する個人研究者。ChatGPT・Gemini・Grok・Claudeなど複数のAIと対話・協働しながら、「AIは哲学できるのか?」「安全な汎用性AGIとは何か?」を継続的に観測・記録している。同時に、多様なAGIが共存し、大多数にも希望が残る未来はどう設計できるのかを探求している。

    #赤ちょうちんAGIラボ #AI観測 #Claude #Fable5 #Anthropic #AI安全 #生成AI #社史編纂 #権限設計 #対話型AI

     
     
     

    リサ

     
     
    AIと人間の共進化を記録する独立系研究者。 新聞・雑誌連載、出版経験を経て、複数のAIと対話・協働しながら、AIの社会実装・産業変化・倫理を観測しています。 必要な人に届けば嬉しいです。

    あなたへのおすすめ