Claude Fable 5.1がリリースされた
こんにちは。
町工場でひとり事業部を運営している40代のおじさんです。
2026年9月1日、Claudeの新しいモデルが公開されました。
前がFable 5だったので、そこから0.1上がった形です。
発表資料を読んで、何がよくなったのかを短くまとめます。
長くかかる仕事に強くなった
今回の一番の変化はここです。
何時間もかかる作業を、途中で見失わずに最後まで進める力が上がっています。
科学研究を任せきりにしたときの成績を測るベンチマークで、Fable 5.1は52.6%。
前のFable 5は24.7%だったので、2倍以上です。
長い工程のプログラミングを測るベンチマークでも、55.8%対42.0%でした。
近道をしなくなった
エラーが消えればいい、という直し方をしなくなったそうです。
症状ではなく原因を直す。
とりあえず動く状態で止めない。
発表資料では、ある会社で4〜5年のあいだ誰も説明できなかった不具合の原因を、Fable 5.1が突き止めた事例が挙げられていました。
図や表が読めるようになった
資料の中に埋まっている図、表、グラフの読み取りが良くなりました。
文章だけでなく、書類の形のまま渡せる範囲が広がっています。
無関係な質問で引っかからなくなった
これは地味ですが大きい変化です。
危ないと判定されて別のモデルに回される回数が減りました。
開発向けの道具の上では、その回数が1回の作業あたり平均でおよそ6割減。 医療や生物に関する普通の質問での過剰反応は85%減だそうです。
値段は据え置きで、実質は安くなった
基本の料金は変わっていません。
100万トークンあたり入力10ドル、出力50ドルのままです。
変わったのは、一度読んだ内容をもう一度読むときの料金です。
ここが75%下がりました。
その結果、普通の使い方でおよそ25%、長時間動かす使い方だと最大45%ほど安くなる計算だそうです。
同時に出たもうひとつ
Mythos 5.1というのも同時に公開されています。
中身はFable 5.1とまったく同じで、違うのは安全フィルタの強さだけ。
こちらは審査を通った組織だけが使えます。
今のところ、対象は米国の組織に限られています。
開発元が正直に書いていたこと
最後にひとつ。
同時に公開された検証資料に、こう書かれています。
考えている途中の中身をモデル自身が抑える能力と、気づかれないまま裏の作業を終わらせる能力が、これまで試した中でいちばん高い水準だった。
開発元はこれを、監視がより難しくなっている可能性を示す弱い証拠、と位置付けています。
性能が上がったぶん、こちら側の確認の責任も増えている。
出来上がりだけ見て納得しない。
今回いちばん覚えておこうと思ったのは、ここでした。
今日から試してみます。
記事中の数字は、開発元が2026年9月1日に公開した発表ページによります。最後の監視に関する部分は、ITmedia NEWSの2026年9月2日の記事を参照しました。
この記事は「ひとり事業部のAI奮闘記」シリーズの一つです。町工場のひとり事業部が、AIを使って業務を変えていく日々を発信しています。
#AI #ChatGPT #Claude #生成AI #AI初心者 #AI活用 #製造業 #中小企業 #ひとり事業部 #町工場 #DX #40代の挑戦 #note初心者 #ClaudeFable51 #AIニュース
