見出し画像

Claude Fable 5.1がリリースされた

こんにちは。
町工場でひとり事業部を運営している40代のおじさんです。

2026年9月1日、Claudeの新しいモデルが公開されました。
前がFable 5だったので、そこから0.1上がった形です。

発表資料を読んで、何がよくなったのかを短くまとめます。

長くかかる仕事に強くなった

今回の一番の変化はここです。

何時間もかかる作業を、途中で見失わずに最後まで進める力が上がっています。

科学研究を任せきりにしたときの成績を測るベンチマークで、Fable 5.1は52.6%。
前のFable 5は24.7%だったので、2倍以上です。

長い工程のプログラミングを測るベンチマークでも、55.8%対42.0%でした。

近道をしなくなった

エラーが消えればいい、という直し方をしなくなったそうです。

症状ではなく原因を直す。
とりあえず動く状態で止めない。

発表資料では、ある会社で4〜5年のあいだ誰も説明できなかった不具合の原因を、Fable 5.1が突き止めた事例が挙げられていました。

図や表が読めるようになった

資料の中に埋まっている図、表、グラフの読み取りが良くなりました。

文章だけでなく、書類の形のまま渡せる範囲が広がっています。

無関係な質問で引っかからなくなった

これは地味ですが大きい変化です。

危ないと判定されて別のモデルに回される回数が減りました。

開発向けの道具の上では、その回数が1回の作業あたり平均でおよそ6割減。 医療や生物に関する普通の質問での過剰反応は85%減だそうです。

値段は据え置きで、実質は安くなった

基本の料金は変わっていません。
100万トークンあたり入力10ドル、出力50ドルのままです。

変わったのは、一度読んだ内容をもう一度読むときの料金です。
ここが75%下がりました。

その結果、普通の使い方でおよそ25%、長時間動かす使い方だと最大45%ほど安くなる計算だそうです。

同時に出たもうひとつ

Mythos 5.1というのも同時に公開されています。

中身はFable 5.1とまったく同じで、違うのは安全フィルタの強さだけ。
こちらは審査を通った組織だけが使えます。
今のところ、対象は米国の組織に限られています。

開発元が正直に書いていたこと

最後にひとつ。

同時に公開された検証資料に、こう書かれています。

考えている途中の中身をモデル自身が抑える能力と、気づかれないまま裏の作業を終わらせる能力が、これまで試した中でいちばん高い水準だった。

開発元はこれを、監視がより難しくなっている可能性を示す弱い証拠、と位置付けています。

性能が上がったぶん、こちら側の確認の責任も増えている。

出来上がりだけ見て納得しない。
今回いちばん覚えておこうと思ったのは、ここでした。

今日から試してみます。

記事中の数字は、開発元が2026年9月1日に公開した発表ページによります。最後の監視に関する部分は、ITmedia NEWSの2026年9月2日の記事を参照しました。

この記事は「ひとり事業部のAI奮闘記」シリーズの一つです。町工場のひとり事業部が、AIを使って業務を変えていく日々を発信しています。

#AI #ChatGPT #Claude #生成AI #AI初心者 #AI活用 #製造業 #中小企業 #ひとり事業部 #町工場 #DX #40代の挑戦 #note初心者 #ClaudeFable51 #AIニュース

いいなと思ったら応援しよう!