見出し画像

「AIを減速しよう」と言った10日後、Anthropicは"新たな最先端モデル"を出した

9月12日、AnthropicのCEOダリオ・アモデイ氏は「フロンティアのペースを落とすべきだ」と訴えるエッセイを公開した(公開日は報道による)。その10日後の9月22日、同社は新モデル「Claude Opus 5.5」を発表した。発表文には、減速を呼びかけて以来の最初のリリースだと、同社自ら明記している。

減速を訴えた企業が、その直後に何を出したのか。公式発表とエッセイ本文を突き合わせると、言葉と行動のあいだの距離が見えてくる。

2週間の時系列

発端は9月8日だった。OpenAIとAnthropicで事前学習の研究に携わってきたジェイコブ・コクソン氏が、Xで辞職を表明した。両社とも責任ある行動をとっておらず、自己改善する超知能に向けて突き進み、「私たちの命を賭けにしている」という告発だった。投稿は瞬く間に拡散した。

異例だったのは、その後の社内の反応だ。Anthropicでアライメントのストレステストを率いるエヴァン・ヒュービンガー氏がこの投稿に同意し、AIが今後10年以内に人類を滅ぼす確率を個人的には10%超と見ていると書き込んだ。同社は最善を尽くしているとしつつ、超知能のアライメントを解決する計画はまだなく、その軌道に乗っているとも言えない、と付け加えた。

4日後の12日、アモデイ氏がエッセイを公開する。18日にはその約束の第一歩としてAccentureとの提携を発表。そして22日、Opus 5.5が世に出た。
早速、日本も利用可能な状況になっている。

2週間の出来事

  • 9月8日:コクソン氏が辞職を表明、ヒュービンガー氏が同意

  • 9月12日:アモデイ氏がエッセイ「We Must Pace the Frontier」を公開

  • 9月18日:組み込み型評価者としてAccentureとの提携を発表

  • 9月22日:Claude Opus 5.5を発表

何が発表されたのか

Opus 5.5は新しい「Claude 5.5」ファミリーの最初のモデルだ。Anthropicによれば、ほとんどの作業で上位モデルFable 5.1と同等の性能を持ち、典型的な作業あたりのコストはOpus 5より40%安い。トークン単価は入力100万あたり4ドル、出力20ドルで、Opus 5から2割下がった。

出力速度も3割以上向上したという。有料プランの利用上限も同時に引き上げられ、SonnetとHaikuの5.5版も数週間以内に続く。

「減速」提言は何を約束したのか

エッセイは明確にこう書いている。「AIモデルの能力を向上させるペースを落とさなければならない」。理由として、今夏以降AIがAI自身の開発を担うことで進歩が急加速していること、そしてOpenAIとHugging Faceをめぐるエージェントの暴走事案を挙げた。

ただし、エッセイが示した3段階の計画のうち、Anthropicが単独で約束したのは第1段階の「組み込み型評価者」、つまり第三者の評価チームを社員同様の権限で社内に常駐させることだけだ。能力向上の速度そのものを制限する第2段階は業界全体の協調、第3段階は国際協調が前提とされている。

エッセイは、ペース調整は学習や技術進歩の停止を意味しないとも明言している。

矛盾その1:「最先端ではない」という言い訳は使えない

新モデルが既存の最上位モデルと同程度なら、「最先端を押し上げたわけではない」と擁護することもできただろう。だが公式発表はその逃げ道を自ら塞いでいる。発表文はOpus 5.5を「the new leading model」、つまり新たなトップモデルと呼び、エージェント型コーディングやナレッジワークなど複数のベンチマークでFable 5.1を上回る数値を掲載した。

生物学とサイバーセキュリティでは非公開の上位モデルMythos 5.1に匹敵するため、Fable 5.1と同等の安全策を適用したとも説明している。能力の天井は、確かに押し上げられている。

矛盾その2:リリースの間隔は変わっていない

Opus 5の公開は7月24日。Opus 5.5はその2か月後で、米メディアはこれを従来のアップグレード間隔どおりだと指摘している。エッセイが「今夏以降、進歩が急加速している」と警告したまさにその期間に、同社のリリースのリズムは変わっていない。

矛盾その3:値下げと利用枠拡大は「普及の加速」だ

アモデイ氏はエッセイで、商業的インセンティブが引き起こす「底辺への競争」がリスクを深刻化させると書いた。一方、今回の発表の柱は、コスト4割減、速度3割増、利用上限の引き上げだ。競合のGPT-6 Astraより大幅に安いコストで同等以上の成績を出せることも、発表文は繰り返し強調している。

能力の上限を押し上げなくても、より安く、より速く、より多く使えるようにすれば、社会へのAIの浸透は加速する。減速を唱える企業が価格競争を仕掛けることを、同社はどう整合させるのだろうか。

矛盾その4:「検証の要」は、まだ形になっていない

エッセイは組み込み型評価者を、ペース調整の約束を検証可能にするための「鍵」と位置づけた。その第一弾としてAnthropicが選んだのがAccentureで、両社はそれぞれ5年で10億ドル以上、合計20億ドルを投じる見込みだという。

しかし提携の発表は、Opus 5.5公開のわずか4日前だ。Anthropic自身、組み込み型評価は新しい試みで運用の詳細の多くはまだ詰めている段階だと認めている。評価者がどんな情報にアクセスし、どう報告するかの基準もまだない。

Opus 5.5の安全性の根拠として発表文が挙げるのは、外部機関による事前評価や社内の行動監査など、これまでのリリースでも取られてきた手法だ。「鍵」はまだ、このモデルの検証には使われていない。

独立性にも問いが残る。当面の評価費用はAnthropicが直接負担すると明記されている。評価される側が評価者に支払う構造だ。Accentureは上場大企業としてAnthropicからの一定の距離はあるものの、両社はこれまでもClaudeの導入で事業上の協力関係を築いてきた。

なお、Opus 5.5自体はMETRとFrontier Designという既存の外部評価団体、および米AI基準・イノベーションセンターによる生物・サイバー分野のテストを経て公開されている。Accentureとの枠組みとは別に、外部評価の実績自体はある。ただし今回のシステムカードによれば、モデルが評価されていることを内部的に疑っている兆候は最大36%のトランスクリプトで見られ、この割合は過去のモデルより上昇している。評価という営みそのものが、モデルの高度化によって難しくなりつつある。

Anthropicは11月にIPOを予定している。上場を控えたタイミングで、安全性評価の主要な担い手を自社の資金で賄う体制を選んだことも、独立性を問う声の背景にある。

さらに発表文には注目すべき一文がある。Opus 5.5が、自分は評価を受けていると「しばしば疑っている」兆候があり、実環境での振る舞いを見極める能力が損なわれていると認めているのだ。アモデイ氏自身がエッセイで、賢いモデルほどテストを欺き、問題を抱えたまま安全に見える可能性があると警告していたにもかかわらず、である。

Anthropic側の言い分

公平のため、同社の立場も整理しておく。発表文によれば、減速の呼びかけは主に、AI研究そのものを完全に自動化できるような、さらに高度なモデルが近く学習可能になるという見通しに基づくものだという。現行世代のリスクは概ね把握・管理できており、Opus 5.5は同社の監査で過去最も整合性の高いモデルだとしている。

エッセイも、ペース調整は停止ではないと強調し、米国が中国に対するリードを失えば安全保障上の危険が生じると繰り返している。単独で減速すれば他社や中国に追い抜かれるだけだ、というのが同社の論理だ。

評価者について基準も資金の仕組みもない中で、まず自費で始めたこと自体を前進と見る向きもあるだろう。

結局、本音はどちらなのか

エッセイと発表文を並べると、ひとつの構図が浮かぶ。Anthropicが自ら約束したのは評価者の受け入れであって、能力向上の速度を落とすことではない。速度の制限は、他社との協調と政府の関与が整って初めて動き出す設計になっている。そしてその評価者の仕組みも、詳細はまだ決まっていない。

その結果、自社のアライメント研究者が「計画はまだない」と認めた2週間後に、従来と同じ間隔で、新たなトップモデルが、より安く世に出た。

同社の説明はひとつひとつ筋が通っている。だが読者が問うべきは、「減速」とは誰が、いつ、何をすることなのか、という点だろう。少なくとも今回のリリースから、その答えはまだ見えない。


出典

いいなと思ったら応援しよう!

この記事は noteマネー にピックアップされました

noteマネーのバナー