メインコンテンツへスキップ
見出し画像

【2026年8月第4週】Claude API のベータが一斉に卒業、Imagen は停止期日入り、Sol が期間限定で Opus 5 より安くなった

    ましろ

    今週(8月17日〜23日)は、各社の最上位モデル(フロンティアモデル)の新リリースがゼロでした。

    そのかわり、その下の土台がまとめて動いています。
    Anthropic は Claude API で「試験提供」だった機能を一斉に正式版へ移し、Google は画像生成モデル Imagen 全体の停止期日を迎え、OpenAI は GPT-5.6 Sol の値段を下げました。
    新しいモデルが出ない週に、モデルの外側のほうが変わった、という並びです。

    なお、この記事にはAPIの話が何度か出てきます。
    APIは、アプリやブラウザの画面ではなく、自分で書いたプログラムからAIを呼ぶための窓口のことです。
    APIを使っていない人は、5章と6章だけ見れば足ります。

    画像

    先週号の最後に挙げた「来週の注目」5件は、今週分の答えが出そろいました。

    • ウォーターマーク(Claude の出力に埋め込まれる、目に見えない識別用の信号)の検出APIは進展ゼロ。提供日は未定のままです

    • 英国AIセキュリティ研究所の事案は、事故そのものの続報ではなく、第三者がフロンティア5社の体制を採点した結果が出ました(3章で詳しく書きます)

    • auto mode(実行の許可を1つずつ人間が確認する代わりに、危険度を判定する仕組みに任せる Claude Code の設定)の Enterprise・API へのデフォルト化は持ち越し。8月14日の「1ヶ月以内」表明のままで、追加の告知はありません

    • MCP(AIに外部の機能をつなぐ共通規格)の新仕様への「対応完了」宣言は出ていません。Claude Code はまだ実装の不具合を直している段階で、Codex CLI も完了宣言を出していません

    • Gemini 3.5 Pro は今週も出ませんでした。I/O での予告から96日です

    前号の期限章で予告していた Workbench(Claude API の開発画面)の廃止は予定どおり実施され、翌18日に後継の Playground が Console に出ています。

    画像

    今日やること: Imagen を使っている人は確認

    Google の画像生成モデル Imagen が、全モデルまとめて停止の期日を迎えました。
    公式ドキュメントの表現は「早ければ2026年8月17日に停止する」というもので、実際に止まる時刻には幅があります。

    関係するのは、画像生成のAPIを使っている人だけです。
    Gemini のアプリやブラウザで画像を作っている人には関係ありません。

    やることは、自分のスクリプトや設定ファイルに `imagen-` で始まるモデルIDを直接書いている箇所がないか探すことです。

    移行先には thinking level という指定が要ります。
    これは、生成の前にモデルがどれだけ考えるかを段階で指定するものです。
    公式が示した移行先は次のとおりです。

    • `imagen-4.0-fast-generate-001` → `gemini-3.1-flash-image`(thinking level は `MINIMAL`)

    • `imagen-4.0-generate-001` → `gemini-3.1-flash-image`(thinking level は `HIGH`)

    • `imagen-4.0-ultra-generate-001` → `gemini-3-pro-image`

    • `imagen-3.0-capability-001` → `gemini-3.1-flash-image`

    モデルIDを文字列置換するだけでは足りず、この段階指定を足す必要があります。
    単純な置換で済まないのはここです。
    非推奨のアナウンス自体は6月15日に出ていました。

    なお、この記事の日付は発表元の現地の日付です。日本時間では翌日になる場合があります。

    1. Claude API のベータが一斉卒業

    8月19日、Anthropic が Claude API のベータ機能をまとめて正式版にしました。

    ベータは試験提供のことで、正式版(GA、一般提供)になると急に形式が変わりにくくなります。
    変更するときは事前の告知と移行期間を置く、というのが正式版の前提だからです。
    これまでベータ機能を使うには、リクエストに「ベータヘッダ」を付ける必要がありました。
    ヘッダは、送るリクエストに添える指定用の付箋のようなものです。

    ここから2段落は開発者向けの細目です。飛ばして次の見出しへ進んでも問題ありません。

    卒業したのは次の4つです。

    • computer use tool(画面を見せて、マウスとキーボードの操作をさせる機能)。1回のターンで複数の操作をまとめて送る batch actions、拡大表示の zoom がデフォルトで有効に、`configs` でメンバーごとの設定も可能に

    • Files API(ファイルをアップロードして使い回す機能)。期限を切る `expires_in_seconds`、ページ送り、`ids[]` での絞り込みが加わりました

    • Agent Skills と Skills API(`/v1/skills`)

    • Claude Enterprise 向け Admin API のユーザー管理系(メンバー、招待、グループ、カスタムロール)

    同じ日、Managed Agents(Anthropic 側が用意する調査・実行用のエージェント)にも変更が入りました。
    `web_search` と `web_fetch` に `allowed_domains` と `blocked_domains` を設定できます。
    読みに行く先を公式ドメインだけへ絞れます。
    拾ってきたページに紛れ込んだ指示へAIが従ってしまう事故を減らせます。
    セルフホストのサンドボックスに memory store をマウントできるようにもなりました。
    Console 側では、セッションの中身をタイムラインやコスト・ツール別の統計で追える表示に刷新されています。

    ブラウザ操作の専用ツールが増えた

    同じ8月19日、browser use tool が新しく出ました(`browser_toolset_20260801`)。

    デスクトップ全体ではなく、アプリ側が用意したブラウザのビューポートの中だけで動きます。
    従来の computer use との違いは、画面の読み取り方です。
    computer use はスクリーンショットを見て座標を推測していましたが、browser use tool はページ自身からアクセシビリティツリー(画面の構造を機械が読める形にした情報)や要素、フォーム、タブを読みます。
    要素の名指し参照・フォーム入力・タブ管理・ダウンロードの報告・許可した場合のファイルアップロード、といった操作が加わりました。

    対応モデルは Fable 5、Mythos 5、Opus 5、Sonnet 5、Opus 4.8 です。

    ログインして検索してフォームを送る、という手順は座標クリックで組むと壊れやすい。
    そこが要素の名指しに置き換わったのが、この週いちばん実務に効く変更です。

    ヘッダを外すときは Files API に注意

    急いで作業する必要はありません。
    旧ヘッダを付けたままのリクエストも、従来の形式のまま動きます。

    ただし Files API だけは、ヘッダを外すとレスポンスの形式が変わります。
    「正式版になったからヘッダを一括で消しておこう」とやると、返ってきた中身を読む側のコードが壊れます。
    外すなら意図的に、返り値を見ながら1つずつ。

    同じ週に Python SDK が v1.0 になった

    8月20日、Python 版のSDK(開発キット)が v1.0 になりました。破壊的変更を含みます。

    HTTP まわりのライブラリが `httpx` から `httpx2` に変わり、Python 3.10 以上が必須になりました。
    旧 Text Completions API と、Messages メソッドの `temperature` / `top_p` / `top_k` は削除されています。

    影響が出るのは、`requirements.txt` に `anthropic` をバージョン指定なしで書いている人です。
    何気なくパッケージを更新したタイミングで動かなくなる可能性があります。

    2. タンパク質設計で15標的中14に成功

    8月18日、Claude を使った自律的なタンパク質バインダー設計の結果が公表されました。
    バインダーは、狙ったタンパク質にくっつく分子のことです。

    設計に使われたのは Mythos Preview と Opus 4.8 です。
    AIが設計案を出し、外部のツールを実行し、返ってきた結果を解釈する。このループを自律で回しています。

    以下の数字は、検証を実施した Adaptyv Bio 側の公開資料によるものです。
    15の標的のうち14で、機能するバインダーの設計に成功しました。
    1,320件の設計のうち354件が実験で機能を確認され、hit rate(設計したもののうち実際に機能した割合)は22.6〜35.1%です。
    業界の典型は10〜15%とされているので、その上に出た数字です。
    検証は Adaptyv Bio と Twist Bioscience のウェットラボ(実際に試薬を使って実験する研究室)で行われました。

    限定を付けて読む必要があります。
    これは創薬の工程のうち、標的にくっつく分子を設計するという初期の1段階の実証です。
    AIが薬を設計した、という話ではありません。報道側も同じ釘を刺しています。

    それでも、汎用のAIが専用モデルの領域で業界水準を超える打率を出し、しかも第三者の実験で確かめられた、という事例は今のところ多くありません。
    フロンティアモデルが1つも出ていない週に、いちばん大きいことがモデルの外側で起きた。今週を一言でまとめるとそうなります。

    3. Anthropic は5項目最高点、封じ込め0点

    8月18日、Guidelight AI Standards がフロンティア5社の制御体制を採点した評価を公開しました。
    Guidelight は2026年に設立された独立の非営利団体で、元OpenAI の Steven Adler と Page Hedley が創設しています。
    AI企業とその従業員からは資金を受けない、と表明しています。

    採点は6項目です。
    ログの記録、監視の有効性、危険な操作をゲートで止める仕組み、緊急停止(サーキットブレーカー)、第三者レビュー、そして暴走したモデルの封じ込め計画。

    採点は各項目5点満点です。ただし実際には、どの企業も3点を超えられませんでした。
    総合スコアは Anthropic と OpenAI が C+(2.50/5)、Google が D+(1.50)、xAI が D−(0.83)、Meta が F(0.67)でした。

    Anthropic の内訳が特徴的です。
    封じ込め計画を除く5項目すべてで、実際に付いた最高点である3を取っていて、これは全社の中で最も高い。
    そのうえで、封じ込め計画だけが0点でした。
    この0点は「計画がない」という認定ではなく、「公開されている文書の中に正式な計画の記載が見つからなかった」という採点です。

    TechCrunch の続報(8月22日)によると、封じ込め計画の項目は OpenAI が3点で最も高く、Anthropic と Meta が最低でした。
    OpenAI は、安全上の問題が見つかったときに社内展開と学習を実際に止めた実績が評価されています。
    Anthropic は「モデルが監督の回避を試みた場合はリスクを評価する」と回答しましたが、Guidelight は公開文書の中に正式な封じ込め計画の記載を見つけられなかった、としています。

    0点は他社にも付いています。
    xAI はログの記録と第三者レビュー、Google と xAI は監視の有効性、Meta は危険な操作のゲートと緊急停止が0点でした。

    3週かけて視点が移った

    この件は、3週続きの話の着地点にあたります。

    8月第2週に英国AIセキュリティ研究所が評価中の逸脱行動を公表し、第3週には OpenAI と同研究所の説明が食い違ったまま並びました。
    そして今週、第三者が体制そのものを横並びで採点しました。
    出来事の告発から、当事者の説明、体制の点数化へと視点が移っています。

    今週起きたのは事故ではなく体制の採点なので、評価中の事故の件数は3件のまま増えていません。

    読者が持ち帰れるとすれば、この6項目です。
    自分がAIエージェントに作業を任せているなら、ログを残しているか、おかしくなったときに止める手段があるか、の2つは同じ質問として使えます。
    フロンティアラボでも5点満点中3点どまりだった、という前提込みで。

    なお同じ週、Anthropic はセキュリティ製品の側への大型投資も発表しています(Enterprise 向けなので個人利用者に直接の変化はありません)。
    採点の0点だけを切り出すと、この動きが視界から消えます。

    4. Sol が11月21日まで Opus 5 より安い

    8月21日、OpenAI が GPT-5.6 Sol の API 価格を下げました。

    価格の単位はトークンです。トークンは文章の長さの単位で、日本語ではおおまかに1文字=1トークン前後になります。
    100万トークンあたり、入力が5ドルから4ドル、出力が30ドルから20ドルです。
    率にして入力2割・出力3割の値下げです。

    以下の円換算は1ドル=155円で計算しています(実勢レートは確認していません)。
    入力が約775円から約620円、出力が約4,650円から約3,100円です。

    押さえるべきは期間で、この価格は2026年11月21日までの期間限定です。そのあとは元の価格に戻ります。

    比較対象になるのが Claude Opus 5 で、入力5ドル(約775円)・出力25ドル(約3,875円)です。
    標準のコンテキスト帯(1回のやりとりで扱える文章量が標準の範囲)に限れば、期間中は入力・出力とも Sol のほうが安い。
    長いコンテキスト帯の価格は比較していません。

    画像

    適用先は API のほか、ChatGPT Work と Codex のクレジットにも順次広がります。
    Pro、Plus、Business のサブスク料金は据え置きです。

    先週号では Gemini 3.7 Flash の半額提供と Sonnet 5 の値上げ撤回を書きました。
    今週も下がった。ただし先週は中位モデル、今週は旗艦モデルと階層は別々で、どちらの週も期限つきの導入価格です。
    言えるのは「階層は違うが、下向きの動きが2週続いた」までです。
    乗り換えのコスト計算は、11月21日に戻る前提とセットで。

    5. 小さな動き

    • Claude Code は8月17日から23日にかけて 2.1.234 から 2.1.241 まで更新されました(Claude Code を使っている人向け)。使用上限のリセット時に処理を自動で継続するようになり、出力スタイルに「Concise」(前置きや実況を飛ばして結果から出す)が組み込みで追加されています

    • 同じ期間の更新で、`claude-api` スキルの読み込むコンテキストが200,000トークン超から25,000トークンに削減されました(Claude Code でスキルを使っている人向け)。スキルを1つ有効にするだけで作業用の余地が削られていた状態が変わります

    • Codex CLI は 0.149.0(8月20日)で `codex agents` と `codex queue` が入りました(Codex CLI を使っている人向け)。前者は走っているタスクを一覧して開いたり止めたりするダッシュボード、後者は動いているセッションに後から指示を送るコマンドです(どちらもターミナルで実行します)

    • Claude Academy が公開されました(8月20日、`academy.claude.com`。Claude をこれから学ぶ人・チームに教える人向け)。プロンプト、Claude Code、MCP、API、RAG、エージェント構成をカバーする無料の学習ハブで、コースを終えるとバッジが出ます。中核の教材は社内の従業員教育をそのまま外部に出したものです

    • Claude Code に `/design` が出ました(8月中旬、リサーチプレビュー。Pro / Max / Team / Enterprise の契約で Claude Code を使っている人向け)。`/design a few options for {機能名}` とチャット欄に打つと画面案が複数のアートボードとして並び、選んでそのまま実装させられる、という説明です。既存のコードやデザインの決まりを自動では踏襲しない、という制約が公表されています。まだ触っていないので、使い勝手についてはここでは書きません

    • 8月17日の朝、Claude の認証障害がありました(Claude をブラウザやアプリで使っている人向け)。日本時間6時58分から7時40分までの42分間で、この件の時刻だけ日本時間で書いています。claude.ai、Claude Code、Cowork が落ちる一方で、Claude API は動き続けていました。原因の報告はまだ公開されていません

    6. これから来る期限

    日付が決まっているものだけ並べます。

    • 8月26日: OpenAI の o3 が ChatGPT からリタイア(ChatGPT でモデルとして o3 を選んでいる人向け。APIは対象外です)

    • 8月30日: DALL·E GPT が廃止(ChatGPT で旧来の画像生成GPTを使っている人向け)

    • 8月31日: Codex(ChatGPT サインイン)から GPT-5.4 と 5.4 mini が削除され、`--full-auto` が `--sandbox workspace-write` に置き換わります(Codex 利用者向け)

    • 8月31日: `gemini-robotics-er-1.6-preview` が停止(ロボティクス系のプレビューモデルを使っている人向け)

    • 9月14日ごろ: Enterprise と API の auto mode デフォルト化について表明された「1ヶ月以内」の期限(組織のアカウントで Claude Code を使っている人向け)

    • 11月21日: GPT-5.6 Sol の値下げが終了(API利用者向け)

    • 12月31日: Gemini 3.7 Flash の導入価格が終了(API利用者向け)

    まとめ

    ChatGPT や Gemini、Claude をアプリやブラウザで使っているだけの人は、今週やることはありません。

    • 8月19日に Claude API の computer use、Files API、Agent Skills、Enterprise 向け Admin API のユーザー管理がまとめて正式版になった

    • 旧ベータヘッダを付けたままでも動くが、Files API だけはヘッダを外すとレスポンスの形式が変わる

    • browser use tool が新しく出て、ブラウザ操作がスクリーンショットからの座標推測ではなくページ構造の読み取りに変わった

    • 8月20日の Python SDK v1.0 は破壊的変更を含むため、`anthropic` をバージョン指定なしで入れている人は更新時に注意する

    • Imagen は全モデルが停止期日を迎え、移行先の `gemini-3.1-flash-image` は thinking level の指定が要るので単純な置換では済まない

    • Claude を使った自律的なタンパク質設計が15標的中14で成功し、hit rate 22.6〜35.1% を第三者のウェットラボ検証つきで記録した(創薬の初期1段階の実証)

    • Guidelight の第三者採点で Anthropic は6項目中5項目が実際に付いた最高点の3、封じ込め計画だけが0点で、この0点は公開文書に正式な計画の記載が見つからなかったという採点だった

    • GPT-5.6 Sol が入力4ドル・出力20ドルに下がり、11月21日までの期間限定で標準コンテキスト帯では Opus 5 より安い

    期限は、来週(8月26日と30日)に2つ、その次の週の頭にあたる8月31日(月)にさらに2つ並びます。
    使っているモデルやコマンドが該当していないか、今週のうちに見ておくと慌てずに済みます。

    追いかけるのは3つです。
    Enterprise と API の auto mode デフォルト化が9月14日ごろの期限までに実施されるか。
    Anthropic の公開版 S-1(上場前に提出する届出書類)が8月末に出るとの報道があり、実際に出るか。出れば売上の一次データが初めて公開され、報道段階で食い違っている数字に決着がつきます。
    そして Guidelight の採点に各社が公式文書で応答するか、特に封じ込め計画の0点に説明が出るか。

    Gemini 3.5 Pro は、5月の Google I/O での予告から、来週で103日目です。


    この記事が参考になったら、ぜひ「スキ」をお願いします。
    毎週、AIを使う人の視点で動向を1本にまとめています。

    あわせて読みたい

    先週の動向はこちらです。

    auto mode が実際に何を止めて何を通すのかは、分類器のルール全文を読んだこちらに。

    モデルを乗り換える前に見るべき場所を整理したのはこちらです。


     
     
     
    AI を毎日使う人向けに、実践Tipsと業界トレンドを書いています! 週次のAI動向まとめと、効率化やAI活用のコツの紹介が中心です。 実際に触ってわかったこと、日々の運用で気づいた小さなコツを発信!

    あなたへのおすすめ