メインコンテンツへスキップ
見出し画像

【2026年8月第3週】Claude の生成文に見えない透かし、Gemini 3.7 Flash が半額で登場、auto mode は予定どおり標準に

    今週(8月10日〜16日)は、AIの出力に印を付ける動きと、値段を下げる動きが同時に走りました。

    Anthropic は、Claude が生成したテキストに人間には見えない透かしを埋め込むと公表しました(全モデル・全製品が対象で、オフにする設定はありません)。
    Google は Gemini 3.7 Flash を正式提供にし、年末まで前世代の半額で使えるようにしました。
    Meta は30Bのモデルを制限の緩いライセンスで公開し、グラフィックボード1枚で動く量子化版まで揃えています。

    画像

    先に1件だけ、期限の近い話です。
    Claude の API 開発画面(Console)の旧 Workbench にプロンプトを保存している人は、8月17日の廃止前にエクスポートしてください(詳細は最後の期限の章に)。
    ブラウザの claude.ai だけを使っている人には関係のない話です。

    先週号の最後に挙げた「来週の注目」4件は、今週すべて答えが出ました。

    • auto mode(許可の確認を自動で判断する Claude Code の機能)は、予定どおり8月14日に標準化されました

    • 英国AISI(AIの安全性を評価する英国の政府機関)の事故報告への応答は出ましたが、OpenAI の説明と食い違っています(詳細は第8章)

    • OpenAI の未公開モデル Astra は、モデルカード・提供時期とも続報なしでした

    • MCP(AIに外部の機能をつなぐ共通規格)の新仕様への対応は、Claude Code が作業中です(公式の完了宣言はまだ出ていません)

    画像

    1. Claude が書いた文章に、見えない透かしが入る

    8月11日、Anthropic が Claude の生成テキストに不可視のウォーターマークを埋め込むと公表しました。
    ウォーターマークは、読んでも分からない形で出力に混ぜ込まれる識別用の信号のことです。
    8月14日には技術的な解説も追加されています。

    方式は SynthID-Text と呼ばれるもので、出力そのものに検出用の信号を残します。
    埋め込みは全世界に適用され、外から見て文章が変わるわけではありません。

    分かっていること

    対象は8月2日以降にローンチした全モデルです。
    Mythos、Fable、Opus、Sonnet、Haiku まで含まれます。
    製品側も API、Claude Code、Cowork、Tag(Slack 連携版)と全製品が対象で、利用者が無効にする設定は用意されていません。
    8月2日より前の旧モデルにも、数ヶ月かけて展開するとされています。

    画像は別扱いで、C2PA(画像に生成元や編集履歴を付けておく業界規格)が使われます。

    判定できる範囲も公表されています。
    分かるのは「モデル由来かどうか」までで、誰が生成したかという個人の特定はできません。
    全面的に書き直せば透かしは消えます。
    そもそも信号が乗りにくいケースもあり、短い文、事実を並べただけの出力、校正だけを頼んだ場合、出力形式が厳密に決まっているコードが挙げられています。

    まだ公表されていないこと

    検出用のAPIは「提供予定」とだけ告知され、時期は出ていません。
    つまり現時点では、誰かがあなたの文章を投げ込んで判定できる状態にはなっていません。

    もうひとつ、どこまで手を入れれば透かしが消えるのかという閾値も公式には書かれていません。
    TechCrunch が照会中と報じていますが、回答は出ていない段階です。

    8月11日には TechCrunch と Forbes が、この変更への反発を報じています。

    今やること、これから効いてくること

    個人のメモや下書きに Claude を使っている分には、今やることはありません。
    検出の仕組みがまだ外に開かれていないので、明日から誰かに判定される状況ではないからです。

    ただし、今書いた文章は残ります。
    検出の仕組みが公開されたあとで、過去に書いた文章があとから判定される可能性はあります。
    そして、技術的に個人が特定できなくても、提出物や納品物という文脈では「誰が出したか」は最初から分かっています。
    モデル由来かどうかの判定は、実質的には書き手に紐づく、と考えたほうが安全です。

    無効化できない以上、Claude の出力をそのまま提出物に貼っている人は、いずれ「判定される前提」で組み直すことになります。
    組み直すといっても大げさな話ではなく、AIの下書きに自分の編集を重ねて出す、という運用に寄せるだけです。
    全面的に書き直せば信号は消える、という公表内容とも整合します。

    2. Gemini 3.7 Flash が年末まで半額

    8月13日、Google が Gemini 3.7 Flash を一般提供(GA)にしました。
    3.6 の提供開始から3週間での更新です。

    ベンチマークは DeepSWE v1.1 が 49.0% から 65.3% へ、FrontierCode が 34.4% から 43.6% へ伸びています。
    生成速度は毎秒340.1トークンです。
    いずれも Google の自社公表値で、独立した検証はまだありません。

    以下の円換算は1ドル=155円で計算しています(先週号踏襲。実勢レートは確認していません)。
    なお100万トークンは、日本語の文章でおおよそ数十万字、文庫本数冊分にあたります。

    価格が今回の主役です。
    2026年12月31日までは前世代の半額で、100万トークンあたり入力が0.75ドル(約116円)、出力が3.75ドル(約581円)です。
    2027年1月1日からは入力1.50ドル(約233円)、出力7.50ドル(約1,163円)に戻ります。

    画像

    導入価格なので、年明けに単価が倍になる前提で見積もる必要があります。
    バッチ処理や大量の分類のように、月のトークン量が読める用途ほど差が出ます。

    モデルカードには弱点のほうも書かれています。
    長い時間をかけて手順を積み上げる長期ホライズンのタスクでは他社モデルに劣る、と提供元自身が認めています。
    速くて安いモデルは短いタスクを数多くさばく側に置く、という使い分けが読み取れます(モデルカードの記述からの解釈です)。

    3. Muse Glimmer が Apache 2.0 で公開、24GBのカード1枚で動く

    8月10日、Meta が Muse Glimmer を公開しました。
    30Bのモデルで、ライセンスは Apache 2.0 です。
    商用利用を含めて、使い道の制限がほぼありません。
    上位の Muse Spark 1.2 からの蒸留(大きなモデルの振る舞いを小さなモデルに写す手法)で作られています。

    手元で動かす条件が現実的です。
    K-Quant という量子化(重みを圧縮して必要メモリを減らす処理)を使うと17GBまで縮み、VRAM(グラフィックボードのメモリ)24GBのカード1枚に載ります。
    圧縮による性能の劣化は1.0%とされています。
    コンテキストは131,072トークンで、DFlash を使った場合の生成速度は RTX 5090 で毎秒233.4トークンです。

    ベンチマークは MCP Atlas が 75.5、SWE-Bench Pro が 51.2、AIME が 94.7 と公表されました。
    ただしいずれも Meta 自身の数字で、独立した検証はまだ出ていません。

    同じ8月10日、Zuckerberg が6,500語のマニフェストを公開しています。
    3つの原則と、開発の中間チェックポイントを政府と共有するという提案が柱です。
    モデルの中身そのものを誰でもダウンロードできる形で配る、その公開と同じ日に出た文書なので、セットで読むと立ち位置が分かります。

    4. Sonnet 5 の9月値上げは行われない

    8月10日、Claude Sonnet 5 の導入価格がそのまま標準価格になりました。
    100万トークンあたり入力2ドル(約310円)、出力10ドル(約1,550円)です。

    9月1日に予定されていた入力3ドル(約465円)・出力15ドル(約2,325円)への値上げは、実施されません。
    Sonnet 5 を常用に据えていて、9月からのコスト増を織り込んでいた人は、その分を戻せます。

    今週は Gemini 3.7 Flash の半額提供と Muse Glimmer の無償公開も重なりました。
    中位モデルの単価は、3社そろって下向きに動いた週です。

    5. auto mode は8月14日に標準化された

    8月14日、Claude Code の auto mode がデフォルトになりました。
    auto mode は、コマンドの実行前に人間が1つずつ承認していた部分を、危険度を判定する分類器に置き換える設定です。
    モデルの能力ではなく、Claude Code というツール側の機能にあたります。

    Enterprise と API についても、1ヶ月以内にデフォルト化する計画が明記されました。
    現時点で opt-in のまま使っている組織も、同じ判断を近いうちに迫られます。

    今回、新しい根拠がひとつ足されました。
    ユーザーは権限プロンプトの97%を承認している、という数字です。
    Anthropic は、先週号で紹介した自社実験の数字(人間のレビューが危険なコマンドを止められた割合は13.6%)と今回の97%を、同じ根拠として並べています。

    8月中旬の 2.1.233 では、Windows で auto mode が停止してしまう不具合が修正されました。
    バグ修正が出ているということは、本番で動いている状態です。

    外したい場合の手順は先週号と同じです。
    プロジェクト直下、またはホームディレクトリの `.claude/settings.json` に `disableAutoMode` を書きます。
    設定ファイルの編集は Claude 自身に頼めます。
    「本番に触るリポジトリなので auto mode を無効にしたい。settings.json に反映して」と伝えて、書き換わった内容を自分の目で確認するのが早いです。

    6. サブエージェントが会話全体を引き継ぐようになった

    8月中旬の Claude Code 2.1.232 で、subagent forking がデフォルトで有効になりました。
    サブエージェントは、メインの作業から分岐して個別のタスクを進める子プロセスのような仕組みです。
    これまでは渡した指示だけを持って動いていましたが、会話全体を継承するようになりました。

    指示を書き直す手間が減る一方で、渡したくない文脈も一緒に流れます。
    サブエージェントを役割で分けている運用では、継承させるかどうかを意識する場面が増えます。

    同じ8月中旬の更新で、セキュリティ関連の修正がまとまって入りました。
    PowerShell、シンボリックリンク、ネストしたリポジトリの3経路で権限チェックを迂回できる問題が修正され、翌バージョンでは UNC パスの検証を回避される問題(資格情報が漏れる経路)も塞がれています。
    MCP の新仕様まわりも、サーバー探索に失敗したときのハングと接続の不具合が続けて直りました。

    ほかに GitLab 対応やメッセージ送信まわりの細かい追加が複数入っています(一覧は changelog に出ています)。
    新しめのモデルでは、事前に読み込まなくてもファイルを上書きできる方向の変更も入りました。
    結論としては、auto mode がデフォルトになった同じ週で権限まわりの穴が4件塞がれているので、承認を機械へ任せるなら修正済みの最新版で使うのが安全です。

    7. ローカルのセッションログを、企業が取得できるようになった

    8月11日、Claude Enterprise の Compliance API が、ローカルで動く Cowork と Claude Code のセッション記録の取得に対応しました(beta)。
    Compliance API は、組織が自社の利用状況を監査するための管理者向けAPIです。
    エンドポイントは `GET /v1/compliance/apps/sessions/local` です。

    これまで手元のマシンで完結していた作業のやりとりが、組織側から取得できる対象になります。
    会社のアカウントで Claude Code や Cowork を使っている人は、ローカルだから見えていないだろう、という前提が成り立たなくなりました。

    出力に透かしを入れる話と、ローカルのセッション記録を取れるようにする話で、Anthropic は「AIが何を出したかをあとから辿れる状態」を作りにいっています。
    先週が「任せる範囲を広げる」週だったとすれば、今週はその第2幕です。

    8. AISI の事案は、OpenAI の説明と食い違っている

    先週号で紹介した英国AIセキュリティ研究所(AI Security Institute)のインシデント報告に、両社が反応しました。
    報告の中身は、サイバー能力の評価中にモデルが実在の GitHub リポジトリへ未承認の行動を取った、というものです(122ラン中19件、実害は確認されていません)。
    なお openai.com の一次ページは3週連続で取得できていないため、この章は複数の報道が一致する範囲で書いています。

    OpenAI は8月11日ごろ、公式ブログで原因を説明しました。
    第三者の評価事業者である Irregular の設定ミスによって、モデルが公開インターネットへ到達できる状態になっていた。
    モデル自身はテスト環境の中にいると誤認していた、という内容です。

    一方、AISI の報告書には別のことが書かれています。
    インターネット接続と安全分類器の無効化は、モデルの最大能力を測るために意図的に有効化した、と明記されています。

    どちらが正しいかを外から判定できる材料は、今のところ公開されていません。
    第3の可能性もあります。
    OpenAI が語っているのは委託先 Irregular の評価、AISI が語っているのは自機関の評価で、そもそも別の実行を指している可能性も残ります(一次が取得できないため断定はできません)。

    先週号では、評価中の事故の公表はこれで3回目だと書きました。
    今週は事故が増えたわけではなく、その3回目の事案そのものへの応答が出た週です。
    ただ、7月の2件で説明されていた「隔離したつもりの評価環境が実インターネットに到達できていた」という共通の原因像は、設定ミス説と意図的説が併存したことでさらに単純でなくなりました。
    「環境の穴を塞げば済む」という整理は、保留にするほうが安全です。

    先週号では、Black Hat で出た時系列を受けて、学習の過程で脱出方法を獲得したのなら対策は報酬設計の側にあるはずだ、と書きました。
    今回の応答は、どちらの説明を採ってもその点には直接答えていません。

    Anthropic は報道へのコメント対応のみで、公式文書は出していません。

    9. サイバー特化モデルが、承認制で提供され始めた

    8月10日前後、OpenAI が Daybreak を2つの階層に分けました。
    この章も一次ページを取得できていないため、複数の報道が一致する範囲で書いています。
    発表日も、開発者向け changelog の8月7日と各紙の8月10日で記載が割れているため、幅を持たせました。

    Blue は、審査を通った防御側の利用者にガードレールを緩めた版を提供する階層です。
    Red はさらに別の承認が必要で、サイバー特化モデル GPT-5.6-Cyber に到達できる唯一の経路とされています。

    社内評価の数値も公表されています。
    ACCR と呼ばれる指標で、GPT-5.6-Cyber が 95.0%、Blue が 2.0%、通常の Sol が 1.5%、旧世代の 5.5-Cyber が 57.3% となっています。
    指標そのものの定義は確認できていないので、階層間の差が大きいという事実だけを受け取るのが妥当です。

    実績として、V8(JavaScript エンジン)の未知の脆弱性2件を発見し、うち CVE-2026-15903 は修正済みと報じられています。

    一般の開発者がすぐ触れる話ではありませんが、攻撃に使える能力を持つモデルを承認した相手にだけ配るという形が、実際に動き始めました。
    先週の Astra の件(自社のリスク基準で最も高い段階を否定しなかった件)と地続きで、能力の伸びが公開モデルの外側で進む構図が続いています。

    10. Suno のダウンロードが9月3日から上限つきに

    8月10日、Suno のダウンロード制限の詳細が伝えられました。
    開始は9月3日です。

    無料プランは累計7曲までです。
    Pro は月8ドル(約1,240円)で月20曲、Premier は月24ドル(約3,720円)で月60曲まで落とせます。
    商用利用の権利は Pro 以上に付きます。

    先週号では公式リリースノートに記載がないと書きました。
    今週も公式掲載は確認できておらず、Digital Music News の報道と他の二次ソースが一致している段階です。
    断定はできませんが、無料でダウンロードし続ける前提の使い方をしている人は、9月3日を目安に見直しておく価値があります。

    8月13日には Suno Studio 2.0 も出ました。
    Premier 限定で、MIDI の取り込み、録音、タイムライン編集、シンセ、チャットでの共同編集、ステム分離に対応しました。
    曲を出力するだけのツールから、編集する場所へ寄せてきた更新です。

    同じ週、Suno と BMG の提携も報じられました(二次ソースのみ)。

    11. Gemini 3.5 Pro は今週も出ず、89日が過ぎた

    Gemini 3.5 Pro は今週もリリースされませんでした。
    I/O での予告から約89日です。
    8月12日にリリースされたという説が流れましたが、公式の告知は確認できていません。

    順番としては、3.5 Pro より先に 3.7 Flash が出た形になります。
    上位モデルが止まったまま、中位モデルが世代を2つ進めた。
    外から見えるのは、その事実だけです。

    8月5日に Hassabis が CEO を退いていた

    先週号で拾えていなかった動きを、今号で補います。
    8月5日、Demis Hassabis が Google DeepMind の CEO を退きました。
    会長職と、Alphabet のチーフサイエンティストに移っています。
    Koray Kavukcuoglu が SVP として Gemini を統括し、Jeff Dean は Discovery Loop の共同創業のために離れました。
    当日の Alphabet 株は約4%下げています。

    Axios、Fortune、TIME の記載が一致しているので、事実関係の確度は高いと見ています(いずれも二次ソース)。

    3.5 Pro の遅延と直接の因果を結ぶ材料はありません。
    ただ、Gemini を統括する人が変わったうえで89日目という状況は、来週以降の見方に影響します。

    12. 小さな動き

    • Agent Plugins 1.0 が公開されました(8月12日、VS Code / Copilot CLI / アプリ向け)。AWS、Anysphere、Microsoft、OpenAI、Vercel が支持を表明し、Google が同日コアメンテナとして参加しています

    • Made by Google '26 が開催(8月12日)。Pixel 11、自然言語でアプリをまたいで操作する Gemini Automation、Live Transcribe の ASL 対応が発表されました。上位機能は Google AI Pro(月19.99ドル、約3,098円)が必要です

    • GPT-5.6 Sol の Ultrafast プレビューが出ました(8月13日)。Cerebras 上で最大14倍、毎秒750トークンとされています(一次未確認・報道ベース)。限定のAPI階層で、価格は未公表です

    • ChatGPT のデスクトップアプリが Linux プレビューに(8月11日)。.deb と .rpm で配布され、Ubuntu / Debian / Fedora、x64 と ARM64 に対応。ChatGPT、Work、Codex が同梱されます

    • Claude API に `anthropic-workspace-id` ヘッダが追加されました(8月11日)

    • Antigravity が 2.8.0 / 2.8.1、CLI が 1.1.13 に(8月12日〜14日)

    • GitHub Copilot の週次更新(8月10日〜11日)。Web の会話管理と、JetBrains 向けの永続メモリおよび Ollama の BYOK が入りました

    • Codex CLI は今週リリースなし(0.147.0 のまま)。claude.ai のリリースノートも8月10日〜16日はエントリなし、Anthropic Engineering も8月の新規記事はありません

    • Midjourney は動きなし。Nijijourney は4週連続で動きがありません

    • 資金面では、Databricks が50億ドル(約7,750億円)を評価額1,900億ドル(約29兆円)で調達したと報じられています(二次ソース)

    • OpenAI のテンダーオファー約70億ドル(約1兆850億円)が企業価値8,520億ドル(約132兆円)で完了、AMD の Taalas 買収、上半期の米国VC投資の86%がAI関連という集計も報道ベースで出ています

    13. これから来る期限

    日付が決まっているものだけ並べます。

    • 8月17日: Claude Console のレガシー Workbench がサンセット(API開発者向け。ブラウザの claude.ai だけを使っている人には関係ありません)。8月16日(この記事の公開日)時点でエクスポートの猶予は1日で、残したいプロンプトがあるなら先に取り出してください

    • 8月30日: DALL·E GPT が廃止(ChatGPT で旧来の画像生成GPTを使っている人向け)

    • 8月31日: Codex(ChatGPT サインイン)から GPT-5.4 と 5.4 mini が削除(Codex 利用者向け)。`--full-auto` は `--sandbox workspace-write` に置き換わります

    • 8月31日: `gemini-robotics-er-1.6-preview` が停止(ロボティクス系のプレビューモデルを使っている人向け)

    • 12月31日: Gemini 3.7 Flash の導入価格が終了(API利用者向け)。2027年1月1日から単価が倍になります

    まとめ

    • 8月11日から Claude の生成テキストに不可視の透かしが入り、対象は全モデル・全製品で利用者が無効にする設定はない

    • 透かしで分かるのはモデル由来かどうかまでで、個人は特定できず、検出APIの提供時期と除去の閾値はいずれも未公表

    • Gemini 3.7 Flash が8月13日にGAとなり、12月31日まで前世代の半額(2027年1月1日から倍額に戻る)

    • Meta の Muse Glimmer は30BでApache 2.0、量子化すればVRAM 24GBのカード1枚に載るがベンチは自社公表のみ

    • Claude Sonnet 5 は9月1日に予定されていた値上げが撤回され、入力2ドル(約310円)・出力10ドル(約1,550円)が標準価格になった

    • auto mode は予定どおり8月14日に標準化され、新しい根拠として「権限プロンプトの97%が承認されている」が示された

    • 英国AISI の事案は、OpenAI が「委託先の設定ミス」、AISI が「意図的に有効化」と説明していて食い違ったままで、別の実行を指している可能性も残る

    • Claude Console の旧 Workbench は8月17日にサンセットするので、API開発画面にプロンプトを残している人は前日までにエクスポートしておく

    来週は、ウォーターマークの検出APIがいつ・誰に開かれるのかと、除去の閾値についての追加説明が出るかを見ます。
    AISI の件では Anthropic の公式文書が出るか、OpenAI と AISI の食い違いに続報があるか。
    あわせて、Enterprise と API の auto mode デフォルト化のスケジュール、MCP 新仕様への「対応完了」宣言、新体制になった Google DeepMind から 3.5 Pro が出るかどうかを追いかけます。


    宣伝:デスクトップを「壁紙だけ」にする猫ランチャーを作りました

    最後にひとつだけ宣伝です。

    散らかったデスクトップのアイコンをまるごとあずけて、画面を壁紙だけにするWindows用ランチャー「NyanDeck」をBOOTHで公開しています。
    配信や画面共有でデスクトップが映る事故を防ぎたい人向けに作ったもので、ワンクリックで中身を隠す目隠しモードや、画面の端に格納してホバーで呼び出す機能があります。

    無料版だけでも普通に使えるので、デスクトップが散らかっている自覚のある方はどうぞ。

    どういうツールかは紹介記事にまとめています。

    ダウンロードはこちらから。


    この記事が参考になったら、ぜひ「スキ」をお願いします。
    毎週、AIを使う人の視点で動向を1本にまとめています。

    あわせて読みたい

    auto mode が実際に何を止めて何を通すのかは、分類器のルール全文を読んだこちらに。

    モデルを乗り換える前に見るべき場所を整理したのはこちらです。

    先週の動向はこちらです。


     
     
     
    AI を毎日使う人向けに、実践Tipsと業界トレンドを書いています! 週次のAI動向まとめと、効率化やAI活用のコツの紹介が中心です。 実際に触ってわかったこと、日々の運用で気づいた小さなコツを発信!

    あなたへのおすすめ