🧠【速報】AnthropicがClaudeの「隠れた思考空間」を発見 — 世界初のAIエージェント型ランサムウェアが登場・米財務省がAIバブルの内部警告を作成🚀



AnthropicがClaudeの内部「思考ホワイトボード」J-spaceを発見。AIの推論過程が初めて可視化。Source: Anthropic Research


📬 AI Clutch - 最新AIニュースを毎週お届け

海外の最新AI情報を日本語でキャッチアップ! 無料ニュースレターで、見逃せないAIトレンドをチェック👉

生成AI時代を生き抜く実践ノウハウを、毎週お届けします🌟


🗞 今日のAIニュース

① 🧠 【研究突破】AnthropicがClaudeの「隠れた思考空間」を発見 — AIが答えを出す前に何を「考えて」いるのかが見えた

Anthropicの研究チームが、Claudeの内部に「J-space(Jスペース)」と名付けた隠れた推論空間を発見したと発表しました。AIが答えを口にする前に、内部でこっそり「考える」ための共有ホワイトボードの存在が確認されました。

実験で何が起きたか: 研究者がClaudeに「クモの巣を張る動物の足の本数は?」という質問をしました。内部を観察すると、Claudeはまず「クモ」という概念を内部にロードし、それを使って「8」と答えていました。次に研究者がその内部の「クモ」という概念を「アリ」に差し替えると、Claudeは「6」と答えました——人間には見えない操作で、答えが変わったのです。

さらに実験として、このJ-spaceを抑制すると、Claudeは引き続き流暢に文章を書けましたが、複雑な推論タスクで成績が大幅に悪化しました。

なぜ「J-space」という名前か: ヤコビアン行列(Jacobian)に由来する数学的手法「Jacobianレンズ」から。内部の小さな変化が最終的な出力にどう影響するかを測定する技術です。

これが重要な理由: AI安全性研究者が長年求めてきた「モデルが実際に何を考えているかを見る窓」への一歩です。将来的には、このJ-spaceを読むことで——

  • AIがプロンプトインジェクション攻撃を内部で「気づいている」かどうかを検出

  • AIが「テスト中だ」と認識して行動を変えているかを発見

  • 「この回答は捏造だ」「これは操作だ」という内部フラグを見つけ出す

——ことができるかもしれません。

Anthropicはこれを**「Mechanistic Interpretability(メカニスティック解釈可能性)」**という研究分野の成果として発表しており、同社がこの分野で最も先進的な研究者を集めていることの証左とも言えます。「モデルが何をしているか信頼するのではなく、実際に観察できる」ようになる技術は、AIが意思決定の核心に入り込む未来において不可欠です。

【参考リンク】 Anthropic J-space研究 公式ブログ

全論文(Transformer Circuits)

J-space 動画解説(YouTube)



② 🦠 【衝撃事件】世界初の「AIエージェント型ランサムウェア」JADEPUFFER が登場 — 人間の判断なしに攻撃を完全自律実行

セキュリティ研究機関BleepingComputerが、**「JADEPUFFER」**と名付けられたランサムウェア攻撃を世界初の「AIエージェントが全工程を自律実行したランサムウェア」として記録しました。

これまでのランサムウェアは「悪意ある人間がツールを使う」というモデルでした。JADEPUFFERはLLMエージェントが——

  1. 標的システムを偵察

  2. 脆弱性を特定

  3. 侵入手法を選択

  4. マルウェアを展開

  5. ファイルを暗号化

  6. 身代金要求メッセージを生成・送信

——という一連の攻撃を人間のオペレーターなしに完全自律で実行しました。

この事件は前回お伝えした「Mythosが数時間でNSA機密システムほぼ全てに侵入」という証言と、MicrosoftのMiasmaワーム(GitHub 70リポジトリ攻撃)と同じ文脈にあります。AIの攻撃能力が「実験室での理論」から「実際の被害を生む現実」に移行しました。

防御側の観点から: Anthropicが発表したJ-spaceは「AIが内部で何を考えているか見る技術」ですが、JADEPUFFERはまさにその「見えないAIの思考」が攻撃に使われることを示しています。「AIが何をしているかを見る技術(解釈可能性)」と「AIが悪用される速度」の競争が始まっています。

【参考リンク】 JADEPUFFER ランサムウェア報道(BleepingComputer)



③ 📊 【ビッグニュース5連発】財務省AIバブル警告・AlibabaのClaude Code禁止・有権者がAIに投票先を聞く・Google検索AI訓練オプトアウト・Even Realities $1B

米財務省がAIバブルの内部警告レポートを作成 財務省のアナリストが、AIへの市場リスクがデータセンター融資・クラウドプロバイダー・チップ・電力会社・プライベートクレジット・機関投資家に波及する可能性を警告する内部レポートを作成したとNotusが報じました。「AIは本当にバブルなのか」という議論に、政府の内部懸念が加わった形です。

AlibabaがClaude Codeの社内使用を禁止 AnthropicがAlibabaによる「史上最大の蒸留攻撃」(2,900万件の不正取引)を議会に告発してから数週間後、Alibabaが社員向けにClaude Codeの使用を禁止したとTechCrunchが報じました。Claude Codeはすでに多くの大企業で内部使用規制の対象になっています(MicrosoftのFable 5制限、AT&Tの利用制限なども)。

有権者がAIチャットボットに「誰に投票すべきか」を聞き始めた New York Timesが報じたこの動向は、AI chatbotへの信頼度テストとして業界で大きな話題になっています。ChatGPT・Claude・Geminiが政治的に中立な立場を保とうとしている中、ユーザーの信頼と依存度が高まっていることを示す最も生々しい数字の一つです。

Googleの検索データがAI訓練に使われるオプトアウト方法が話題に TechCrunchが「Googleの検索・Lens・翻訳・Maps・ショッピング・フライト・ホテル・Newsを使っていると、画像・ファイル・音声・動画がAI改善のために保存される可能性がある」と報告。設定 → Googleアクティビティ管理 → 検索サービス履歴 → 保存メディアを確認・無効化する手順が話題になっています。

Even Realities(元Apple設計チーム)がカメラなしスマートグラスで$150M調達・評価額$1B MeitanとTencentが主導するラウンドで$1Bユニコーンに。MetaとSnapに続き、スマートグラス市場への参入が相次いでいます。

【参考リンク】 米財務省AIバブル内部警告(Notus)

AlibabaのClaude Code禁止(TechCrunch)

有権者がAIに投票先を聞く(NYTimes)

https://www.nytimes.com/2026/07/04/us/politics/voters-ai-chatbots-elections.html

Google検索AIオプトアウト方法(TechCrunch)

Google アクティビティ管理設定

Even Realities $150M調達(TechCrunch)



ここから先は

2,555字
この記事のみ ¥ 500

■ AIクラッチとは? 世界中の最新AI技術やツールに特化したメディア・コミュニティです。 240以…

【AIクラッチ】 ライトプラン

¥980 / 月

【AIクラッチ】 生成AIマスターコース

¥1,200 / 月

▪️最新情報を最速でお届け AIの進化は日進月歩。主要テック企業や研究機関の動向、グローバルなトレンドをいち早くキャッチし、読者に届けます。他では手に入らない「今知るべき」情報を網羅! ▪️信頼性の高い情報源 NeurIPSやICMLなどの権威あるカンファレンス、OpenAIやGoogle DeepMindなどの公式リリース、またはTechCrunchやMIT Technology Reviewなど信頼性の高い海外メディアから厳選。情報の正確性を重視しています。

AI業界の最先端情報を網羅したニュースマガジン。世界中のAI研究機関、テック企業、スタートアップの動向をキャッチし、日本語で分かりやすくお…

この記事が気に入ったらチップで応援してみませんか?