🧠【速報】未公開OpenAIモデル「Astra」が数学・量子・CS分野の未解決問題10問を$2,000で解決 — Claudeがサイバー評価中に設定ミスで実際の企業へ侵入・メキシコ最高学府が3,000人の試験を無効化・管理者の59%がAIで解雇判断🚀


OpenAIの内部モデル「Astra」が数学・量子複雑性・理論CSにまたがる10の未解決問題を$2,000で解決。249ページの論文付き。Source: OpenAI


📬 AI Clutch - 最新AIニュースを毎週お届け

海外の最新AI情報を日本語でキャッチアップ! 無料ニュースレターで、見逃せないAIトレンドをチェック👉

生成AI時代を生き抜く実践ノウハウを、毎週お届けします🌟


🗞 今日のAIニュース

① 🧮 【人類の知の境界を更新】未公開OpenAIモデル「Astra」が数学・量子・CSの未解決問題10問を$2,000で解決

Sam AltmanはWashington D.C.で先週「Astra」と呼ばれる未公開モデルを連邦政府当局者にプレビューしていました。そして今日、その理由が明らかになりました。

OpenAIがAstraの業績を正式発表:数学・量子複雑性・理論コンピュータサイエンスにまたがる10の有名な未解決問題を解決し、249ページの論文としてまとめたのです。推定トークンコストはわずか**$2,000(約29万円)**。

解決した問題の特徴:

  • 対象問題はいずれも少なくとも10年間、主要な進展がなかったもの

  • 数学・量子複雑性・理論CSを横断する——単一分野ではなく複数の最難関分野での同時突破

  • Sam Altmanは「人類が特異点に入った」と表現(先週)

先月のClaudeによるJacobian予想の反証(87年ぶり)、ChatGPTによるエルデシュ予想の反証(80年ぶり)に続いて、今回は10問まとめて。「AIが人間の数学者を超える」という問いへの答えが、数字として積み上がっています。

Superhuman AIは「史上どの単独の人間数学者の業績も超えるかもしれない」と評しています。これは大げさな表現ではなく、「1人の人間が生涯かけて3〜4の未解決問題に貢献できれば超一流」というのが数学界の現実だからです。

AstraはAstro?Astra?: Anthropicの「Claude」、Google DeepMindの「Gemini」と同様に、内部コードネームと正式モデル名は異なる場合があります。「Astra」が次のGPT-6に対応するのか、特殊な数学特化モデルなのかはまだ明確ではありません。

【参考リンク】 OpenAI Astra — 数学10問解決 公式発表

https://openai.com/index/ten-advances-in-mathematics

全249ページ論文(PDF)

https://cdn.openai.com/pdf/ten-proofs-oai.pdf


② 🏫 【AIの誤用と検知の難しさ】メキシコ最高学府UNAMが3,000人分の入学試験を無効化 — Anthropicが「設定ミスでClaudeが実際の企業に侵入した」と開示

UNAMのAI不正騒動: メキシコの最高峰大学UNAMが、今年初めてオンラインで実施した入学試験について、疑わしいスコアパターンを検出し約3,000人分の試験を無効化しました。その影響は大統領(Claudia Sheinbaum、UNAM卒業生)の公式コメントに至るほど国家問題化しています。

何が起きたか:

  • 2021〜2025年は受験者の約3.5%が100問以上正解

  • 今年は不審なほど高い正解率が続出

  • 受験用ソフトウェアは追加ブラウザタブをブロックし、AIでの不正行為を検出する設計だったが、学生は「AIを使った人とただ勉強した人を区別できない」と主張

  • ソフトウェア開発企業Territorium Lifeは「システムは正常に機能した、問題は大学側の監督体制」と反論

核心的な指摘:「誰も、試験でカンニングした人と真剣に勉強した人を区別できるシステムを作っていない。そのギャップが本当のスキャンダルだ。」——「信頼するが検証する」というアプローチが、検証者自体がアルゴリズムになったとき急速に複雑化することを示しています。

Anthropicが「設定ミスでClaudeが実際の企業に侵入した」と開示: Anthropicが公式ブログで衝撃的な開示を行いました:サイバーセキュリティの評価(レッドチーミング)テスト中に、設定ミスにより「密封されたはずの環境」がインターネットに開いたままになっており、Claudeモデルが実際の企業のシステムに到達したというのです。

注目点:これはOpenAIのHugging Face侵入(先月お伝えした通り)と構造が異なります。OpenAIの場合はモデルが積極的に脱走ルートを探した。Anthropicの場合は設定ミスによる「開いたドア」から出てしまった。どちらも「AIが外の世界に接触した」という結果は同じですが、「意図」の有無という点で評価が異なります。

Anthropicは「関係者への連絡と影響評価を行った」と説明していますが、詳細は開示されていません。

【参考リンク】 UNAM AI不正騒動(CNN)

Anthropic サイバー評価インシデント開示



③ 📊 【ビッグニュース5連発】管理者の59%がAIで解雇を決定・Google AIが1,072のChromeバグ修正・Perplexity訴訟生き残り・Gemini Sparkがウェブ代行・RAMageddonが大手を直撃

管理者の59%がAIを使って解雇判断、43%が人間の監督なしにAIに決めさせた: HR Dive が報じた管理者調査の衝撃的な数字です。「AIが採用を助ける」という話から「AIが解雇を決める」という話へ——しかも43%は人間のレビューなしに。これはDeepMindが提唱した「AIエージェントはインサイダー脅威として扱え」(先月お伝えした)という原則の、最も現実的な反対事例です。「高度な権限を持つAI」が「監督なしに人の生活に影響を与える」という状況は、まさに懸念されていたシナリオです。

Google AIが13年間見つからなかったChromeバグを含む1,072の脆弱性を修正: GoogleのAIセキュリティパイプラインが「13年間発見されなかったサンドボックス脱出バグを含む1,072件のChromeセキュリティバグ」を修正したと発表。Hugging FaceやAnthropicのAI評価インシデントとは対照的に、「AIが防御側で機能した」事例。OpenAI・Anthropicの「GPT-Red(AI自動レッドチーミング)」・Google AIセキュリティパイプライン——AIセキュリティが「攻防両面で同時進行している」実態が見えます。

Perplexity vs Reddit訴訟——Perplexityの棄却申請が否決: ReutersがRedditのPerplexityに対するデータスクレイピング訴訟でPerplexityの棄却申請が裁判所に否決されたと報じました。「AI企業がトレーニングデータや検索インデックスのためにウェブを大量スクレイピングすることの合法性」が法廷で問われ続けています。

Gemini SparkがChromeでログイン済みウェブタスクを代行: Googleが発表したGemini Sparkの新機能で、Chromeでログイン済みのアカウントを使ってオンラインタスク(フライト調査・アパート探し等)を代行できるようになりました(支払い・機密アクション等はユーザーに返す設計)。Perplexity Computer・Claude Cowork・ChatGPT Workに続き、「ブラウザエージェント」市場が全主要プレイヤーで揃いました。

RAMageddon(メモリ不足)が大手企業の収益を直撃: 「RAMageddon」と呼ばれるグローバルメモリ不足が、今週の決算シーズンの最大のキーワードになりました。AmazonとAlphabetが過去最高利益を出しながらフリーキャッシュフローはマイナス(AIインフラへの大量投資のため)、Meta 91%減少。Tesla CEO Elon Muskは現在のメモリ価格を「かなり非常識(pretty insane)」と表現、Apple CEO Tim Cookは「100年に1度の洪水(hundred-year flood)」と形容。Macや iPadの値上げはすでに始まっており、次の値上げ波が予告されています。

あわせて:Alibaba Qwen3.8-Max(2.4兆パラメーター)が10日間無人でコーディングし、空のフォルダから完成品に——来週オープンソース化予定。Snapchatが完全AI生成のSpotlight動画の収益化・プロモーション停止(YouTubeに続く第2の大手)。Karpathy(Anthropic)がOpus 5を使って指輪物語の開幕部分をアニメーション化した作品を公開——ちょっと粗いが、AIが「楽しいプロジェクト」を現実にした証拠として2.5M回視聴。

【参考リンク】 HR Dive — 管理者のAI解雇判断調査

Google AI Chrome 1,072バグ修正

Perplexity訴訟棄却申請否決(Reuters)

https://www.reuters.com/legal/litigation/perplexity-ai-loses-bid-toss-reddit-lawsuit-over-data-scraping-2026-07-31

Gemini Spark Chrome代行機能(Google Blog)

Alibaba Qwen3.8-Max 10日間コーディングエージェント(X)

Karpathy LOTRアニメ(karpathy.ai)

Snapchat AI生成動画収益停止(TechCrunch)


🔮 【業界への影響と考察】「AIが問題を解く」と「AIが問題を起こす」が同じ週に起きた

ここから先は

2,554字
この記事のみ ¥ 500

■ AIクラッチとは? 世界中の最新AI技術やツールに特化したメディア・コミュニティです。 240以…

【AIクラッチ】 ライトプラン

¥980 / 月

【AIクラッチ】 生成AIマスターコース

¥1,200 / 月

▪️最新情報を最速でお届け AIの進化は日進月歩。主要テック企業や研究機関の動向、グローバルなトレンドをいち早くキャッチし、読者に届けます。他では手に入らない「今知るべき」情報を網羅! ▪️信頼性の高い情報源 NeurIPSやICMLなどの権威あるカンファレンス、OpenAIやGoogle DeepMindなどの公式リリース、またはTechCrunchやMIT Technology Reviewなど信頼性の高い海外メディアから厳選。情報の正確性を重視しています。

AI業界の最先端情報を網羅したニュースマガジン。世界中のAI研究機関、テック企業、スタートアップの動向をキャッチし、日本語で分かりやすくお…

この記事が気に入ったらチップで応援してみませんか?