見出し画像

Google I/O 2026の発表を時系列で整理:AIが「答える」から「動く」時代へ

更新日:2026/5/20

Google I/O 2026のGoogle Keynoteは、米国太平洋時間2026年5月19日10時(日本時間2026年5月20日2時)に行われました。Google I/O公式サイトでは、2日間のライブ配信セッションとして開催されることが案内されています。 ⟦S1⟧ (Google I/O)
今回のキーノートで見えてきたのは、単なる新AIモデルの発表ではありませんでした。
Googleが示した中心テーマは、

AIが質問に答えるだけでなく、ユーザーの代わりに作業し、判断を支援し、複数のサービスをまたいで行動する時代

です。
Google公式のI/O 2026まとめでは、Gemini Omni、Gemini 3.5、Google Antigravity、Searchの情報エージェント、Gemini Spark、Universal Cart、Google Pics、インテリジェントアイウェアなどが発表群として整理されています。 ⟦S10⟧ (blog.google)
そこで記事では、実際のキーノートの流れに沿って、重要な発表を順番に整理します。視聴対象となるキーノート動画は、Google I/O ’26 Keynoteの公式ライブ配信です。 ⟦S13⟧

Gemini 3 - Nano Banana Pro にて作成した、記事の全体像インフォグラフィック画像
ChatGPT Images 2.0 にて作成した、記事の全体像インフォグラフィック画像

※作成した記事内容をGammaに入力しスライド自動作成させました。スライドの方が見やすいようでしたらこちらをご覧くださいませ。



導入. AI First戦略の10年:Google全体がAI前提へ

Google CEOのサンダー・ピチャイ氏が登壇し、GoogleがAI Firstへ舵を切ってから10年が経ったことを振り返りました。
Googleは、同社サービス全体で処理されるトークン数が、2年前の月間9.7兆、前年の約480兆から、2026年5月時点で月間3.2 quadrillion超に増えたと説明しています。日本語では約3200兆、つまり0.32京に相当します。あわせて、10億人以上のユーザーを持つGoogle製品が13あり、そのうち5製品は30億人以上のユーザーを持つと説明されています。 ⟦S3⟧ (blog.google)
ここで示されたのは、GoogleのAIが単体のチャットサービスではなく、検索、YouTube、Workspace、Android、開発環境、ショッピング、科学研究まで、Googleの主要領域に横断的に入り始めているという事実です。


1. Ask MapsとAsk YouTube:検索や動画視聴が会話型へ

Googleは、すでにGoogleマップで導入しているAsk Mapsに触れたうえで、YouTubeにも高度な会話型AI体験を広げると説明しました。
Ask YouTubeでは、ユーザーが複雑な質問をすると、関連する動画を提示するだけでなく、動画内の最も関連性が高い箇所へ直接ジャンプできるようになります。GoogleはAsk YouTubeをテスト開始中で、2026年夏に米国で広く展開すると説明しています。 ⟦S3⟧ ⟦S20⟧ (blog.google)
これは、従来の「キーワードを入れて結果を探す」体験から、「質問して、必要な箇所まで案内してもらう」体験への変化です。


2. Docs Live:声で話すだけで文書を作る

Workspace関連では、Docs Liveが発表されました。
Docs Liveは、ユーザーが口頭で考えを話すだけで、Geminiが内容を整理し、文書の構成や初稿作成を支援する機能です。Google Workspaceの公式発表では、Docs LiveがGmail、Drive、Chat、Web上の関連情報を、ユーザーの許可に基づいて参照しながら文書作成を支援すると説明されています。 ⟦S14⟧ (blog.google)
この発表の意味は大きいです。文書作成は、これまで「プロンプトを書く」作業でした。Docs Liveでは、考えをそのまま話し、AIが構成化してくれる方向へ進みます。


3. 第8世代TPUとJAX and Pathways:AIを支えるインフラ

次に示されたのが、AIを大規模に動かすためのインフラです。
Googleは、第8世代TPUとして、訓練向けのTPU 8tと推論向けのTPU 8iを説明しました。訓練ではJAX and Pathwaysを使い、単一データセンターの制約を超えて、複数拠点にまたがる100万以上のTPUへ分散できると説明しています。 ⟦S3⟧ (blog.google)
このパートは、後半に登場するGemini Omni、Gemini 3.5 Flash、Gemini Spark、AI Searchが、単なるアプリ機能ではなく、巨大な計算基盤の上に成り立っていることを示す位置づけです。


4. Gemini Omni:世界を理解し、動画を生成・編集するモデル

Google DeepMindのデミス・ハサビス氏のパートでは、新世代モデルGemini Omniが発表されました。
Gemini Omniは、テキスト、画像、音声、動画などを入力として扱い、まずは高品質な動画生成・編集に使われるモデルとして説明されています。Googleは、Gemini Omniを「任意の入力から作成できる」モデルであり、世界理解、マルチモダリティ、編集能力の前進として位置づけています。 ⟦S4⟧ ⟦S10⟧ (blog.google)
重要なのは、動画生成が「一発で映像を出す」だけではなく、会話で編集する方向へ進んでいることです。たとえば、動き、構図、雰囲気、物理的な変化を自然言語で指示しながら編集する体験が示されました。
Gemini Omni Flashは、Geminiアプリ、Google Flow、YouTube Shortsに展開されると説明されています。 ⟦S4⟧ (blog.google)


5. SynthIDの拡大:AI生成コンテンツの透明性

AI生成コンテンツが広がるほど、「これはAIで作られたのか」「編集されたのか」を見分ける仕組みが重要になります。
Googleは、AI生成コンテンツを識別する不可視のウォーターマーク技術SynthIDの拡大を発表しました。公式発表では、1000億以上の画像・動画、6万年分相当の音声にウォーターマークを付与してきたと説明されています。また、OpenAI、Kakao、ElevenLabsなどがSynthIDを採用するとされています。 ⟦S15⟧ ⟦S3⟧ (blog.google)
ChromeやGoogle検索を通じて、画像や動画がAIによって生成・編集されたものかを確認しやすくする方向も示されています。これは、生成AIの普及と同時に、透明性を確保しようとする重要な発表です。


6. Gemini 3.5 FlashとGoogle Antigravity 2.0:AIがコード補助からタスク実行へ

今回の中心発表のひとつが、Gemini 3.5 Flashです。
GoogleはGemini 3.5を、「フロンティア級の知能」と「行動力」を組み合わせた新しいモデルファミリーとして発表しました。その第一弾がGemini 3.5 Flashです。エージェント的な作業、コーディング、長時間にわたる複雑なワークフローに強いモデルとして位置づけられています。 ⟦S2⟧ (blog.google)
あわせて紹介されたのが、エージェントファーストの開発プラットフォームGoogle Antigravity 2.0です。Googleは、Antigravityを「AIにコードを書かせる」ためだけの道具ではなく、AIエージェントとやり取りし、タスクを進めるための中心的な環境として説明しています。 ⟦S3⟧ ⟦S10⟧ (blog.google)
このパートで示された方向性は、開発者がAIにコードの一部を書かせる段階から、複数のAIエージェントに作業を任せ、人間が進捗と判断を管理する段階への移行です。


7. Gemini Spark:24時間365日動く個人AIエージェント

次に発表されたのが、Gemini Sparkです。
Gemini Sparkは、Geminiアプリ内で使える24時間365日の個人AIエージェントとして説明されています。Googleは、SparkをGoogle Cloud上の専用仮想マシンで動作させ、Gemini 3.5とGoogle Antigravityの仕組みを使って、長時間のタスクをバックグラウンドで進められるようにすると説明しています。 ⟦S3⟧ ⟦S16⟧ (blog.google)
Workspace公式発表でも、Gemini Sparkはユーザーの指示のもとで行動し、Workspaceアプリと連携する24/7の個人AIエージェントとして説明されています。高リスクな操作、たとえばメール送信やカレンダー追加のような行為では、ユーザーに確認を求める設計も示されています。 ⟦S14⟧ ⟦S16⟧ (blog.google)
提供範囲については注意が必要です。Googleは、Gemini Sparkを信頼されたテスター向けに展開し、米国のGoogle AI Ultra契約者向けにベータ提供すると説明しています。日本での提供時期や対象プランは、現時点では断定しないほうが安全です。 ⟦S9⟧ (blog.google)


8. Google検索がAI Searchへ:検索結果から生成UIへ

検索も大きく変わります。
Googleは、SearchのAI ModeにGemini 3.5 Flashを標準モデルとして導入すると発表しました。さらに、テキスト、画像、ファイル、動画、Chromeタブなどを入力に使えるAI前提の検索ボックスを展開すると説明しています。 ⟦S8⟧ (blog.google)
特に重要なのが、Search AgentsとGenerative UIです。Search Agentsは、ユーザーに代わってバックグラウンドで情報を探すエージェントです。Generative UIは、検索内容に応じて、グラフ、ダッシュボード、ミニアプリのようなインタラクティブなUIをその場で生成する機能です。 ⟦S8⟧ (blog.google)
これは、検索が「リンクを探す場所」から、「目的に応じて情報を整理し、行動につなげる場所」へ変わることを意味します。


9. エージェントEコマース:Universal Cart、UCP、AP2

ショッピング領域では、AIエージェントがユーザーの代わりに商品探しや購入判断を支援する基盤が示されました。
Googleは、複数サービスを横断するUniversal Cartを発表し、Search、Gemini、YouTube、Gmailをまたいで買い物体験をつなげる方向を示しました。あわせて、エージェント時代のコマース基盤としてUCP(Universal Commerce Protocol)とAP2(Agent Payments Protocol)が説明されています。 ⟦S17⟧ (blog.google)
AP2は、AIエージェントがユーザーの管理下で安全に決済を代行するための仕組みとして位置づけられています。これは、AIが「商品を探す」だけでなく、「条件を満たしたら購入準備まで進める」方向へ向かっていることを示します。


10. Geminiアプリの刷新:Neural Expressive、Daily Brief、macOSアプリ

Geminiアプリも、よりエージェント的な体験へ刷新されます。
Googleは、Geminiアプリの月間利用者が9億人を超え、230以上の国と地域、70以上の言語で使われていると説明しています。新しいデザイン言語Neural Expressiveでは、流動的なアニメーション、色、タイポグラフィ、触覚的な反応などを通じて、Geminiとのやり取りをより自然にする方向が示されました。 ⟦S16⟧ (blog.google)
また、毎朝のカスタム要約であるDaily Briefや、macOS版Geminiアプリも紹介されています。macOSアプリでは、音声やローカルファイルを組み合わせたワークフローが今後広がると説明されています。 ⟦S16⟧ (blog.google)


11. クリエイティブツール:Google Pics、Stitch、Flow

クリエイティブ領域では、画像、UI、動画、音楽制作のAI化がまとめて示されました。
Workspace向けには、画像生成・編集ツールGoogle Picsが発表されました。公式表記は「Pix」ではなくGoogle Picsです。Google Picsは、画像内の特定オブジェクトの編集、画像内テキストの修正や翻訳、SlidesやDriveとの連携などを備えると説明されています。 ⟦S14⟧ (blog.google)
UIデザイン領域では、Stitchがリアルタイムデザイン支援ツールとして紹介されました。テキスト、音声、既存ファイル、コードベースをもとに、レイアウトやデザインを生成・調整する方向です。 ⟦S21⟧ (blog.google)
動画・音楽制作では、Google FlowとFlow MusicにGemini Omniやエージェント機能が統合されると説明されています。Googleは、FlowとFlow Musicをクリエイティブな共同制作者として位置づけています。 ⟦S18⟧ (blog.google)


12. Android XRとインテリジェントアイウェア:Geminiがメガネにも入る

Android XRでは、Geminiを搭載したインテリジェントアイウェアの方向性が示されました。
Googleは、SamsungやQualcommと共同で開発しているAndroid XRを土台に、音声で支援するオーディオグラスと、情報を表示するディスプレイグラスの2種類を説明しています。先に登場するのはオーディオグラスで、2026年秋に展開予定です。 ⟦S7⟧ (blog.google)
パートナーとして、Samsung、Gentle Monster、Warby Parkerが挙げられています。想定される機能には、道案内、通話、メッセージ、写真・動画撮影、翻訳、タスク操作、アプリ利用などがあります。 ⟦S7⟧ (blog.google)
スマートグラスは、単なる表示デバイスではなく、目の前の状況をGeminiが理解し、支援するAIデバイスに近づいています。


13. Gemini for Science:科学、医療、気象へ広がるAI

最後に、科学研究や医療、気象予測に関するAI活用も紹介されました。
Googleは、Gemini for Scienceを、科学的発見の規模と精度を広げるためのツール群・実験群として説明しています。仮説生成、計算発見、文献理解、ライフサイエンス向けデータベースやツールとの連携などが示されています。 ⟦S19⟧ (blog.google)
Google I/O 2026の公式まとめでは、Gemini for Scienceに加え、WeatherNextに関するDeepMind記事もI/O発表群に含まれています。気象、創薬、ライフサイエンスの領域でも、AIは研究者の作業を補助するだけでなく、発見の速度を上げる基盤として位置づけられています。 ⟦S10⟧ ⟦S19⟧ (blog.google)


まとめ:Google I/O 2026の本質は「agentic Gemini era」

Google I/O 2026のキーノートを時系列で見ると、Googleの狙いはかなり明確でした。
今回の発表は、単に新しいAIモデルを出すイベントではありませんでした。

  • Ask YouTubeやDocs Liveは、会話によって検索や文書作成を進める方向を示しました。

  • TPU 8t / 8iとJAX and Pathwaysは、それを支えるインフラです。

  • Gemini Omniは、映像や世界理解のモデルです。

  • SynthIDは、AI生成コンテンツの透明性を支える技術です。

  • Gemini 3.5 FlashとGoogle Antigravity 2.0は、AIエージェントがタスクを実行するための基盤です。

  • Gemini Sparkは、個人のために24時間動くAIエージェントです。

  • AI Search、Universal Cart、AP2は、検索や買い物を「探す」から「任せる」方向へ変えます。

  • Geminiアプリ、Google Pics、Stitch、Flow、Android XR、Gemini for Scienceは、AIを日常、創作、デバイス、研究の中へ広げていきます。

Google I/O 2026が示したのは、

AIが『答える』時代から、AIが『動く』時代へ移る転換点

です。
日本でいつ、どの機能が、どの端末やプランで使えるようになるかは、機能ごとに異なります。今後、ベータ対象、提供地域、対応言語、価格等は日本向けにいつ・どのようになっていくのか確認していく使っていくことが重要かと感じます。

Gemini 3 - Nano Banana Pro にて作成した、記事の全体像インフォグラフィック画像
ChatGPT Images 2.0 にて作成した、記事の全体像インフォグラフィック画像

参考・出典

いいなと思ったら応援しよう!