メインコンテンツへスキップ
見出し画像

“作りたい”と思うだけで、AIが材料を揃える。ChatGPT Atlasが生活に入り込んだ日

    本日(2025年10月22日・日本時間午前0時)、OpenAIはライブ配信にて新しいウェブブラウザ「ChatGPT Atlas」を正式に発表した。すでに実装されているので利用手順を解説したあと、ライブ配信の解説をしていく。

    ChatGPT Atlasの使い方

    ChatGPTにログインすると、右下のチャット欄の側にこの様なモーダルが出現しているはずです。

    画像

    ダウンロードすると、例によってアプリフォルダに入れるか聞いてきます。(Macの場合)

    画像

    「アプリケーション」ディレクトリに格納した後のアイコンはこちら。

    画像

    立ち上げると、アカウントのログインを行います。初回のログインでキーチェーンなどの設定もできます。

    画像

    初回のログインでも、「お帰りなさい」と言われます。

    画像

    ブックマークや設定などを、普段使っているブラウザからインポートします。

    画像

    デフォルトのブラウザに設定することもできます。

    画像
    画像

    webページを出しながらその事について質問できます。

    画像

    筆者の場合、自分のサイトの相談をしてみました。こんな感じです。これは、便利。URL貼り付けたり、コード貼り付けたりしなくてもその画面を表示していれば解析から問題点を洗ってくれます。

    画像

    こんな感じで、ガンガン提案してきます。以下引用:

    ① Next.js(Reactフレームワーク)

    現実的にいちばんおすすめ。
    SEOもSSR(サーバーサイドレンダリング)も自動でやってくれて、WordPressをヘッドレスCMSとしてつなげば、いまの投稿データをそのまま引っ張れる。

    構成イメージはこう:

    frontend(Next.js)
    └ pages/
       ├ index.tsx       ← トップページ(Shibuyaのヒーロー部分)
       ├ rooms/
       ├ neighborhood/
       └ about/
    backend(WordPress REST API)
    └ /wp-json/wp/v2/posts
       /wp-json/wp/v2/categories
    

    WordPressをAPI専用にして、React側でfetchして表示する。
    ビルドするときに静的化(SSG)できるから、高速+CDNキャッシュ可能+メンテナンス性高い。


    ② Astro + React Islands

    もう少し軽量にいくならAstro。
    トップページは静的HTMLで生成して、必要な箇所(地図とかギャラリーとか)だけReactコンポーネント化する方式。
    ホテルサイトやAirbnb型サイトに向いてて、Lighthouseスコア爆上がりする。


    ③ Vite + React(完全フロントのみ)

    もしSEOよりUX重視なら、ViteでReact SPA化もあり。
    ただしWordPressの投稿を流用するなら、別途APIを叩く仕組みを自分で作る必要がある。
    →「akikito.tokyo/api/posts」みたいな中間層サーバーを立ててもいい。


    もし本気でやるなら、まず知りたいのは:

    • いまのWordPressを「残してAPI化」したいのか(=ヘッドレス化)

    • それとも完全に「WordPressから脱出」してReactオンリーで再構築したいのか

    どっちの方向?
    それで設計がだいぶ変わる。

    引用終わり。解説に戻ります。CorsorはOpenAIが出資して立ち上がったスタートアップ企業ですが、いっときOpenAIが買収しようとして失敗しました。が「ChatGPT Atlas」では連結で来た様です。これで、バイブコーディングも楽々になりますね。

    画像

    準備完了という事で後は「ChatGPT Atlas」の中であんなことやこんな事をしていきましょう。

    画像

    右頭に、通知を許可するかしないか選択するモーダルも出ているので設定しておきましょう。

    画像

    UIは非常に使いやすく、「プロジェクト」が左カラムから、右のプルダウンに移動されています。

    画像

    Xみながら雑談するとか、もうほとんどPC一緒にのぞきならら雑談してる伴侶的な相手になっちゃってます。

    画像
    画像

    驚くほどわかりやすいUIなので、ライブ配信を解説しなくてもわかりますが、とりあえず全編解説しておきます。

    ChatGPT Atlas ライブデモ

    ChatGPT Atlas──OpenAIが発表した新しいAIブラウザ

    冒頭でサム・アルトマンCEOは次のように述べた。

    「AIは、ブラウザを再定義する10年に一度の機会をもたらしている。」

    サム・アルトマン

    AtlasはChatGPTを中核に据えた新しいブラウジング体験を提供するもので、同社はこれを「AI時代のためのブラウザ」と位置づけている。サムは「タブ以来、大きな進化がなかったブラウザを、対話を中心に再設計した」と説明した。

    本記事では、このライブ配信でサムと開発チームが紹介した内容を整理し、ChatGPT Atlasの主要な機能と構成を時系列に沿って解説する。

    サム・アルトマンによる概要説明(理念と目的)

    サム・アルトマンは冒頭で、ChatGPT Atlas を「AIによって再設計された新しいウェブブラウザ」として紹介した。彼は、AIがブラウザという概念そのものを再考する契機になると述べた。

    「AIは、ブラウザを再発明する10年に一度の機会をもたらしている。」

    サム・アルトマン

    アルトマンは、ブラウザの基本的な構造が長年変わっていないことに触れた。タブやURLバーの登場以来、ユーザー体験は進化してこなかったが、AIの登場によって新しい形が可能になると語った。

    「タブは素晴らしい発明だったが、その後のブラウザには大きな革新が見られなかった。私たちは、それをもう一度設計し直すチャンスを得た。」

    続けて、彼は新しいブラウザ体験の中心には「対話」があると説明した。URLバーや検索ボックスが従来のウェブ利用を象徴してきたように、今後はチャット体験がブラウジングの中心になるとした。

    「これまでURLバーや検索ボックスがインターネットの入り口だったように、これからは“チャット”が新しい入り口になる。」

    アルトマンによれば、ChatGPT Atlasは従来のブラウザと同様に「作業や生活の多くが行われる場」であり、そこにChatGPTを統合することで、ユーザーはウェブページと直接対話できるようになる。ユーザーはページ内で質問をしたり、情報を整理したり、さらには「エージェントモード」を利用してブラウザ上で実際の操作を代行させることができるという。

    「ChatGPTがブラウザの中心にあることで、ページと対話し、必要な情報を見つけ、操作を委ねることができる。」

    最後にアルトマンは、この取り組みを「単なる機能追加ではなく、ウェブの使い方そのものを再設計する試み」と位置づけ、続いてエンジニアリングリードのベンが詳細を紹介することを伝えて、登壇を譲った。

    ベンによるエンジニアリング構想(チャット中心設計)

    続いて登壇したのは、ChatGPT Atlas のエンジニアリングリードを務める ベン。彼は開発の出発点として「もしブラウザと会話できたら?」という問いからこのプロジェクトが始まったと説明した。

    「Atlas は、『もしブラウザとチャットできたらどうなるか?』という発想から始まった。」

    Ben Goodger

    ベンは、従来のブラウザが長年の進化の中で多くの機能を積み重ね、結果的に複雑化してきたと述べた。その複雑さを取り除き、代わりに**“会話”という最も自然な操作体系**で再構築することを目指したという。

    「私たちは、これまでのブラウザにある何年分もの“複雑さ”を、シンプルな対話へと置き換えた。」

    Ben Goodger

    この設計において重要なのは、Atlasが単に「ブラウザにチャット機能を追加したもの」ではない点だ。ベンは「ChatGPTを中心(the beating heart)に据えた設計」だと強調した。つまり、チャットが周辺機能ではなく、ブラウザ全体の構造の核に位置している。

    「Atlas は、ChatGPT を心臓部に据えたブラウザだ。
    ユーザーのそばに常に寄り添い、ウェブ上の行動すべてを支援する。」

    Ben Goodger

    ベンは、自身がAtlasを使う中で、これまでよりも自然に疑問を持ち、検索や探索を繰り返すようになったと述べた。それは「より好奇心旺盛で、情報に敏感な自分になった感覚」だという。

    「Atlas を使うと、より多くの質問を投げかけるようになった。
    結果として、より多くを学び、より情報に基づいた判断ができるようになった。」

    Ben Goodger

    最後にベンは、Atlasが高速で柔軟な基盤を持つことにも言及した。従来のブラウザの安定性や速度を維持しながら、新しい体験を重ねられる設計になっていると述べ、次の登壇者アダムに説明を引き継いだ。

    アダムによる主要機能紹介(Chat Anywhere/Memory/Agent Mode)

    次に登壇したのは、プロダクトリードの アダム。
    彼は、Atlas の基本設計が従来のブラウザ体験を維持しながらも、AIを中核に据えた点にあると説明した。

    「Atlas は、これまでのブラウザと同じようにタブ、ブックマーク、オートフィルなどの基本機能を備えています。
    しかし、その上に3つの中核的な機能を統合しています。」

    Adam Fry

    アダムが紹介した三つの主要機能は次のとおり。

    1. Chat Anywhere(ウェブ上のどこでもチャット)

    最初の機能は、ウェブ上のあらゆる場所でChatGPTと対話できる「Chat Anywhere」。
    ユーザーは、別のタブを開いたりコピー&ペーストしたりする必要なく、閲覧中のページ上で直接ChatGPTを呼び出し、その内容を参照しながら作業を続けることができる。
    この際、ChatGPTはページ内容のコンテキストを理解しており、より関連性の高い回答を返す。

    「ページの内容を踏まえて支援できるため、文書作成やメール編集などがより効率的になります。」

    Adam Fry

    2. Browser Memory(ブラウザ記憶機能)

    二つ目は、ChatGPTで好評だった**記憶(Memory)**機能のブラウザ統合版。
    Atlas はユーザーの操作履歴や参照情報を学習し、時間の経過とともに個別化された支援を行う。これにより、ユーザーは以前見たページやドキュメントを自然言語で検索し直すことができる。

    「ChatGPTの記憶機能がブラウザ全体に拡張されます。
    使用するほど、よりパーソナライズされ、理解の深いサポートが行えます。」

    Adam Fry

    3. Agent Mode(自律操作エージェント)

    三つ目は、ブラウザ上でChatGPTが実際の操作を行う「エージェントモード」。
    ユーザーの指示に応じて、カーソルが自動で動き、ボタンをクリックしたりフォームを入力したりといった操作を代行する。
    これにより、予約の手配、文書の編集、Webアプリの操作といった複雑なタスクを、ChatGPTが直接ブラウザ内で実行できるようになる。

    「ChatGPTが実際にページ上をクリックして動作します。
    予約の処理やファイルの編集など、これまでユーザーが手で行っていた操作を任せることができます。」

    Adam Fry

    アダムは、この三つの機能によってAtlasが「ブラウザを再定義する」基盤になると述べた。
    続いて、これらの要素を実際に動作させたデモンストレーションを、デザインチームのライアンが紹介した。

    ライアンによるデモンストレーション(サイドチャット・検索・カーソルチャット)

    続いて登壇したのは、リードデザイナーの ライアン。
    彼はChatGPT Atlasの主要な操作フローを、実際のデモ画面を用いて紹介した。

    画像

    ホーム画面と基本構成:

    ライアンはまず、アプリを初めて起動したときに表示されるホーム画面を紹介した。
    そこには中央に「ChatGPTへの入力欄(コンポーザー)」が配置され、ユーザーは従来のChatGPTのように質問や命令を入力できる。
    画面左には過去のチャット履歴、右にはツールやモデル選択の項目が並び、従来のChatGPTとブラウザ機能が一体化している構成となっている。

    「従来のブラウザに近い感覚で使えますが、ChatGPTのすべての機能が統合されています。」

    Ryan O’Rouke

    ライアンは「Hacker Newsを開いて」と自然言語で入力し、チャットがそのままウェブサイトのURLに遷移する様子を示した。また「Atlas Core Designのドキュメントを検索して」と入力すると、Atlasのブラウザメモリー機能が呼び出され、過去にアクセスしたGoogle Docsの該当文書を自動的に開いた。

    画像
    画像

    パーソナライズされた提案:

    ホーム画面の下部には「Suggestions(提案)」が表示されており、Atlasがユーザーの行動や履歴から推測したニュース記事やタスクを提示する。これはブラウザの個人化機能の初期版で、利用が進むほど精度が高まると説明された。

    「利用を重ねることで、Atlasはユーザーが次に行いたいことを予測し、提案を改善していきます。」

    Ryan O’Rouke

    サイドチャット機能:

    次にライアンは、GitHubのコードページを開き、“Ask ChatGPT”ボタンをクリックした。
    すると画面右側にChatGPTのサイドバーが展開し、ページ内容を読み取ったうえで質問や要約を行えるモードが表示された。
    これにより、閲覧中のウェブページを「理解可能な対象」として直接対話できる。

    画像

    「この機能により、ブラウザは単に情報を“表示するツール”から、“理解し編集できるツール”へと変わります。」

    Ryan O’Rouke

    ライアンはデモで、GitHub上のコード変更(diff)を要約させる例を示し、さらに「この変更は安全に取り込めるか?」という質問にChatGPTがリスクを分析して答える様子を紹介した。
    このやり取りを通じて、Atlasが単なる閲覧支援ではなく、思考の補助ツールとして機能する点を示した。

    検索体験の再設計:

    次にライアンは検索機能を紹介した。
    Atlasでは、検索結果がChatGPTのチャット形式で提示されるだけでなく、上部に「Images」「Videos」「News」などのタブが表示され、ユーザーがモードを切り替えて情報を探索できる。
    検索結果のリンクをクリックすると、ページが分割ビューで開き、右側にChatGPTが並行して残る。

    「検索結果を見ながら、その内容をChatGPTとやり取りできる新しい検索体験です。」

    この機能では、従来の「ページ遷移中心の検索」ではなく、「会話を通じて検索結果を理解する」形に変化している。

    カーソルチャット(Cursor Chat):

    最後にライアンはGmailの下書き画面を開き、カーソルチャット機能を紹介した。

    画像

    ユーザーが文章を選択して「ChatGPTを起動」すると、チャット欄が現れ、「文体を整えて」や「トーンを柔らかく」といった指示を送れる。
    生成された新しい文面を確認後、「Update」を押すとその場で内容が書き換わる。

    「ChatGPTでの編集が、ブラウザ上のフォームや入力欄に直接反映されます。」

    ライアンはこの機能を「Cursor Chat」と呼び、メールや文書フォームの編集をブラウザ上で完結できる仕組みとして紹介した。

    エージェントモードの実演と安全設計

    続いて登壇したのは、Atlas チームの ウィル・エルズワース(リサーチリード)、ジャスティン(エンジニア)、プラノブ(プロダクトリード) の3名。
    このセクションでは、ChatGPTがブラウザを操作してタスクを実行する「Agent Mode(エージェントモード)」の実演が行われた。

    Googleドキュメントでの業務支援デモ:

    ウィルは最初に、「ハロウィンのイベント企画書」というGoogleドキュメントを開き、そこで進行中のプロジェクト管理タスクを例にエージェントモードを起動した。

    画像
    ChatGPTがGoogle Docs上のタスク表を解析し、未入力者にコメントを追加する様子


    この文書には、担当者のタスク一覧が記されていたが、いくつか未入力の項目が残っていた。ウィルは、ChatGPTに対して以下の2つの指示を与えた。

    1. タスク未記入のメンバーに、入力を促すコメントを残すこと。

    2. 記入済みのタスクを外部のタスク管理ツール「Linear」に転記して、正式な課題(issue)として登録すること。

    エージェントモードを起動すると、ブラウザ上にChatGPTの専用カーソルが出現し、自動的にクリックや入力を開始した。ウィルはこれを「ChatGPTが自分の代わりにブラウザを操作している」と説明した。

    「エージェントは私のローカル認証情報や履歴にアクセスでき、まるで自分自身が操作しているかのようにタスクを遂行します。」

    この間、ユーザーは別のタブで他の作業を続けることも可能であり、ウィルが離れている間にエージェントはGoogle Docs上のコメント投稿とLinearへの転記を完了した。

    画像
    Googleドキュメントのサイドバーに常駐するChatGPT。Geminiの位置に置き換わり、リアルタイムで文書操作を行う

    日常利用の例ー買い物支援:

    続いてジャスティンが、個人利用の例として「レシピサイトで買い物リストを自動生成・注文する」デモを紹介した。
    レシピページを開いた状態で「8人分を作るために必要な食材をまとめて」と入力すると、ChatGPTはページを解析して材料リストを抽出し、分量を自動計算した。

    画像
    ChatGPTがブラウザ上のレシピ記事をリアルタイムで読んで、買い物リストを自動生成しているところ。


    ジャスティンがさらに「肉と野菜だけを注文して」と指示すると、Atlasはエージェントモードを起動し、ユーザーが普段利用している通販サービス「Instacart」にアクセス。自動的に検索・商品選択・カート追加までを実行した。

    「ChatGPTが私の買い物習慣を理解しており、指定したサイトに移動して必要な項目を追加します。」

    ジャスティンは、エージェントが高速でタイピングし、数分でカートを完成させる様子を実演した。

    画像
    ChatGPTがInstacart上でユーザーの代わりに買い物を“している”ところ。

    安全設計とアクセス制御:

    プラノブは、Atlasのエージェントがもつ安全設計について説明した。
    エージェントモードでは、ChatGPTが操作できる範囲がブラウザのタブ内に限定されており、コンピュータ上の他のファイルやシステムにはアクセスできない。
    また、各タブごとに「ChatGPT Agentをログイン状態にするかどうか」をユーザーが選択でき、ログイン情報の共有や保存も制御可能だという。

    「どのサイトにアクセス権を与えるかは常にユーザーが選択できます。
    記憶機能(Memory)も任意でオン・オフでき、保存内容は設定画面から確認・削除可能です。」

    また、プライバシー保護のために**インコグニートウィンドウ(匿名モード)**も利用でき、これを使えばチャット内容や履歴が記録されない状態で操作が行える。

    最後にウィルは、実演の結果として、ChatGPTが生成したInstacartのカート内容と、Linear上に自動作成されたタスク一覧を確認した。どちらも担当者の割り当てやコメントまで正しく反映されていたことを示し、次のように締めくくった。

    「ブラウザ操作を委任することで、業務と生活の両方で多くの時間を節約できる。
    ChatGPTは“コードを書くツール”から、“生活を支援するツール”へと拡張している。」

    画像
    ChatGPTが「ユーザーの行動ログ(logged-in context)」を理解して、次にやるべきことを提案している瞬間

    「Agent mode」っていうモードが選択されてて、そこに「Logged in / Logged out」ってオプションがある。これはAIがユーザーの各種アカウントに接続してタスクを実行できる状態を意味してる。
    たとえばGmail、カレンダー、航空券予約サイト、ショッピングサイトとか。ログイン状態だと、ChatGPTはこういう情報を扱える:

    • カレンダーから「次の会議」や「今日の空き時間」を把握

    • メール内容から「未返信タスク」や「請求関連」を抽出

    • ショッピング履歴や検索履歴から「今日やるべきToDo」を構成

    つまりこのUIの裏では、“デジタル生活全体を見渡して、文脈的に次の行動を提示”してる。「Describe a task」って欄は、もう命令文入力欄じゃなくて“共同行動の設計窓口”だ。

    ざっくり言うと、ここでChatGPTは「あなたの代わりにWebを見る」のじゃなくて、「あなたの代わりに“人生のレイヤー”を見てる」。だから“次に何をすべきか”を自然に理解してるわけだ。

    サムによるまとめとリリース情報

    発表の最後に、再びサム・アルトマンが登壇した。
    彼はAtlasを「これからも継続的に拡張していくプロジェクト」と位置づけ、今回の発表はその第一段階であると述べた。

    「Atlasは今日からMacOS向けに世界同時リリースされます。
    エージェントモードは現時点ではPlusおよびProユーザー限定ですが、
    Windowsやモバイルへの対応もできるだけ早く進めていきます。」

    サム・アルトマン

    サムは、Atlasを単なるブラウザの新製品ではなく、「インターネットの使い方を再定義する基盤」として説明した。
    特に、カスタムインストラクション(個別設定)やエージェントによるタスク実行が、今後の拡張の中心になると語った。

    「私たちが目指しているのは、ChatGPTがユーザーを理解し、
    その人の行動や意図に沿って自律的に動ける環境です。
    それがブラウザ上で自然に実現するよう設計しています。」

    サム・アルトマン

    また、ChatGPT Atlasの進化方向として、「ユーザーをより深く理解し、必要な情報や行動を先回りして提示するエージェント体験」を挙げた。
    サムは「この基盤を使うことで、ウェブの生産性と快適さを大幅に高められる」と語り、今後もユーザーからのフィードバックをもとに開発を続ける方針を示した。

    「これはまだ始まりにすぎません。
    フィードバックを受けながら、さらに多くの機能を追加していきます。」

    サム・アルトマン

    発表の締めくくりとして、サムは「ChatGPT Atlasを通じて、ウェブという空間そのものをより知的で生産的な環境にしていきたい」と述べ、ライブ配信を終えた。

     
     
    広告デザイン、エディトリアルデザイン、Webフロントエンド開発を経て、サイバーエージェントや楽天の新人研修での登壇・指導をきっかけに講師業へ。現在はAIを使った業務設計と運用を実装している。

    あなたへのおすすめ