メインコンテンツへスキップ
見出し画像

GoogleのAIサービスの紹介@2025年11月更新

    1.概要

     Googleが提供しているAIサービスについて、整理してみました。
     参考として、Gemini Drop で最新リリースの内容を簡単に把握できます。

    1-1.料金プラン

    Gemini  @2025年9月

    画像
    https://gemini.google/about/?_gl=1*s1vlqj*_gcl_au*MTU0NTc0NTQxLjE3NTUzODU2NDg.*_ga*MjkyMjQzNDQxLjE3Mzg2NzAzNTY.*_ga_WC57KJ50ZZ*czE3NTY1MTUzMDgkbzI1OSRnMSR0MTc1NjUxODgwMyRqNjAkbDAkaDA.
    https://one.google.com/intl/ja_jp/about/google-ai-plans/

    Google Workspace @2025年9月

    画像
    https://workspace.google.com/intl/ja/#pricing

    1-2.セキュリティ(データ保護)

     会社でも使用する場合、情報漏洩に対するリスク管理は重要です。論点として「入力したデータがAIモデルの学習に利用されるか」について、結論としてはGoogle Workspace版での利用が推奨されます。

    【個人版Gemini(有償・無償含む)】
     最低限のプライバシー保護はされておりますが、Geminiのサービス改善(モデルの学習)に利用される可能性はあります。

    画像
    https://support.google.com/gemini/answer/13594961?hl=ja&authuser=1

     履歴の自動削除を設定/アクティビティの保存自体をオフによりセキュリティ強化は可能です。しかしアクティビティをオフにすれば、会話履歴は保存されず、モデルの学習にも利用されませんが、過去の会話を振り返ることはできなくなります。

     つまりそもそもの設計思想がビジネス向けとは異なります。

    画像
    https://myactivity.google.com/u/1/product/gemini?pli=1

    【Gemini for Google Workspace (法人・組織版)】
     Google Workspaceははエンタープライズ セキュリティに対応しており、データの機密性と管理性を最優先に設計されています。

    お客様のプライバシーが最優先

    生成 AI は、お客様が自らデータの選択と管理を行えるようにするための、Google の基本的なプライバシー保護の取り組みを変えるものではありません。
    ・Gemini とのやり取りが組織外に開示されることはありません。Gemini は、お客様の許可なくコンテンツを組織外に共有することはありません。
    ・既存の Google Workspace の保護は自動的に適用されます。Gemini は、他の Google Workspace サービスと同じエンタープライズ グレードのセキュリティを提供します。
    ・お客様のコンテンツが他のお客様のために使用されることはありません。 お客様のコンテンツは、人間によってレビューされることも、許可なくお客様のドメイン外で生成 AI モデルのトレーニングに使用されることもありません。

    Google Workspace の生成 AI に関するプライバシー ハブ

     Geminiのプロンプト欄に盾マークがついているものはエンタープライズ版となります。

    画像

    1-3.Chrome拡張機能

     Geminiなど別サービスと相性が良い拡張機能を紹介します。

     データ抽出

    拡張機能ではないですがGoogleレンズでもOCR可能です。

     下図をGoogleレンズで読んでも、テキスト抽出できました。

    画像
    画像

    Obsidian Web Clipper
     ページ内の不要な情報は除いてMarkdown形式でコピペ可能

    Easy Scraper
     サクッとWebページをスクレイピングしてくれます。テーブルデータを簡単に抽出できるため、CSVやExcelと相性が良いです。

    画像

     連携・効率化

    Permanent Clipboard
     テキストを保存可能->よく使うプロンプトをメモしておく

    Gemini エクスポーター
     
    Geminiの会話をPDF、Markdown、テキスト(TXT)、JSON、CSV、画像などの複数の形式でエクスポートできます。

    Shortcuts for Google™
     ブラウザ上にポップアップボタンを付けてショートカットを出せます。

    画像
    私のショートカット一覧

    コラム:Googleのハードウェア

     2025年8月28日よりGoogleのスマホPIxel10シリーズがリリースされました。モデルは4種類あります。

    画像
    https://store.google.com/jp/product/pixel_10_pro?hl=ja

     スマホの機能は置いといて、AIに関しては「Gemini Nanoをローカル処理」、「Gemini Liveに接続しやすい」、「AIで100倍ズーム」くらいでしょうか・・・・

     個人的には「性能の良いカメラで通信が良ければ、予算無しならiphoneでよくね?」とは思います。


    2.Gemini-基礎編

     Googleが提供するマルチモーダルAIのサービスです(※マルチモーダル:テキストだけでなく、画像、音声、動画などを同時に扱える)。詳細は下記記事参照。

     Web画面は以下参照。使用方法はブラウザ(gemini.google.com)または、モバイルアプリから操作可能です。

    画像
    Geminiのホーム画面 (Proユーザー)

     概要として下記が実施可能です。一部を追加で紹介します。

    • Prompt(テキスト)での対話:Promptに対してテキストデータを出力し、予約、会話、翻訳などが可能

    • Googleアプリ連携:Gmail、Google カレンダー、Google マップ、YouTube、Google フォトなどと連携可能

    • Gemini Live(音声会話):音声でリアルタイムに対話できるモード

    • Canvas(コード実行・編集):出力編集や視覚化(HTMLやLP作成)可能

    2-1.Googleアプリ連携

     私が良く使うのはGoogleカレンダーです。Geminiに予定をコピペして「カレンダーに入れて」というだけでアプリに追加してくれます。
    ※終日でいれてくれない(難しい)ので、時刻も合わせて入れるのがベスト。

    画像

    2-2.Gemini Live

     Gemini Liveでは、話しかけるだけでスムーズな会話をすることができます。ただし現在下記制限があります。

    • モバイルアプリのみ(PCでは使用不可)

    • Gemからは使用できない

      • ブレストなど知的生産のようなトークはロールプレイングプロンプトのような事前の情報が無いとレベルが低すぎて仕事ではつかえない


    3.Gemini-機能

    3-1.Gem(カスタム指示)

      Promptを記憶させる(カスタム指示)ことで自分専用のカスタム AIを作成できます。普段から使用するPromptを覚えさえることで効率的な指示が可能です。

     プリメイド Gem

     プリメイド Gem とはあらかじめ用意された Gemです。ニーズに合わせてカスタマイズすることもできます。

    • 家庭教師:複雑なトピックを分解して、理解しやすくするのに役立ちます。

    • アイデア出しのプロ:パーティーのアイデアや、誕生日にぴったりのプレゼントなど、インスピレーションを得ることができます。

    • キャリア アドバイザー:スキルを磨き、キャリア目標を達成するための詳細な計画で、キャリアの可能性を広げられます。

    • 編集者と校正役:文法や文章構造など、さまざまな点について明確で建設的なフィードバックを提供し、文章の質を高めます。

    • コーディング パートナー:コーディング スキルをレベルアップして、プロジェクトの構築と学習を手助けします。

    画像

     カスタムGem

     自分の目的に合ったカスタム Gem を作成可能です。例として以下4つを含めることで効果的な出力が得られます。
    ー>良い事例は次章で紹介

    画像

    3-2.Deep Research

     ユーザーの代わりに数百ものウェブサイトを自動的に参照し、得られた結果を分析して、複数のページで構成される分析情報のレポートを数分で作成

    3-3.画像生成(Imagen)

     Gemini にテキスト、画像、またはその両方を組み合わせて指示することで、新しい画像を生成できます

     AI 生成コンテンツであることを認識できるよう「SynthID」という人間には認識できない透かしを入れています。

    3-4.動画生成(Veo 3)

    3-5.Gemini Canvas

     下記参照。

    3-6.Gemini in Chrome

    ※現在、米国ユーザーのみ

    3-7.Deep Think

    ※現在、Ultraユーザーのみ


    4.Gemini-応用

     Geminiを最大限使いこなすことでできることを紹介します。
     詳細は下記参照。

    4-1.スライド作成(まじんさん)

     Gemにプロンプトを投げGoogleスライドを作成することが出来ます。

     スライド作成手順は以下の通り(詳細は元記事より)

    1. Gem作成(初回のみ)

    2. 作成したGemにスライド化したいデータを渡す。

      • 例:DeepResearchの結果を丸ごと渡す

    3. 空のGoogleスライドを作成し、「拡張機能」→「Apps Script」を開く

    4. コード.gsのデフォルト値は削除し、2の出力をコピペ

    5. コードの保存 → 「実行」をクリック

    画像

     2025年9月28日公開のまじん式プロンプトv3で作成したスライドを共有します(DeepResearchで自分の情報を調査)。

    4-2.Nano Banana

     2025年8月26日に公開された新画像編集モデルです。キーポイントは「編集しても見た目を維持/対話型の編集」です。
     マンガやアニメなど、画像の出力を統一する必要があるものには重要となります。例として下記が出来ます。Imageと同様にSynthIDは入ります

    • 衣装や場所の変更:画像情報は残して指定場所を変更

    • 写真の合成:複数の画像を渡して、それをプロンプトに従って合成

    • 生成画像のアップデート(複数回にわたる編集):生成した画像に情報を追加したり、逆に削除したりもできます。

    • デザインの融合:ある画像のスタイルを別の画像に適用(多分JOJO風とかできます)

     使用方法

     nano bananaの遊び方は下記の通りです。
    ※現時点で日本語のプロンプトは苦手みたいのため、推奨は英語です。

    1. gemini

      • ホーム画面(アプリ・PC共に対応)から普通に選べます

    2. Google API

    3. Google AI Studio

    画像

     プロンプトガイド

     プロンプトパターンは以下の通り。

    • Text-to-Image: テキストから画像生成

    • 画像 + テキストから画像(編集): 画像を指定し、テキストで画像を調整

    • Multi-Image to Image(構図とスタイル転送): 複数画像で別の画像生成

    • 反復的な調整: 会話を通じて画像を徐々に調整

    • 高忠実度のテキスト レンダリング: ロゴなどのテキスト入り画像生成

    • その他の画像生成モード

      • テキスト->画像とテキスト:イラスト付きレシピなど

      • 画像+テキスト画像->画像+テキスト画像

      • マルチターン画像編集: 対話形式で画像を生成、編集し続ける

     Gemini 2.5 Flash 画像生成を使いこなすための基本原則および戦略は以下の通り。

    <基本原則>
    キーワードを列挙するだけでなく、シーンを説明する。
    Geminiは言語を深く理解できます。よって、関連性のない単語のリストよりも、物語や説明文の段落の方が優れた一貫性のある画像を生成できる。

    プロンプト事例

    1. 写真風(フォトリアリスティック):

      • リアルな画像の場合は、写真用語を使用

      • カメラアングル、レンズの種類、照明、細部について言及

    2. スタイルを適用したイラストとステッカー(切り抜き・貼り紙)

      1. スタイルを明確に指定し、背景を透明にするようリクエスト

    3. 文字を正確に入れる:

      • 入れたい文字と書体の雰囲気(例:モダン、シンプル)を両方指定

    4. 商品のモックアップと広告写真(モノをきれいに見せる):

      • 「スタジオ照明」「無地背景」「高解像度」などような環境を指定

    5. 余白を活かす(ミニマルでネガティブ スペースを活かす):

      • 被写体を置く位置(フレームの右下)や何もない空間(余白)を指示

    6. 部分的に修正(インペイント):

      • 「(特定の部分)だけを(別のもの)に変えて。他はそのまま」と、変更箇所を限定して指示

    ベストプラクティス

    • 具体的な内容にする: 詳細な内容にするほど、より細かく制御できる

    • 背景と意図を説明: 画像の目的を説明する。

      • モデルのコンテキストの理解が最終出力に影響

      • 例:「ロゴを作成して」より「高級でミニマリストなスキンケア ブランドのロゴを作成して」の方が良い

    • イテレーションと改良: モデルの会話的な性質を利用し、小さな変更を行う

      • 最初の試行で完璧な画像が生成されるとは限らない

    • ステップバイステップの手順を使用: プロンプトをステップに分割

      • 多くの要素を含む複雑なシーンに有効

      • 例:まず、夜明けの静かで霧がかった森の背景を作成します。次に、前景に苔むした古代の石の祭壇を追加します。最後に、祭壇の上に光る剣を 1 本置きます。

    • 「セマンティック ネガティブ プロンプト」を使用:

      • 「車がない」より「交通の兆候がない空っぽの寂れた通り」のように、望ましいシーンを肯定的に説明

    • カメラを制御: 写真や映画の用語を使用し、構図を制御

      • wide-angle shot、macro shot、low-angle perspective などの用語

     実践

     それでは遊んでみます。

    【画像 + テキストから画像(編集)】
     「プロフィール紹介:KIYO」にある”猫の画像”+下記プロンプトにより、”元画像の情報を保持した”のバナナを食べる猫の AI 生成画像が作れました。

    Case1

    [Prompt]
    "Create a picture of my cat eating a nano-banana in a "
        "fancy restaurant under the Gemini constellation"
    画像

    Case2

    [Prompt]
    "Create a picture of my cat eating a nano-banana in a "
        "fancy restaurant under the Gemini constellation"
    画像

    【画像合成】
     
    「茜さやさん(ぱくたそ)」と「犬カフェで撮影したゴールデンレトリーバー(別添3参照)」を合成しました。プロンプトは結論として下記英語を使用しました。 
     最初はシンプルなプロンプトにしたのですが全然ダメだったので、Geminiでプロンプトを作ってもらいました。更に日本語と英語の両方で試したのですが、日本語ではうまくいかなかったので英語にしました。

    [Prompt]
    日本語:
    「1枚目の画像に写っている女性が、2枚目の画像に写っているゴールデンレトリバーを犬カフェで優しくなでている。女性は笑顔で、ゴールデンレトリバーも気持ちよさそうにしている。温かみのある光の中で、幸せそうな雰囲気が伝わる写真。」
    
    英語:
    "The woman from the first image is gently petting the Golden Retriever from the second image at a dog cafe. The woman is smiling, and the Golden Retriever looks content. A photograph conveying a happy atmosphere under warm lighting."
    画像

    【対話的修正】
     
    徐々に自分の希望する画像に変更していきます。

    [Prompt1]
    サンプルとして、空室のマンションのリビングをかいて。バルコニーが見える向きから
    [Prompt2]
    この部屋の右の壁に、茶色のシックなソファーを設置して
    [Prompt3]
    FOR RENTの札は外して
    [Prompt4]
    ソファーの前に、人の手が届く距離くらいに、ソファーと同じサイズのガラスのテーブルを設置して。テーブルの上には観葉植物を設置して
    画像

    Nano Banana 作例集
     様々なプロンプト事例が紹介されています。面白いの2つだけ紹介。

    【Prompt】
    アップした画像のモチーフのみを精密に線画に起こして。光源・影などは無視すること
    画像
    図 画像を線画にする(スケッチや塗り絵など作れる)
    【Prompt】
    Generate avatars of this person with different hairstyles in a 3x3 grid format
    画像
    図 Input画像の髪型を変える

    5.Gemini CLI


    6.Google Labs

     Google Labsでは、一般ユーザーがGoogleが開発中の最新の実験的なAIプロジェクトや機能を早期に試すことができます。

    画像
    https://labs.google/fx/ja

    Opal:ミニAIアプリ構築

    Whisk:画像生成(Im2Im)

     Whisk は、詳細なテキスト プロンプトの必要なく、画像をプロンプトとして使用する画像生成 AI です。

     画像を選択して、Whisk に入力するだけで簡単にブレンドできます。
    左が入力画像(モデル:ネコ、背景:例のプール、スタイル:ゴッホ)で、右が出力画像2種です。

    画像

    ImageFX:画像生成(Text2Im)

     ImageFX は、簡単なテキスト プロンプトを使用して画像を作成できる Labs の新しいツールです。
    ※画像生成用AIモデルのImagen 3はGeminiでも利用可能

    Flow:動画生成

    MusicFX:音楽生成


    7.Notebook LM

     手持ちの資料(ドキュメント、PDF、テキストファイル、WebサイトのURLなど)をAIが理解し、下記などを実行できる。

    • 自然言語処理:要約、質疑応答や詳細レポート作成など

    • マインドマップ作成

    • 音声概要:「 2 人の AI ホストによるポッドキャスト形式の議論」を生成

    • 動画解説:


    8.Jules

     Julesは、Googleが開発した非同期型コーディングエージェントです。


    9.IDE

     AIエージェント主導のIDEとしてAntigravityをリリースしています。


    10.Platform

     主に開発者や企業がAIサービスを構築・運用するための基盤(プラットフォーム)を紹介します。

    Google AI Studio:プロトタイプ作成

     ブラウザ上でGoogleの最新AIモデル群を簡単に試したり、プロトタイプを作成したりできる開発者向けのWebツールです。

    Workspace Flows:自動化ツール

    Vertex AI Platform:機械学習向け

     Vertex AI は、ML モデルと AI アプリケーションをトレーニングしてデプロイできる ML プラットフォームです。

    画像

    Firebase Studio:フルスタックアプリ

     ブラウザから、AI を取り入れたフルスタック アプリのプロトタイプ作成、構築、製品化を迅速かつ効率的に行います。


    11.Google Work Flows


    12.Project Mariner

     Project Marinerは、複数のステップや異なるアプリケーションにまたがる複雑なタスクを自働でこなすAIエージェントです。

    画像
    https://labs.google.com/mariner/landing

     まだ(国内のUltraユーザーにも?)サービス展開されていませんが、期待される技術となります。

    Google I/Oで一番ワクワクしたのはブラウザを操作する「Project Mariner」かな!

    ・ブラウザを操作するAIエージェント
    ・ユーザーの指示に応じてWeb操作を代行
    ・最大10タスク同時進行
    ・ユーザーが一度教えたら次から似たような操作ができる「teach & repeat」
    ・Geminiにも「Agent Mode」として導入… pic.twitter.com/G4xdIG9uly

    — エクセル兄さん(たてばやし淳)@ExcelとChatGPT著書多数 (@excel_niisan) May 20, 2025

    参考資料

    別添1:Google公式

    別添2:技術ブログ

    別添3.サンプル画像

    画像
    画像
    画像
    https://www.instagram.com/dogtouch.rink_anjyo/

    あとがき

     とりあえずできることが多いのは分かったけど、使いこなすのも一苦労だな・・・

    改正履歴

    • 2025年9月7日:初版発行

      • 目次+概要は完成、Nano bananaで遊び中

    • 2025年10月11日:情報追加

    • 2025年10月19日:Whiskを追加

    • 2025年11月16日:OpalとFlowsの記事追加

    • 2025年12月7日:

      • カバー更新

      • Google Antigravityの追加

      • Google AI Studio追加


     
     

    KIYO

     
     
    普段は製造業で企画/開発/設計しております。記事はプログラミング・機械学習、IoT関係の記事をメインで作成し、なるべく1つの記事で知りたいことを網羅していきます。内容は学術的より実装・アウトプット(ほしくなるもの)を重視して作成しています。 面白そうな仕事があればやりたいです!

    あなたへのおすすめ