コンテンツへスキップ

media AI活用の最前線

ChatGPT活用

ChatGPT音声会話(GPT-Live)とは|使い方と無料枠【2026年9月】

ChatGPT音声会話(GPT-Live)の使い方・無料枠とプラン別の上限(2026年9月)

【2026年9月4日更新】解説図を追加し、モデル名・単価を現行へ更新しました。

ChatGPTの音声会話(GPT-Live)3秒まとめ・2026年9月22日時点

  • 始め方: スマホアプリ/Web(chatgpt.com)の入力欄にある音声アイコンを押して話すだけ。設定→Voice で「Live/Advanced/Standard」を切り替えられます。
  • 無料で使える?: 使えます(無料プランは軽量版 GPT-Live-1 mini を限定的に)。Go・Plus は直近 24 時間で 3 時間、Pro($200)は無制限、Business Standard は 3 時間・Premium は 15 時間(超過は 1 分 1.25 クレジット)。
  • 法人で使うなら: Business/Enterprise/Edu の会話は既定でモデルの学習に使われず、Enterprise/Edu では管理者が Voice を有効化・無効化できます(OpenAI 公式ヘルプ)。

結論: ChatGPTの音声会話は、2026年9月時点では「GPT-Live」で動いています。GPT-Liveは、OpenAIが2026年7月8日(米国時間、日本時間7月9日)に発表した新しい音声会話モデルで、聞くことと話すことを同時に行う「フルデュプレックス」方式によってChatGPTの音声対話を刷新します。読み方は「GPTライブ」で、「ChatGPTライブ」「チャットGPTライブ」とも表記されます。

  • 要点1: 有料プラン(Go/Plus/Pro)には上位モデル「GPT-Live-1」、無料プランには軽量版「GPT-Live-1 mini」がデフォルトとして順次展開されます
  • 要点2: 深い調査や複雑な推論が必要な場面では、会話を止めずにバックグラウンドでGPT-5.5に処理を委任する仕組みが導入されました
  • 要点3: 会話モデル(GPT-Live-1)は2026年9月10日からAPIでも提供が始まりました(音声部分は1分あたり$0.05・秒単位課金、推論やツール呼び出しに使うバックエンドモデルの料金は別)。それまでは音声認識専用の「GPT Live Transcribe」(2026年7月28日〜)だけがAPIで使えました。企業導入はChatGPTアプリ経由に加え、自社システムへの組み込みも現実的になりました

対象読者: ChatGPTの音声機能をビジネスで活用したい経営者・情シス/DX担当者、AI業界の最新動向を追いたい方

読了後にできること: GPT-Liveと従来の音声AIとの違いを説明でき、自社の会議・電話応対・ハンズフリー業務での活用可能性を検討できる

最終更新:2026年9月14日

「ChatGPTと話していると、こちらが話し終わるまでずっと”待たれている”感じがする」——音声AIを使ったことがある人なら、一度はこの違和感を覚えたのではないでしょうか。人間同士の会話では、相手の話を聞きながら相づちを打ったり、言いたいことがあれば自然に割り込んだりします。ところが従来の音声AIの多くは、ユーザーが話し終えるのを待ってから応答する「ターン制」が基本で、その”間”がどうしても機械的な印象を生んでいました。

OpenAIは2026年7月8日(米国時間、日本時間7月9日)、この課題に正面から取り組んだ新しい音声モデル「GPT-Live」を発表しました。聞くことと話すことを同時に行う「フルデュプレックス(全二重)」方式を採用し、ChatGPTの音声会話そのものを刷新するという発表です。ChatGPTの音声機能はすでに会議メモ・語学練習・ハンズフリー作業など業務の現場でも使われ始めており、今回のアップデートはその使い勝手を大きく左右する可能性があります。

この記事では、GPT-Liveの発表内容を一次情報ベースで整理したうえで、対応プランや料金、使い方、そして企業がこの新しい音声AIをどう業務に活かせるかを、現時点で確認できている事実だけをもとに解説します。

GPT-Liveとは — ChatGPT音声を刷新する新モデル

ターン制の従来Voiceとフルデュプレックス方式のGPT-Liveの違いを2枚のカードで比較した図
図1:ターン制とフルデュプレックスの違い。GPT-Liveは聞き取りと発話を同時に行う

GPT-Liveとは、OpenAIが2026年7月に発表した、ChatGPTの音声会話機能(ChatGPT Voice)向けの新しい音声モデルです。最大の特徴は「フルデュプレックス(全二重)アーキテクチャ」を採用している点で、AIが聞き取りと発話を同時に行いながら、1秒間に何度も「話すか」「聞き続けるか」「一時停止するか」「割り込むか」を判断します。これにより、相づちを打つ、ユーザーが考えている間は静かに待つ、話の途中でも自然に反応する、といった人間の会話に近い振る舞いが可能になりました。

ビジネスでのChatGPT活用全般の基礎知識はChatGPTビジネス活用完全ガイドでまとめています。GPT-Liveはその音声版のアップデートにあたる位置づけです。

OpenAIは2つのモデルを同時に展開しています。

  • GPT-Live-1:有料プラン(Go / Plus / Pro)のデフォルト音声モデル
  • GPT-Live-1 mini:無料プランのデフォルト音声モデル(軽量版)

何が起きたのか — 発表内容の全体像

まず、報道されている発表内容を整理します。数字や仕様は今後のアップデートで変わる可能性があるため、記載時点の情報として参照してください。

項目内容
発表日2026年7月8日(米国時間)/日本時間では7月9日
発表元OpenAI
モデル名GPT-Live-1(有料プラン向け)、GPT-Live-1 mini(無料プラン向け)
提供形態ChatGPT Web版・iOS/Androidアプリの音声会話機能として順次展開
技術方式フルデュプレックス(全二重)アーキテクチャ。聞き取りと発話を同時進行
バックエンド連携複雑な推論・検索が必要な場面ではGPT-5.5にバックグラウンドで処理を委任
新機能音声会話中に天気・株価・スポーツ等の情報をビジュアルカードで表示(海外メディア報道ベース)
API提供2026年9月10日からAPIで提供開始(GPT-Live-1)。音声部分は1分あたり$0.05(秒単位課金)、バックエンドモデル料金は別
追加料金現時点で明らかにされていません

何が変わったのか — 「フルデュプレックス」で会話のクセが変わる

これまでのChatGPT Voice(Advanced Voice Mode)は、ユーザーが話し終えたことを検出してからAIが応答する「ターン制」が基本でした。無音を検知して初めて「発言が終わった」と判断する仕組みのため、少し考える間を置いただけで話を遮られたり、逆に相手の発言が終わっているのに応答が遅れたりすることがありました。

GPT-Liveは、この構造そのものを変えています。常に聞き取りと発話の両方を並行して処理し、1秒間に何度も「話すべきか」「聞き続けるべきか」「黙って待つべきか」「割り込むべきか」を判断し続けます。Impress Watchの報道では、好感度や会話の順番、割り込みへの対応、会話の自然さなどを評価する5〜10分間の対等な会話比較テストで、従来モデルより「圧倒的に好まれている」と評価されたと伝えられています。

項目従来のChatGPT Voice(Advanced Voice Mode)GPT-Live
会話方式ターン制(発言→沈黙検知→応答)フルデュプレックス(聞き取りと発話が同時進行)
応答判断発言の終わりを検出してから応答を開始1秒間に何度も「話す/聞く/待つ/割り込む」を判断
相づち・割り込み苦手(発話が終わるまで基本反応しない)自然な相づち・割り込みへの対応を強化
複雑な処理への対応基本的にモデル単体で処理必要に応じてGPT-5.5にバックグラウンドで処理を委任し、会話を止めずに結果を反映
画面表示基本的に音声のみ天気・株価・スポーツ等をビジュアルカードで表示(海外メディア報道ベース)

バックグラウンドで動くモデルであるGPT-5.5についてはGPT-5.5 Instantとは?企業AI運用の新標準と導入アクションで解説しています。一部報道(gihyo.jp、MarkTechPost)によれば、GPT-Live-1には処理の深さに応じた複数の段階が用意されており、状況に応じてバックグラウンドで使われるGPT-5.5の推論の深さが切り替わる仕組みがあるとされています。GPT-Live-1 miniは軽量なGPT-5.5 Instantのみを使う構成と報じられています。ただし、この切り替えがユーザー操作によるものか自動なのか、詳細な提供形態はまだ明確になっていません。

対応プラン・料金 — ChatGPTの音声会話は無料でどこまで使えるか(2026年9月22日時点)

Free・Go/Plus/Pro・API開発者向けのプラン別デフォルト音声モデルを3枚のカードで整理した図
図2:プラン別のデフォルト音声モデル。無料プランはGPT-Live-1 mini、有料プランはGPT-Live-1

音声会話(Live)の利用可否とモデルは、契約中の ChatGPT プランで自動的に決まります。追加のオプション申し込みは不要です。上限は OpenAI 公式ヘルプ「ChatGPT Voice」(2026年9月22日参照)の記載で、直近 24 時間の利用時間で数えます(上限に達すると ChatGPT が通知します)。

プラン音声モデル音声会話(Live)の上限・24 時間あたり
FreeGPT-Live-1 mini限定的に利用可(上限は変更されることがある)
GoGPT-Live-1 mini3 時間
PlusGPT-Live-13 時間
Pro($100/月)GPT-Live-115 時間
Pro($200/月)GPT-Live-1無制限
Business StandardGPT-Live-13 時間(超過は 1 分あたり 1.25 クレジット)
Business PremiumGPT-Live-115 時間(超過は 1 分あたり 1.25 クレジット)
Enterprise/Edu(クレジット課金)GPT-Live-11 分あたり 1.25 クレジット
Enterprise(従量・米ドル課金)GPT-Live-11 分あたり $0.05
API(開発者向け)GPT-Live-1(2026年9月10日〜)音声部分 1分あたり$0.05(秒単位課金)・バックエンドモデル料金は別
ChatGPT音声会話(Live)のプラン別上限。FreeはGPT-Live-1 miniを限定的に、Goは24時間で3時間(mini)、Plus・Business Standardは24時間で3時間、Pro・Business Premiumは24時間で15時間(Pro $200は無制限)
図4: 音声会話の上限は直近 24 時間あたりで決まる(OpenAI 公式ヘルプ・2026年9月22日参照)

ChatGPTの有料プラン全体の違い(Go/Plus/Pro/Business/Enterpriseの使い分けなど)はChatGPT有料プラン比較【2026年最新】で詳しく比較しています。Pro の $200 プランは 2026年9月22日時点で新規申込と切り替えが一時停止と公式ヘルプに表示されています(既存契約は継続)。音声会話そのものの追加課金は無く、既存プランの上限内で使えます。

主要AIモデルの料金体系を横断的に比較した最新版は主要AIモデルAPI料金 横断比較【2026年6月・毎月更新】にまとめています。GPT-Live-1のAPI料金(音声部分1分あたり$0.05)は2026年9月10日に公開されました。

【2026年9月10日更新】GPT-Live-1がAPIで提供開始

OpenAIは2026年9月10日、会話型音声モデル「GPT-Live-1」をAPIで提供開始しました(OpenAI公式発表・参照日: 2026-09-14)。料金は音声部分が1分あたり$0.05(秒単位課金)で、推論やツール呼び出しに使うバックエンドモデルの利用料は別途かかります。発話中の割り込みや依頼の変更への対応、背景雑音と発話の区別、声の調子や話す速さの指示など、ChatGPTアプリ版と同じ全二重の会話を自社のアプリや電話応対システムに組み込めるようになりました。公式発表の数値では応答開始まで0.798秒、ツール呼び出しの正確性は87%とされています(gihyo.jpの報道)。以下の各節にある「API未提供」を前提にした記述は、この更新より前の状況です。

【2026年8月更新】音声関連APIの新展開 — 「GPT Live Transcribe」

ChatGPT音声会話そのもの(GPT-Live-1・GPT-Live-1 mini)のAPI提供は2026年8月時点ではまだ始まっていませんでした(上記のとおり9月10日に開始)。ただしOpenAIの開発者向けAPI変更履歴(developers.openai.com、参照日: 2026-08-14)によると、2026年7月28日に低遅延ストリーミング文字起こしに特化した新モデル「GPT Live Transcribe」(v1/audio/transcriptions・v1/realtime)が公開されています。これは音声認識(Speech-to-Text)専用のモデルで、ChatGPTの会話型音声モデルであるGPT-Live-1そのものをAPI経由で利用できるようになったわけではない点にご注意ください。OpenAIの公式料金ページ(参照日: 2026-09-04)では、この文字起こしモデルはgpt-live-transcribeとして掲載され、料金は1分あたり$0.017(Live transcription)と明記されています。一方、同ページのモデル一覧に会話モデル(GPT-Live-1 / GPT-Live-1 mini)のAPI項目は2026年9月4日時点でも掲載されていません。

無料プランでどこまで使えるか

無料プランでもGPT-Liveは利用できます。デフォルトで軽量版のGPT-Live-1 miniが適用され、有料プラン(Go/Plus/Pro)では上位モデルのGPT-Live-1に自動で切り替わります。本稿執筆時点で追加料金の発表はなく、契約中のプランに応じてモデルが決まる仕組みです。

GPT-Live-1とGPT-Live-1 miniの違い

公表された性能数値はありませんが、報道ベースでは無料向けのGPT-Live-1 miniは軽量なGPT-5.5 Instantのみを使う構成、有料向けのGPT-Live-1は状況に応じてより深い推論を行う構成とされています。込み入った相談や複雑な調べものが多いなら、有料プランのGPT-Live-1の方が恩恵を受けやすい構図です。

ChatGPTの音声会話の始め方(スマホ・PC・Web)— GPT-Liveは自動で切り替わる

ChatGPTアプリ更新から音声アイコン起動、プランに応じた自動適用までの3ステップを示した手順フロー図
図3:GPT-Liveの始め方は3ステップ。ユーザー側の切り替え操作は不要

結論から言うと、GPT-Liveの始め方はアプリを最新版に更新して音声アイコンをタップするだけの3ステップです。

公式ヘルプの手順(2026年9月22日参照)

  • iOS/Android: メッセージ入力欄の音声アイコンを選ぶ→マイクの許可→初回は声を選ぶ→話し始める。会話中はマイクの操作でミュート、終了の操作で会話を閉じる
  • Web: chatgpt.com を開き、入力欄の音声アイコンを選ぶ→ブラウザのマイク許可→話し始める
  • デスクトップアプリ(macOS/Windows): 「Voice in Desktop」として、音声でタスクの開始・進捗確認・エージェントの操作ができる(提供範囲と上限は公式の「Voice in Desktop」のページに従う)
  • 切り替え: 設定→Voice で Live/Advanced/Standard を選べる。Live は GPT-Live-1(プランにより mini)で動き、Web 検索・メモリ・ウィジェット表示・テキストと画像の併用に対応。動画や画面共有は Live では使えず、スマホの Advanced でだけ使える
  • 言語: 設定→Voice→Language でよく使う言語を選ぶと認識が安定する。会話中に「英語で話して」と頼むこともできる

起動手順(スマホ・PC共通)

  1. ChatGPTアプリを最新版に更新する(App Store / Google Play / デスクトップアプリ)
  2. チャット画面の音声アイコンから音声会話を開始する
  3. モデルは契約プランに応じて自動適用される(無料プラン=GPT-Live-1 mini、Go/Plus/Pro=GPT-Live-1)。ユーザー側の切り替え操作は不要

切り替わらない・従来のVoiceのままの時の3チェック

  • アプリのバージョンが最新か(旧バージョンでは従来のVoiceのまま)
  • アプリを完全終了して再起動したか
  • 展開は順次ロールアウトのため、未反映のアカウントは数日待つ(不具合ではない)

GPT-Liveを使うために、ユーザー側で複雑な設定をする必要は基本的にありません。ChatGPTのWeb版・iOS/Androidアプリで、これまで通り音声会話を開始するだけで、契約プランに応じて自動的にGPT-Live-1(有料プラン)またはGPT-Live-1 mini(無料プラン)が使われる仕組みです。

  1. ChatGPTアプリ、またはWeb版のChatGPTを開く
  2. 音声会話アイコンをタップ(またはクリック)し、いつも通り話しかける
  3. プランに応じて自動的にGPT-Live-1 / GPT-Live-1 miniが使用される
  4. 複雑な質問や調べものをした場合は、会話を止めずにバックグラウンドでGPT-5.5が処理し、結果が会話に反映される

展開はChatGPT Web版とiOS/Androidアプリで順次進められており、日本でも近く利用できるようになると報じられています(ITmedia調べ)。実際の展開スケジュールや、UI上の表示・切り替え方法は今後のアップデートで変わる可能性があるため、最新の状況はアプリ内の案内やOpenAI公式情報を確認してください。

この記事の内容を社内で使うなら

要点と手順をまとめた資料を無料で受け取れます。研修4,000名以上・支援100社以上の実績をもとに、自社の業務に当てはめる相談も30分から受け付けています。

生成AI 料金・プラン早見表 2026年10月版無料で受け取る →AI顧問に相談する(30分・無料)→

法人で音声会話を使う前に管理者が決めること(Business/Enterprise/Edu)

研修先で「音声で話した内容は学習に使われるのか」「会議で使ってよいのか」を必ず聞かれます。OpenAI の公式ヘルプとエンタープライズプライバシーのページ(いずれも 2026年9月22日参照)の記載で、管理者が先に決める 4 点を整理します。

法人で音声会話を使う前に管理者が決める4点。有効化の判断、データの扱い、保持期間、社内ルール
図5: 管理者が先に決める 4 点(有効化・データの扱い・保持期間・社内ルール)
  1. 有効化の判断: 音声会話は Business/Enterprise/Edu のワークスペースで使え、Enterprise/Edu ではワークスペースのオーナーが Voice を有効化すると Live が既定になる。Voice を丸ごと無効化することもできるので、まず「使わせるか」を決める
  2. データの扱い: Business/Enterprise/Edu の会話は既定でモデルの学習に使われない(個人プランはオプトアウトしない限り使われることがある)。音声で話した内容も会話の一部として同じ扱い
  3. 保持期間と閲覧: 保持期間はワークスペースの管理者が設定でき、削除した会話は法的義務がない限り 30 日以内に消える。Business では管理者がメンバーの会話履歴を閲覧・エクスポート・削除できる(Enterprise は Compliance API)
  4. 社内ルール: ①会議の録音・文字起こしに使うなら参加者の同意を先に取る ②オープンスペースで機密(顧客名・金額・未公開情報)を声に出さない ③固有名詞の聞き間違いは必ずテキストで確認する ④上限(Business Standard は 24 時間 3 時間)を超えるとクレジットを消費するので、営業・CS など長時間使う部署は Premium かクレジットの予算を決めておく

ビジネス活用の視点 — 会議・電話応対・語学・ハンズフリー業務でどう使えるか

音声にとどまらず、業務全体でのAIエージェント活用の考え方はAIエージェント完全ガイドで体系的に整理しています。

【2026年7月17日更新】展開状況と対応環境の続報

OpenAIのリリースノート(複数の技術メディアが原文を確認)によると、展開状況の詳細が明らかになっています。

  • GPT-Live-1で使える機能:Web検索・メモリ(記憶機能)・画像とテキストの併用入力に対応。音声での回答は、同じチャット内にテキストとしても同時表示されます
  • 現時点で使えない環境:ChatGPTデスクトップアプリ、一時チャット(Temporary Chats)、カスタムGPT、ChatGPT Work、Codex、コネクテッドアプリ連携、Business・Enterprise・Eduワークスペース。ビデオ・画面共有は開発中とされています
  • API:7月17日時点では提供時期未発表でしたが、2026年9月10日にGPT-Live-1のAPI提供が始まりました(上記の9月10日更新を参照)

法人利用の観点では、Business/Enterprise環境が対象外である点が2026年7月17日時点での最大の制約でした。以下の通り、8月時点ではこの状況が更新されています。

【2026年8月14日更新】Enterprise/Edu/Business・デスクトップアプリへの展開

OpenAIヘルプセンターの公式リリースノート(「ChatGPT Enterprise & Edu Release Notes」「ChatGPT Business Release Notes」、参照日: 2026-08-14)によると、7月17日時点からさらに状況が進んでいます。

  • Enterprise・Edu・Healthcareワークスペース: ワークスペース管理者がVoiceを有効化すると、Liveが標準の音声体験になりました。これまで必要だった「Early Model Access」設定の個別有効化は不要になっています
  • Businessワークスペース: GPT-Liveによる音声会話中のファイルアップロード・Projects参照(直近のプロジェクトチャット・ソース・プロジェクト指示の参照)に対応しました
  • デスクトップアプリ: 複数の技術メディア報道(AndroidAuthority、ai-tldr.dev、参照日: 2026-08-14)によれば、Mac/Windowsのデスクトップアプリにも2026年7月23日からGPT-Liveが展開され、Codex・Computer Use・ChatGPT Work・ローカルファイルとの連携も含めて利用できるようになったとされています。Macでは画面内容を認識する「Appshots」モードも追加されたと報じられています
  • 音声の電子透かし: 2026年7月31日付で、ChatGPT VoiceおよびOpenAI API経由のGPT-Live生成音声に、AI生成コンテンツであることを示す「SynthID」電子透かしが付与されるようになりました

ビデオ・画面共有については、2026年9月時点でもGPT-Live単体では非対応のままです。画面を見せながら会話したい場合は、引き続き従来のAdvanced Voice Modeを使う必要があります(提供時期の公式アナウンスは確認できていません)。

AI研修やAI導入支援の現場では、これまでも「音声でのやり取りをどこまで業務に組み込めるか」という質問を継続的に受けてきました。GPT-Liveのような全二重の音声AIが一般的になれば、企業での使いどころもさらに広がっていく可能性があります。以下は2026年9月10日のAPI提供開始より前に書いた「ChatGPTアプリを通じた活用」を前提にした見立てです。API経由で自社システムに組み込む道も開けています。

会議・打ち合わせでの壁打ち相手として

人間の会話に近いテンポでやり取りできるようになったことで、資料を見ながらの壁打ちや、アイデア出しの相手としての使い勝手が上がると考えられます。ただし、会議の議事録化や複数人での同時利用のような使い方は、API提供が始まった(2026年9月10日)ことで組み込み自体は可能になりましたが、議事録ツール側の対応はまだ確認できていません。生成AIによる議事録自動化の実務的な進め方は生成AIで議事録を自動化する方法で解説しています。

電話応対・カスタマーサポートへの応用

相づちや割り込みへの対応が改善されたことは、電話応対のような「間」が重要なやり取りとの相性の良さを示唆しています。ただし、既存の電話システムに組み込むにはAPI経由の実装が前提になるため、今回の発表だけで「今日から自社の電話応対に組み込める」わけではありません。音声ボットによる電話・自動応答の一般的な導入パターンは中小企業のAI電話受付・自動応答 導入ガイドを参考にしてください。

語学学習・多言語コミュニケーション

割り込みや相づちに強くなったことで、語学学習用途では「実際の会話に近い練習相手」としての価値が高まる可能性があります。一方でMarkTechPostの報道では、言語間で同等の品質を保証する「完全な多言語パリティ」は発表時点では未対応とされており、日本語を含む非英語での品質がどこまで英語と並ぶかは、今後の実際の利用状況を見て判断する必要があります。

ハンズフリー業務(現場・移動中)での活用

手がふさがっている現場作業や移動中の情報確認など、画面を見ずに使える場面との相性は従来から音声AIの強みでした。GPT-Liveでは天気・株価・スポーツなどの情報をビジュアルカードで表示する機能も報じられており、「音声で聞きながら、必要なときだけ画面をちらっと見る」というハイブリッドな使い方がしやすくなる可能性があります。

企業として音声UI導入を検討する際に見ておくべきこと

音声インターフェースを業務に組み込む際、AI研修・AI導入支援の現場でよく論点になるのは次のような点です。

  • ログ・記録の扱い:音声でのやり取りが記録・保存される範囲と、社内規定・個人情報保護との整合性
  • API提供のタイミング:既存の業務システム(電話・チャット・CRM等)に組み込むにはAPIが前提になるため、本格導入はAPI公開後を待つのが現実的でしたが、2026年9月10日に公開されたため組み込みの検討に進めます
  • 誤認識・誤動作への備え:フルデュプレックスは自然さが増す一方、割り込みの誤検知など新しいタイプの誤動作が起きる可能性もあり、重要な業務ではまず限定的な範囲から試すのが安全
  • 社内での利用ルール:どの業務での利用を許可し、どこから人間の確認を必須にするかを事前に決めておく

できることと現時点の限界

MarkTechPostの報道によれば、GPT-Liveは科学的推論を問うベンチマーク「GPQA」や、Web検索を伴うタスク「BrowseComp」などで、従来モデルに対して優位な結果を示したとされています。人間による評価でも、5〜10分間の対等な会話比較で「圧倒的に好まれた」とImpress Watchは報じています。

一方で、発表時点でできないことも明確にされています。

  • 動画・画面共有:発表時点では対応していません(MarkTechPost報道)
  • 完全な多言語パリティ:言語間で同等品質を保証する「完全な多言語パリティ」は、発表時点では未達とされています
  • API経由での利用:2026年9月10日にGPT-Live-1のAPI提供が始まり、この制約は解消しました(音声部分1分あたり$0.05・秒単位課金)
  • 詳細な料金体系:ChatGPT内の音声機能は各プラン料金に含まれ、公式料金ページ(2026年9月5日時点)では音声がFree「上限あり」・Go/Plus「拡張」・Pro「無制限(不正利用防止の安全対策あり)」と表記されています。GPT-Live会話モデルのAPI単価は未公開で、公式API料金表に載っているのは文字起こし専用のgpt-live-transcribe(1分あたり0.017ドル)だけです

Apple・AmazonなどもAIとの自然な会話体験の強化を進めており、対話AIのスタートアップも独自の自然な会話モデルを展開しているとTechCrunchは伝えています。音声インターフェース領域の競争は今後さらに激しくなる見通しで、GPT-Liveの発表もその流れの一つと捉えるのが実務的な見方です。企業として音声AIの活用を検討する際は、こうした「発表直後にはできないこと」と「競合含めて今後さらに更新が続く領域であること」の両方を踏まえたうえで、段階的に導入範囲を広げていくのが現実的です。

よくある質問(FAQ)

Q1. GPT-Liveとは何ですか?

A. OpenAIが2026年7月に発表した、ChatGPTの音声会話機能向けの新しいモデルです。「チャットGPTライブ」とも呼ばれ、聞くことと話すことを同時に行う「フルデュプレックス」方式を採用し、相づちや自然な割り込みに対応した会話ができるようになりました。

Q2. GPT-Liveは無料プランでも使えますか?

A. はい。無料プランには軽量版の「GPT-Live-1 mini」がデフォルトとして提供されます。有料プラン(Go/Plus/Pro)には上位モデルの「GPT-Live-1」が使われます。

Q3. GPT-LiveはAPIで使えますか?

A. はい。2026年9月10日から会話モデル「GPT-Live-1」がAPIで使えます(音声部分は1分あたり$0.05・秒単位課金、バックエンドモデル料金は別)。それ以前は音声認識に特化した「GPT Live Transcribe」(2026年7月28日公開)だけがAPI提供でした。

Q4. GPT-Liveの利用に追加料金はかかりますか?

A. 現時点でOpenAIから追加料金についての明確な発表はありません。利用できるモデルは契約中のプラン(Free/Go/Plus/Pro)に応じて自動的に決まる仕組みです。

Q5. 日本語には対応していますか?

A. 音声会話自体は日本語ユーザーを含めて順次利用できるようになるとみられ、ITmediaは日本でも「まもなく」利用可能になると報じています。ただし、発表時点では言語間で同等品質を保証する「完全な多言語パリティ」は未達とされており、日本語での品質については今後の実際の利用状況を確認する必要があります。

Q6. 従来のChatGPT Voice(Advanced Voice Mode)と何が違いますか?

A. 最大の違いは会話方式です。従来はユーザーが話し終えるのを待ってから応答する「ターン制」でしたが、GPT-Liveは聞き取りと発話を同時に行う「フルデュプレックス」方式に変わりました。詳しい比較は本文の比較表をご覧ください。

Q7. ビジネスで今すぐ活用できますか?

A. ChatGPTアプリを通じた壁打ちや情報収集といった個人利用レベルではすぐに試せますが、電話応対システムやCRMなど既存の業務システムへの本格的な組み込みにはAPI提供を待つ必要があります。段階的に活用範囲を広げていくのが現実的です。

Q8. Team・Enterpriseプランでも使えますか?

A. 発表時点(2026年7月)ではFree・Go・Plus・Proの4プランのみが確認されていました。2026年8月14日時点でOpenAIヘルプセンターの公式リリースノートを確認したところ、Enterprise・Edu・Healthcareワークスペースではワークスペース管理者がVoiceを有効化するとLiveが標準の音声体験になり、Businessワークスペースでも音声会話中のファイルアップロード・Projects参照に対応したことが確認できました。Teamプランについては本稿執筆時点でも明確な言及を確認できていません。

Q9. GPT-Live-1とGPT-Live-1 miniの性能差はどれくらいですか?

A. 明確な性能差の数値は公表されていませんが、報道によれば無料プラン向けのGPT-Live-1 miniは軽量なGPT-5.5 Instantのみを使う構成とされ、有料プラン向けのGPT-Live-1は状況に応じてより深い推論を行う構成が用意されているとされています。複雑な調べものや込み入った相談が多い場合は、有料プランのGPT-Live-1の方が恩恵を受けやすいと考えられます。

Q10. スマホでGPT-Liveを使うには?

ChatGPT公式アプリ(iOS/Android)を最新版に更新し、①画面右下の音声アイコンをタップ、②GPT-Liveモードを選択、③マイク・カメラの権限を許可、の3ステップで開始できます。ブラウザ版スマホよりアプリのほうが安定します。

Q11. ChatGPTの音声会話は無料で使えますか?

使えます。無料プランは軽量版の GPT-Live-1 mini を限定的に使えます(上限は変更されることがあります)。Go・Plus は直近 24 時間で 3 時間、Pro($200)は無制限です(OpenAI 公式ヘルプ・2026年9月22日参照)。

Q12. スマホと PC(Web)で違いはありますか?

始め方は同じ(入力欄の音声アイコン)ですが、動画・画面共有はスマホアプリの Advanced だけで、Live ではどの端末でも使えません。デスクトップアプリには音声でエージェントを操作する「Voice in Desktop」があります。

Q13. 音声で話した内容は学習に使われますか?

Business/Enterprise/Edu では既定で学習に使われません。個人プラン(Free/Go/Plus/Pro)は、設定でオプトアウトしない限り学習に使われることがあります。

Q14. 社内で使う時の注意は?

①管理者が Voice の有効化と保持期間を決める ②会議で使うなら録音の同意を取る ③機密を声に出さない ④固有名詞はテキストで確認する ⑤長時間使う部署は上限(24 時間 3 時間など)とクレジットの予算を先に決める、の 5 点です。

まとめ:今日から始める3つのアクション

  1. 今日やること: 自分のChatGPTアプリで音声会話を試し、従来との応答テンポの違いを体感してみる
  2. 今週中: 自社の会議・電話応対・ハンズフリー業務の中で、音声AIが活きそうな場面を1つ書き出してみる
  3. 今月中: API提供開始のアナウンスを注視しつつ、社内での音声データの取り扱いルール(ログ・個人情報)を整理しておく

参考・出典

執筆者プロフィール

佐藤傑(さとう・すぐる)
株式会社Uravation代表取締役。X(@SuguruKun_ai)フォロワー約10万人。
100社以上の企業向けAI研修・導入支援。著書『AIエージェント仕事術』(SBクリエイティブ)。
SoftBank IT連載7回執筆(NewsPicks最大1,125ピックス)。

ご質問・ご相談はお問い合わせフォームからお気軽にどうぞ。

あわせて読みたい:


あわせて読みたい(最新アップデート)

関連記事: AIスポーツ分析ツール6選比較|映像分析とGPS計測の選び方【2026年最新】

監修:株式会社Uravation(生成AI活用書籍シリーズ累計59,900部の著者チームが運営。自社7メディアの実運用でAI検索からの引用・流入を継続計測し、その知見に基づいて編集しています。仕様・料金が変わりやすい領域のため、重要な意思決定の前には各公式情報の最新版をご確認ください)

この記事の内容を社内展開する方へ: 生成AI 料金・プラン早見表 2026年10月版(無料・PDF 35ページ+Excel) をダウンロードできます。

佐藤傑
この記事を書いた人 佐藤傑

株式会社Uravation 代表取締役CEO/生成AIエバンジェリスト。法人向けAI研修・コンサルティングを手がけ、日経・SBクリエイティブ・GMO等のメディアで生成AIについて執筆。

執筆・監修:佐藤傑/下書き・図版・機械検査:当社のAI社員(人が確認してから公開しています)。記事の作り方と検査の方針

この記事をシェア

Contact お問い合わせ

30分の無料相談では、いま時間を取られている業務を伺い、稼働中のAI社員62体の事例の画面と一緒に近い進め方をお見せします。
売り込みはしません。

Claude Code 個別指導(1対1・12セッション)をご希望の方はこちら、Codex 個別指導はこちらから別途お申し込みください

Claude Code 個別指導 無料相談