「ChatGPTと音声で話していると、こちらが話し終わるまでじっと待たれている感じがする」。音声AIを使ったことがある人なら、一度はこの不自然さを感じたことがあるはずです。人間どうしの会話なら、相手の話を聞きながら相づちを打ったり、自然に言葉を重ねたりします。ところが従来の音声AIは、ユーザーが話し終えてから応答する「順番待ち」が基本で、どうしても機械と話している感覚が残っていました。
その壁を壊しに来たのが、OpenAIが2026年7月8日(日本時間7月9日)に発表した新しい音声モデル「GPT-Live(ジーピーティー・ライブ)」です。聞くことと話すことを同時に行う「フルデュプレックス(全二重)」という仕組みを採用し、ChatGPTの音声会話を根本から作り変えました。相づちを打ち、考えている間は静かに待ち、難しい質問は裏側で高性能モデルに任せながら会話を続ける。音声AIとのやり取りが、「機械への入力」から「人との会話」に近づいた、大きな転換点です。
この記事では、ChatGPTコンサル編集部が、GPT-Liveとは何か、従来の音声モードと何が違うのか、対応プラン・料金・使い方から、現時点でできないことまで、公式発表をもとに丁寧に解説します。
⚠️ GPT-Liveは2026年7月に発表されたばかりの機能で、展開が進行中です。仕様・対応範囲は今後変わる可能性があります。本記事は2026年7月時点の情報です。最新の状況はOpenAI公式でご確認ください。
結論早見表|GPT-Liveの要点
まず、全体像を1枚で整理します。
| 項目 | 内容 |
|---|---|
| 発表日 | 2026年7月8日(日本時間7月9日) |
| 正体 | ChatGPTの音声会話(Voice)を支える新世代の音声モデル |
| 最大の特徴 | フルデュプレックス(聞く・話すを同時に処理) |
| モデル | GPT-Live-1(有料プランの既定)/GPT-Live-1 mini(無料プランの既定) |
| 料金 | 追加料金なし(各プランの料金に含まれる) |
| 対応 | 無料・Go・Plus・Proの個人向けプラン。iOS・Android・Web |
| 賢さの秘密 | 難しい質問はバックグラウンドでGPT-5.5に委任し、会話は止めない |
| 現時点の制約 | API未提供、法人ワークスペース(Business等)は対象外、画面共有など非対応 |
ひとことで言えば、GPT-Liveは「声で答えるAI」を「話しながら考えるAI」へ進化させるアップデートです。ここから、順番に詳しく見ていきます。
💬 さとしさん(編集長) 音声機能は週1.5億人以上が使う巨大な入口。その標準が丸ごと入れ替わるのだから、これは押さえておくべき変化だぞ!
GPT-Liveとは|「順番待ち」をなくした音声モデル
GPT-Liveは、ChatGPTの音声会話機能(ChatGPT Voice)向けにOpenAIが開発した、新しい音声モデルです。これまでの音声モード(Advanced Voice Mode)を置き換える形で、標準の音声体験として順次展開されています。
最大の特徴:フルデュプレックス(全二重)
GPT-Liveの核心は、「フルデュプレックス(全二重)」と呼ばれるアーキテクチャです。少し難しい言葉ですが、意味はシンプルです。
- 従来(半二重・ターン制):トランシーバーのように「あなたが話す→AIが考える→AIが話す」と交互に進む
- GPT-Live(全二重):電話のように「聞きながら、同時に話せる」
GPT-Liveは、人の声を聞き取りながら、並行して自分の音声を組み立てています。そして「話すか、聞き続けるか、一時停止するか、割り込むか」を、1秒間に何度も判断し続けています。この仕組みによって、次のような人間らしい振る舞いが可能になりました。
- 会話の途中で「うんうん」「はい」と相づちを打つ
- ユーザーが考え込んでいるときは、静かに待つ
- テンポの速いやり取りにも、間を置かずに反応する
- 話の途中でも、自然に言葉を重ねられる
従来の音声AIは、沈黙をもって「話し終わった」と判断していたため、少し考えて黙っただけで話を遮られる、というストレスがありました。GPT-Liveは「ターン(順番)」という単位そのものを持たない設計に変わったことで、この問題に正面から取り組んでいます。
💬 りくさん(編集部) 実際に使うと「待たれている感」が消えているのに驚きます。考え込んでも遮られないだけで、こんなに話しやすくなるんですね。
従来の音声モードと何が違う?|3世代で理解する
GPT-Liveの位置づけは、ChatGPTの音声機能の歴史を3世代で整理すると分かりやすくなります。
第1世代:カスケード型(初代のChatGPT Voice)
音声認識→言語モデル→音声合成という3つのモデルを直列につなぐ方式でした。バケツリレーのように処理が受け渡されるため、応答が遅く、モデル間で情報(声のトーンやニュアンス)が失われる課題がありました。
第2世代:Advanced Voice Mode(ターン制)
理解と生成を1つのモデルで処理するようになり、応答は大きく速くなりました。ただし、会話は「相手が話し終わってから返す」ターン制のまま。発話の終わりを沈黙で判断するため、短い間や背景の物音まで「話し終わり」と誤解され、不自然なタイミングで割り込まれることがありました。
第3世代:GPT-Live(フルデュプレックス)
そして今回のGPT-Liveは、ターンという概念を取り払い、聞くと話すを同時に処理します。応答の速さだけでなく、会話のリズムそのものが人間の対話に近づきました。OpenAIの発表では、選好度・会話の流れ・自然さ・タスク遂行の各指標で、従来のAdvanced Voice Modeを上回ったとされています。
| 世代 | 方式 | 課題 |
|---|---|---|
| 第1世代 | カスケード型(3モデル直列) | 遅い、ニュアンスが失われる |
| 第2世代 | ターン制(単一モデル) | 順番待ち、沈黙で誤割り込み |
| 第3世代(GPT-Live) | フルデュプレックス | ターンの概念自体を解消 |
💬 あやさん(副編集長) 「速くなった」ではなく「会話の仕組みが変わった」のが今回のポイント。順番待ちがなくなるのは体感でかなり大きいよ!
「話しながら考える」仕組み|GPT-5.5への委任
GPT-Liveのもう一つの重要な特徴が、バックグラウンドでの処理の委任です。
音声モデルは会話のテンポを保つのが役割なので、単体では深い調査や複雑な推論に限界があります。そこでGPT-Liveは、Web検索・深い推論・複雑な作業が必要な質問を受けると、裏側で最新のフロンティアモデル(提供開始時点ではGPT-5.5)に処理を任せます。そして計算が進んでいる間も会話を続け、結果がまとまり次第、自然に会話へ戻すのです。
たとえるなら、目の前の会話は感じのいい受付担当が続けてくれて、難しい調べ物は裏で専門家チームが同時に進めてくれる、という二段構えです。「会話の自然さ」と「回答の賢さ」を、1つのモデルに無理に詰め込まず、役割分担で両立させた設計といえます。
なお、OpenAIは新しいフロンティアモデルをリリースするたびに、GPT-Liveが裏で使うモデルも更新していくと表明しています。つまりGPT-Liveの「賢さ」は、今後も自動的に底上げされていく仕組みです。
💬 さとしさん(編集長) 「会話係」と「頭脳係」の分業がミソ。難しい質問で会話が止まらないのは、この二段構えのおかげだ!
2つのモデルと対応プラン
GPT-Liveは、2つのバージョンで展開されています。
| モデル | 対象プラン | 位置づけ |
|---|---|---|
| GPT-Live-1 | Go・Plus・Pro(有料プラン)の既定 | 上位モデル |
| GPT-Live-1 mini | 無料プランの既定 | 軽量版 |
注目すべきは、無料プランにも軽量版(mini)が標準で展開される点です。追加の申し込みは不要で、契約中のプランに応じて自動的にモデルが切り替わります。低価格プランのGoも上位モデル(GPT-Live-1)の対象に含まれており、音声体験の底上げが幅広いユーザーに及びます。
展開は2026年7月8日から世界中で順次進んでおり、iOS・Android・Web(chatgpt.com)に数日かけて届く形です。同じプランでも、アカウントによって使えるようになる時期に差が出ることがあります。
料金|追加費用はかからない
GPT-Live自体に追加料金はありません。 ChatGPTの各プラン料金に含まれる形で提供され、プランによって使えるモデル(GPT-Live-1か、miniか)が変わる仕組みです。
- 無料プラン:GPT-Live-1 miniが利用可能(0円)
- Go/Plus/Pro:GPT-Live-1が既定に
なお、無料プランでの利用回数・時間の上限については、現時点でOpenAIから明確な公表がありません。上限はプランや利用状況によって異なり、変更される可能性もあるため、自分のアカウント画面で確認するのが確実です。
💬 あやさん(副編集長) 「新機能=課金」ではなく、無料でも軽量版が使えるのが今回の太っ腹なところ。まずは触ってみるのが早いよ!
使い方|入口はこれまでと同じ
使い方はとても簡単で、従来の音声モードと同じ入口から始められます。
- ChatGPTアプリ(またはWeb版)を開く
- チャット入力欄の右端にある**音声波形のマーク(波マーク)**をタップ
- 音声会話が始まる。GPT-Liveが展開済みのアカウントなら、自動的に新モデルで動作する
9種類の声から選べる
初回起動時には、利用できる声のサンプルを聞けます。声は事前に用意された9種類で、それぞれに個性があります(気さくなタイプ、落ち着いたタイプ、陽気なタイプなど)。
なお、声が9種類に限定されているのは、実在の人物の声を模倣する「ボイスクローン」を防ぐための安全設計です。自由に声を作れないのは不便に見えて、悪用を防ぐための意図的な制限といえます。
💬 りくさん(編集部) 使い方は今までの音声モードと同じなので、迷うことはありません。まず声のサンプルを聞き比べるのが楽しいです。
GPT-Liveでできること・活用シーン
自然な会話ができるようになったことで、音声の使いどころが広がります。
① 壁打ち・アイデア出し
考えながら話す場面で、真価を発揮します。黙って考えても遮られず、「うんうん」と聞いてくれるので、思考の言語化が進みます。企画のブレストや、話しながら考えを整理したいときに向いています。
② 語学練習・発話トレーニング
会話のテンポが自然になったことで、英会話などの練習相手として一段と実用的になりました。相づちや自然な割り込みがある対話は、実際の会話に近い練習環境になります。
③ リアルタイム翻訳
聞きながら話せる特性は、翻訳とも相性抜群です。トランシーバーのように交互に待つのではなく、双方が同時に話しながら訳す、同時通訳に近い使い方ができます。
④ ハンズフリーでの調べ物・作業
料理中や移動中など、手がふさがっている場面での調べ物やメモに便利です。難しい質問は裏でGPT-5.5が処理してくれるため、会話を続けながら深い回答を待てます。
⑤ 会話しながらの相談・思考整理
日々の相談ごとや、頭の中の整理にも使えます。「話し終わるまで待たれている」感覚が消えたことで、口に出しながら考えるという使い方が現実的になりました。
💬 さとしさん(編集長) キーワードは「考えながら話せる」こと。壁打ち・語学・翻訳のような、言葉の往復が多い場面ほど違いが出るぞ!
現時点でできないこと|ローンチ時の制約
発表直後の機能なので、まだ対応していない範囲もあります。導入を検討するうえで重要なので、正直に整理します。
① APIはまだ提供されていない
開発者向けのAPI提供は「近日提供」とされているのみで、提供日・料金は未発表です。自社の電話システムやアプリに組み込みたい企業は、現時点では待つ必要があります(音声AIをAPIで組み込みたい場合は、別系統のリアルタイム音声API群を使うことになります)。
② 法人ワークスペースは対象外
Business・Enterprise・Eduの法人向けワークスペースは、ローンチ時点で対象外です。会社のChatGPTアカウントでGPT-Liveが見当たらないのは、不具合ではなく仕様です。当面は個人向けプランでの提供が中心になります。
③ 一部機能は非対応
ローンチ時点では、動画・画面共有・連携アプリ・カスタムGPTとの組み合わせには対応していません。
④ 日本語の流暢さには改善余地
日本語にも対応していますが、OpenAI自身が「一部の言語ではアクセントや流暢さに課題が残る」と認めています。方言や専門用語の多い会話では、違和感が出る場面もあるかもしれません。言語ごとの改善は継続される方針です。
⑤ 誤った割り込みがゼロになったわけではない
フルデュプレックス化で大きく改善されたものの、背景音や長い沈黙がある環境では、依然として不自然な割り込みが起こりうるとされています。
💬 あやさん(副編集長) 「会社のアカウントで出てこない」「APIで使いたい」は今は仕様上できないこと。ここを知っておくと無駄に悩まずに済むよ!
使ううえでの注意点
新しい体験に目が行きがちですが、基本的な注意は変わりません。
- 「会話が自然」と「事実が正確」は別物:応答がスムーズになっても、固有名詞・日付・数字などの正確性が保証されるわけではありません。重要な情報は必ず確認しましょう
- 機密情報を話さない:音声でも入力データであることは同じです。仕事の機密や個人情報を話すのは避け、学習に関する設定(データコントロール)も確認しておきましょう
- 展開途中であることを踏まえる:アカウントによって利用可否や表示時期が異なります。アプリを最新版にしても出てこない場合は、順番待ちの可能性があります
💬 りくさん(編集部) 会話が人間っぽくなるほど、つい何でも話したくなります。「機密は話さない」の意識は、音声でも忘れないようにしたいです。
よくある質問(FAQ)
Q. GPT-Liveとは何ですか? A. OpenAIが2026年7月8日に発表した、ChatGPTの音声会話を支える新世代の音声モデルです。聞くことと話すことを同時に行う「フルデュプレックス(全二重)」方式で、人間の会話に近い自然なやり取りができます。
Q. 追加料金はかかりますか? A. かかりません。各プランの料金に含まれ、無料プランでも軽量版(GPT-Live-1 mini)が使えます。Go・Plus・Proでは上位のGPT-Live-1が既定になります。
Q. 従来の音声モードと何が違いますか? A. 従来は「話し終わってから応答する」ターン制でしたが、GPT-Liveはターンの概念をなくし、聞きながら同時に話せます。相づち、自然な割り込み対応、考えている間は待つ、といった振る舞いが可能です。
Q. GPT-5.5との関係は? A. GPT-5.5はGPT-Liveのベースではなく、「委任先」です。Web検索や深い推論が必要なとき、GPT-Liveが裏でGPT-5.5に処理を任せ、その間も会話を続けます。
Q. 会社のChatGPTで使えないのですが? A. Business・Enterprise・Eduの法人ワークスペースは、ローンチ時点で対象外です。不具合ではなく仕様で、当面は個人向けプランが中心です。
Q. APIで自社サービスに組み込めますか? A. まだできません。API提供は「近日」とされ、提供日・料金は未発表です。現時点で音声AIを組み込むなら、別系統のリアルタイム音声APIを使う形になります。
Q. アプリに表示されません。故障ですか? A. まずアプリを最新版に更新してください。それでも出ない場合、展開が順次進行中のため、順番待ちの可能性があります。法人アカウントは対象外です。
まとめ|音声AIが「会話の相手」になった日
GPT-Liveの要点を、最後に整理します。
- GPT-Liveは、2026年7月8日発表のChatGPT新音声モデル。従来のAdvanced Voice Modeを置き換える
- **フルデュプレックス(全二重)**により、聞く・話すを同時に処理。相づち・自然な割り込み・待つ、ができる
- 難しい質問は裏でGPT-5.5に委任し、会話を止めずに賢い回答を返す二段構え
- 追加料金なし。無料プランはmini、Go・Plus・ProはGPT-Live-1が既定
- 使い方は従来と同じ:音声波形マークをタップするだけ。声は安全設計の9種類
- 現時点の制約:API未提供、法人ワークスペース対象外、画面共有など非対応、日本語の流暢さは改善途上
- 注意:会話が自然でも事実確認は必要。機密情報は話さない
音声AIはこれまで「便利だけれど、どこか不自然」な存在でした。GPT-Liveは、その不自然さの正体だった「順番待ち」を技術的に解消し、AIとの対話を人との会話に一歩近づけています。まずはアプリの波マークをタップして、相づちを打ちながら聞いてくれる新しいChatGPTと、一度話してみてください。その体感の違いが、この記事のどんな説明よりも雄弁なはずです。
💬 さとしさん(編集長) 説明を読むより、1回話すのが一番早い。音声AIの「潮目が変わった瞬間」を、ぜひ自分の耳で確かめてみてくれ!