OpenAI が Introducing GPT-Live をリリース ── ChatGPTの音声対話を支える次世代モデル登場
ついにChatGPTの音声機能を根底からアップデートする新モデル「GPT-Live」が登場した。より自然な人間とAIのやり取りを実現するための次世代ボイスモデルで、すでにChatGPT Voiceを裏で動かしているらしい。これまで以上に滑らかで、まさに「生きている」ような会話ができるのかと思うと期待が高まる。
▸何が変わったのか
今回OpenAIが投入したのは「自然な人間とAIのインタラクション」のための新世代音声モデル「GPT-Live」。一番のポイントは、このモデルがすでにChatGPT Voiceをバックエンドで駆動させていること。具体的なベンチマークやパラメータ数は非公開だが、「Live」というネーミングからしても、従来よりさらにリアルタイム性を高めた低遅延のやり取りが可能になったと考えられる。
◈前モデル / 競合との比較
既存のChatGPT音声機能と比べて、名前に「Live」が冠されていることから、さらにリアルタイムで人間に近いインタラクションができる新世代モデルへと進化したことがうかがえる。
◈技術背景と意義
これまでの音声AIの多くは、「音声を文字起こし」→「テキストで回答を生成」→「そのテキストを音声にする」というステップを踏んでいた。この方式だと、どうしても会話のテンポが遅れたり、声のトーンが平坦になりがち。GPT-Liveのような直接音声を扱うモデルは、こうした変換の壁を取り払おうとするもの。AIが呼吸や間、感情の揺らぎを汲み取り、人間らしいテンポで即座に返してくれるようになる、まさに次世代のアプローチだ。
▸こんな人・用途に
ChatGPTアプリで音声機能を日常的に使っているユーザー全般。特に、ハンズフリーでのナビゲートや、自然な雑談、感情豊かな読み聞かせなどの用途でさらなる進化が期待できる。
◆入手方法・リンク
クローズドソースモデルであり、GitHub等でのコード公開はない。ただし、すでにChatGPT Voiceを裏で動かしているため、ChatGPTアプリの音声機能を使うことで体験できる。
SOURCE: OpenAI (2026-07-08)