何が変わったか
OpenAIが公開したGPT-Live-1とGPT-Live-1 miniは、ChatGPT音声の中核を「ターン制」から「デュプレックス(全二重)」へ切り替える新モデルです。従来のAdvanced Voice Modeは、ユーザーが話し終えるのを待ってから応答する仕組みで、短い間を勘違いして割り込む、逆に間延びするといった不自然さが残っていました。新モデルは入力の受け取りと出力の生成を同時に行える構造のため、会話中に「うんうん」「なるほど」といった相槌を挟み、時間感覚を保ち、ライブ翻訳もこなします。
タスクを裏で「委任」する仕組み
もう一つの要点は、GPT-Liveが会話を止めずに他モデルへ処理を委任できる点です。推論・Web検索・エージェント的な操作はGPT-5.5などに投げ、結果を待つ間もユーザーとの会話は途切れません。天気・スポーツ・株価などをカード型のビジュアルで返す機能、画像やファイルのアップロード、Web検索もChatGPT Voice内から扱えます。
安全設計と提供範囲
リスクの高い出力を検知した際は、安全な応答へ誘導したり、追加の安全メッセージを表示したり、通話を打ち切るセーフガードが組み込まれました。ペアレンタルコントロールで10代の利用を無効化でき、自傷傾向の兆候を検出した場合は保護者に通知されます。提供はAndroid・iOS・Web向けに本日開始。Go/Plus/Pro加入者はGPT-Live-1、無料ユーザーはGPT-Live-1 miniが既定になります。
💼 事業会社視点:これは自社にどう効くか
「音声UIは相槌と割り込みで決まる」ことが、いよいよ実装レイヤーに落ちてきました。日本のコールセンター運営会社やSaaSベンダー、EC事業者にとって示唆は明確です。第一に、既存のIVRやチャットボット刷新プロジェクトの前提が変わります。ターン制を前提に設計した「発話→終端検出→応答」のフローは、デュプレックス前提のUX設計に描き直す必要があります。第二に、受託開発やシステムインテグレータは、ChatGPT VoiceがGPT-5.5へ処理を委任しつつ会話を継続する構造を「参照アーキテクチャ」として顧客に提示できます。裏側で検索や在庫照会を走らせながら相槌を返す、という体験は、有人窓口の代替提案の説得力を一段引き上げます。第三に、事業責任者は「音声のブランド体験」を意思決定事項として扱うべきです。Siri/Alexa世代のUIと、デュプレックス世代のUIでは顧客の期待値そのものが変わります。半年後の商談で「うちの音声、間が悪いんですよね」と言われる前に、PoC予算を確保しておく判断が要ります。