AI生成イメージAIニュース音楽・音声 / GPT-Live-1
話している途中でも聞ける「GPT-Live-1」、電話対応に組み込む音声AIを公開
OpenAIは、聞くことと話すことを同時に処理するGPT-Live-1をAPIで提供開始しました。音声対話を続けながら、必要な推論やツール操作を別のモデルへ委ねられるため、予約受付や顧客対応などの音声業務への組み込みを想定できます。
まずは、作っている人の実例へ
気になる使い方から選べます。作者と、見てほしいポイントを添えました。
公式発表で機能・提供状況を見る
OpenAI
OpenAIの公式発表。モデルの仕組み、割り込み対応、委譲、電話対応、提供状況を確認できます。
- 公開日
- 2026-09-10
- 編集部の確認
- 公式資料の本文を確認。RAVENによる実機検証は行っていません。(2026-09-17 確認)
GPT-Live-1の公式モデル資料を読む
OpenAI
公式モデル資料。対応モダリティ、エンドポイント、セッション、レート制限など実装時の仕様を確認できます。
- 公開日
- 不明
- 編集部の確認
- 公式資料の本文を確認。RAVENによる実機検証は行っていません。(2026-09-17 確認)
音声の受け渡しを一つのモデルで扱う
従来の音声システムは、音声認識、推論、音声合成を順番につなぐ構成が一般的でした。GPT-Live-1は音声の入力と出力を一つの全二重モデルで扱い、相手の割り込み、考えている間の沈黙、短い相づち、背景雑音を含む会話への対応を掲げています。
話す役割と考える役割を分ける
会話の進行はGPT-Live-1が担い、複雑な推論やツール呼び出しはバックエンドのテキストモデルへ委譲できます。音声応答を止めずに処理を進める構成で、電話による予約、注文、カスタマーサポートなどが用途として示されています。
評価値は条件とともに読む
公式発表は、従来モデルとの評価や導入企業の初期結果を掲載しています。ただし、特定の構成や評価条件に基づく値であり、日本語や各社の通話環境で同じ結果になることを保証するものではありません。
出典・確認記録
出典:Introducing GPT-Live-1 in the API(OpenAI、2026-09-10 公開)。 本記事で紹介した内容は、出典に記載された作者・発表元の主張です。RAVEN coordinator が 2026-09-17 22:03 JST に出典を直接確認し、以下の点を照合しました。 ・GPT-Live-1は全二重の音声モデル
タグ
タグを選ぶと、同じタグの記事だけを一覧に表示します。




