OpenAI API音声・音楽確認済み

OpenAI「GPT-Live-1」API公開、聞きながら話す音声AI——料金は1分0.05ドル

割り込みや沈黙、雑音を扱い、必要な推論や操作を別のAIへ任せられる全二重音声モデルです。

  • 2026-09-11
  • 最終確認日 2026-09-11
自分にどう関係する?

人同士に近い割り込み可能な音声対話を、電話やアプリへ組み込みやすくなるためです。

ニュースをやさしく解説

結論から言うと、OpenAIは2026年9月10日、自然な音声会話をアプリへ組み込む「GPT-Live-1」をAPIで公開しました。相手の声を聞きながら話せる全二重方式で、利用者が返答の途中に割り込んだり、少し黙って考えたり、周囲に雑音があったりする場面を一つの音声モデルで扱います。

従来の音声認識、文章AI、音声合成を順につなぐ方式より構成を簡単にし、深い推論やツール操作が必要なときはGPT-6 Astraなどの文章モデルへ処理を任せられます。声の調子、速さ、話し方はシステム指示で調整でき、電話による予約や顧客対応にも利用可能です。

OpenAIの評価ではFull Duplex BenchがGPT-Realtime-2.1より30ポイント向上し、語学サービスSpeakの初期評価では、学習者が考えている途中の割り込みが従来方式より約80%減りました。提供価格は前面の音声処理が1分0.05ドルで、後ろで使う推論モデルなどの費用は別です。開発者には会話アプリの実装量と待ち時間を減らせる可能性があります。

ただし数値には自社評価や協力企業の事例が含まれ、実際の精度や総費用は用途、通話時間、裏側のモデルで変わります。録音への同意や個人情報の扱いも事前に設計してください。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

OpenAI公式発表を開く