Gemini音声・音楽確認済み

Google「Gemini 3.8 Live」公開、会話を止めずに音声AIが裏で道具を操作

高速な音声対話版と、複雑な多段階作業向けExtended Thinking版がGemini APIなどで使えます。

  • 2026-09-16
  • 最終確認日 2026-09-16
自分にどう関係する?

音声AIが単に答えるだけでなく、会話を続けながら複数段階の作業を進める用途に近づきました。

ニュースをやさしく解説

結論から言うと、Googleは話している途中でも考え続け、道具を裏で操作できる音声AI「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」を公開しました。Googleは2026年9月15日、両モデルをGemini API、Geminiアプリ、Google Workspace、検索で提供すると公式ブログで発表しました。

通常版は速く自然な会話と画像を含む状況理解を、Extended Thinking版は複雑な多段階の作業を重視します。音声対話を続けながらバックグラウンドで道具を管理でき、割り込みや言語の切り替えにも対応します。

Google公表値では、Extended Thinking版はArtificial AnalysisのSpeech to Speech Quality Indexで82.6、音声エージェント評価τ-Voiceで68.6%、銀行業務版で35.1%、Big Bench Audioで97.7%を記録しました。

利用者には、画面を触りにくい時の調査、予定整理、仕事の手順実行を声だけで進めやすくなる更新です。ただし数値はGoogleが示した評価で、実際の精度や待ち時間は言語、通信環境、接続する道具で変わります。料金や日本語での利用条件は、使う製品の公式画面で確認してください。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

Google Blogを開く