Gemini ニュース 2026/09/15 AI判定 重要度:高

Google、リアルタイム音声向け新モデル「Gemini 3.8 Live」「3.8 Live Extended Thinking」を発表

#Gemini#Google#GeminiLive#音声AI#リアルタイム

Googleはリアルタイム音声向けの新モデルを2種類発表しました。コスト効率と大規模利用を重視した「Gemini 3.8 Live」と、対話を通じた複雑な複数手順の推論タスクに対応する「Gemini 3.8 Live Extended Thinking」です。

詳細

  • Gemini 3.8 Live: ほぼリアルタイムでの文脈を踏まえた視覚処理、97言語対応で会話中の言語切り替えも自動、対話を中断せずにバックグラウンドでツール・APIを実行可能
  • Extended Thinkingで追加される点: 複雑なワークフロー向けに推論と発話を同時に実行、エンタープライズ業務向けのより深い分析能力、そして「確認しますね…」といった自然な相槌とともに、複数手順の処理中の進捗をライブで説明する機能
  • ベンチマーク: Extended ThinkingはArtificial AnalysisのSpeech to Speech Quality Indexで82.6、τ-Voiceで68.6%、Big Bench Audio推論タスクで97.7%を記録。標準版のLiveはSpeech Agent Arenaで2位につけつつ、コスト効率では優位性を示す
  • 提供状況: 両モデルとも2026年9月15日にリリース。開発者向けにはGemini APIおよびAI Studio、組織向けにはGemini Enterpriseでプライベートプレビュー、一般消費者向けにはSearch Live、Gemini Live、Workspace、Gmail、Keepで利用可能

その後

Liveシリーズを、コスト最適化されたティアと推論重視の「Extended Thinking」ティアに分けるという構成は、Googleが自社のモデルラインナップの他の部分ですでに採用してきた「テキスト/Flash対推論」という分割を、初めてリアルタイム音声に適用したものです。開発者は、安価で高速な音声対話と、対話形式で提供されるより低速で深い推論のどちらかを選べるようになります。