Googleが、ライブカメラ映像を解析してリアルタイムに音声でガイドする、Gemini Live向けのアクセシビリティ機能「Guided Vision」を発表。Airaと提携し、1,000人以上の視覚障がいのあるテスターの協力を得て開発された。
Googleが、Geminiにおいて再利用可能なカスタム指示をスラッシュコマンドで呼び出せる「Skills」を導入。複数のSkillsを組み合わせたり、テキスト・PDF・画像ファイルを参照させることも可能で、2027年半ばまでに既存のGemsを完全に置き換える予定。
Googleが新フロンティアモデル「Gemini 4 Argon」を発表。出力トークン上限100万という大幅増量に加え、コーディングやサイバーセキュリティのベンチマークで高いスコアを記録し、信頼されたサイバー防御チームを皮切りに段階的に提供を開始する。
Googleが「Gemini 3.8 Live」向けに、ほぼリアルタイムの映像生成と音声を組み合わせた「Live Avatar」を発表。97言語対応でリップシンクと表情豊かな会話アニメーションを実現し、全出力にSynthID電子透かしを付与。現時点ではGemini Enterprise限定で提供。
Googleが、これまでで最も表現力豊かな音声生成モデルとする「Gemini 3.8 Flash TTS」「Flash-Lite TTS」を発表。100以上の言語に対応し、テキストプロンプトからの音声作成、30秒のサンプルからの複製、長尺・複数話者生成に対応。Hume AIの音声品質ベンチマークで首位を獲得した。
Googleが、生産性系(Airtable、Linear、monday.com)、クリエイティブ系(Adobe、Picsart、Webflow)、ライフスタイル系(apartments.com、Experian、Peloton、SeatGeek)にわたるサードパーティアプリ連携を新たにGeminiへ導入。設定画面または「@」メンションから利用できる。
Geminiアプリ内の適応学習機能「学習ノートブック」が、個人アカウントに続き学校・職場のGoogleアカウントにもEEA域外で世界展開。クイズ、パーソナライズされたレッスン、進捗管理を提供する。
GitHubが、Gemini 3.7 Flash、GPT-5.5、GPT-5.4、GPT-5.4 mini、GPT-5 mini、Grok 4.5を2026年10月19日付で全Copilot利用面から廃止すると発表。Business/Enterprise顧客はデフォルト設定を無効化していない限り、新モデルへ自動的に切り替わる。
Googleがリアルタイム音声モデルを2種類発表。コストを抑えた大規模利用向けの「Gemini 3.8 Live」と、複雑な複数手順の推論とライブでの進捗説明に対応する「3.8 Live Extended Thinking」。97言語に対応し会話中の言語切り替えも自動化。