Google DeepMindは9月15日、Gemini 3.8 LiveとExtended Thinkingを発表した。従来の音声AIのように沈黙して考えるのではなく、会話を続けながら多段階推論やツール実行を並行し、進捗を自然言語で伝えられる点が特徴とされる。97言語の自動切り替えやベンチマーク首位、コスト効率の高さも語られており、Google AI Studioから即利用できる。WorkspaceやSearchへの展開も予定されているため、音声エージェントやハンズフリーな調査フローを検討しているチームにとっては、実装経路の選択肢が増える。
エンジニア視点:
- 音声+ツール実行はレイテンシと中断復帰の設計が肝になる
- Studioでの試作とWorkspace展開の権限・データ所在を分けて評価する
- 多言語自動切替を使うなら、ログと監査の言語境界も先に決める