一次情報で読む、いまのAI
← すべてのニュース

Gemini 3.8 Liveと拡張思考版を発表

目線

音声エージェントを作る開発者はLive APIの新モデルでレイテンシとツール呼び出しを比較試用する段階。

対象

音声エージェント・リアルタイム対話の開発者

使える場面

  • 本番向け音声エージェント構築
  • ビジュアル接地したライブ対話
  • Workspaceでの音声コラボ

試すなら

Gemini API LiveやAI Studioで3.8 Liveを試す

確認点

Enterprise向けはprivate preview、料金詳細は要確認

背景

近リアルタイム推論で音声エージェントを強化し、直感的で知的な対話を可能にするため。

何が変わったか

  • 3.8 Live: スケール・コスト効率重視の対話知能とビジュアル接地
  • 3.8 Live Extended Thinking: 高複雑タスク向けマルチステップ推論と同時発話
  • 97言語の自動切替、バックグラウンドでのツール/API実行
  • Speech to Speech等ベンチでトップクラス、SynthID透かし付与

使える場面・影響

開発者はLive API経由で信頼性の高い音声エージェントを構築しやすくなり、GeminiアプリやWorkspace/Searchでも活用可能。

試す前に確認

  • 開発者向け: Gemini APIとGoogle AI Studioで本日開始
  • Enterprise: Gemini Enterpriseでprivate preview
  • 一般: Search Live、Gemini Live、対象Workspaceプランで利用

一次ソース