Googleは15日(現地時間)に、Gemini 3.8 LiveとGemini 3.8 Live Extended Thinkingモデルを公開した。3.8 Large-scale deploymentとコスト効率に最適化されており、Extended Thinkingは多段推論とエージェントタスクのために強化されたバージョンだ。両モデルとも会話中に97言語を自動検知し言語を切り替えることができ、カメラ画像をほぼリアルタイムで処理可能。さらにAPIコールを会話のバックグラウンドで実行することで、対話の流れを途切れさせずツールの利用を可能にする。
Google、Gemini 3.8 LiveとExtended Thinkingモデルを発表
Googleは15日(現地時間)に、リアルタイムな音声対話向けのGemini 3.8 Liveと複雑なタスク向けのExtended Thinkingモデルを公開した。どちらのモデルも会話の流れを途切れさせず、ツールの利用と多言語対応が可能。Extended Thinkingは多段推論やエージェントタスクに強化されており、97言語での自動言語切り替えやカメラ画像のほぼリアルタイム処理に対応する。
01GoogleGemini人工知能音声アシスタントリアルタイムマルチモーダルAPIWorkspace