Google 发布两款实时对话模型。Gemini 3.8 Live 主打规模与成本效率,把对话智能、流畅语音与视觉接地结合起来:它能近乎实时地处理视觉输入,在对话中途自动识别并切换 97 种支持语言,并在继续交谈的同时在后台执行工具与 API 调用。Gemini 3.8 Live Extended Thinking 面向高复杂度任务,边推理边说话,会用「让我查一下」这类口语化提示承接请求,并实时播报多步后台任务的进展。