谷歌发布Gemini 3.8 Live实时对话模型,97种语言边聊边执行后台任务

【软盟资讯 · 7×24快讯】(2026年09月15日) 当地时间9月15日,谷歌宣布推出Gemini 3.8 Live和Extended Thinking两款实时对话模型,前者面向规模部署与成本优化,后者面向高复杂度任务、强化多步推理。Gemini 3.8 Live支持近实时视觉输入,对话中可自动切换97种语言,并在后台执行工具和API调用、保持对话流畅;Extended Thinking版实现推理与发言同步,通过“让我确认一下…”等提示实时讲解多步后台任务进度。Extended Thinking在Artificial Analysis语音对语音质量指数排名第一(82.6%),Big Bench Audio得分97.7%。两款模型已通过Gemini API、Google AI Studio、Workspace及Gemini应用向开发者开放,Search Live同步上线。

软盟观察: 谷歌把Gemini 3.8 Live分成“标准版+Extended Thinking”两款,是语音智能体商业化的务实分法:标准版主打规模与成本,靠97种语言切换和后台工具调用抢占高频日常;Extended Thinking主打多步推理,用“边说边想、实时讲解进度”啃复杂任务的硬骨头,还在多项语音智能体基准上拿下第一。这背后反映的是语音AI竞争焦点的转移——从“能不能听懂”转向“能不能边对话边干活”,从“聊天陪伴”升级为“实时协作的语音同事”。对开发者而言,Gemini API、Search Live、Google AI Studio同步开放意味着它正抢着做“语音Agent”的基础设施。但也要看到,多语言切换和后台任务执行的能力一旦规模化,数据合规、语言偏见和实时交互的稳定性,将是比发布会跑分更现实的考验。

上一篇:

下一篇:

发表回复

登录后才能评论