【XM经纪商】谷歌(GOOGL.US)发布Gemini 3.8 Live双模型:语音AI进入“边推理边对话”时代,实测得分超越OpenAI、SpaceXAI
获悉,谷歌(GOOGL.US)于周二发布了两款全新的Gemini模型——Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking,主打提升语音智能体性能。
谷歌工程师Tom Ouyang在一篇博客文章中表示:“对于开发者和企业而言,这些模型提供了构建可靠、可投入生产的语音智能体的基础模块。它们还让用户通过Gemini应用、Google Workspace和搜索与Gemini对话更加流畅、更具协作性——帮助用户仅凭语音即可完成复杂任务。”
据了解,Gemini 3.8 Live Extended Thinking在AI语音转语音评测基准(Artificial Intelligence Speech to Speech Index)上得分82.6%,以微弱优势超越了OpenAI的GPT-Live-1 Astra(81.5%)和SpaceXAI(SPCX)的Grok Voice Think Fast 2.0(81.3%)。

Ouyang表示:“对于需要深度推理的任务,3.8 Live Extended Thinking能够边推理边说话。它为复杂工作流带来更强的智能水平,同时保持对话的连贯流畅——通过‘让我查一下……’等早期语音提示自然地回应用户,并以实时进度叙述引导用户了解多步骤后台任务的推进过程。”
另外,谷歌还与赛富时(CRM.US)、Genspark和Lumeris合作,探索新模型的应用场景。
赛富时旗下Agentforce产品副总裁Bob Van Osten表示:“通过将实时多模态能力与智能体AI相结合,我们正在探索新的方式,从首次接触到问题解决,打造更丰富、更直观的客户体验。”

据介绍,Gemini 3.8 Live即日起面向开发者开放,可通过Gemini API和Google AI Studio使用,并在Gemini Enterprise中开启私密预览,同时面向所有用户登陆Search Live。Gemini 3.8 Live Extended Thinking即日起面向开发者开放,可通过Gemini API和Google AI Studio使用,在企业版Gemini Enterprise中开启私密预览,并面向所有用户在Gemini Live和Google AI Pro中上线。