谷歌发布Gemini 3.8 Live双模型:语音AI进入“边推理边对话”时代,实测得分超越OpenAI、SpaceXAI

发布时间:2026-09-16 13:56

  谷歌工程师Tom Ouyang在一篇博客中表示:“对于开发者和企业而言,这些模型提供了构建可靠、可投入生产的语音智能体的基础模块。它们还让用户通过Gemini应用、Google Workspace和与Gemini对话更加流畅、更具协作性——帮助用户仅凭语音即可完成复杂任务。”

  Ouyang表示:“对于需要深度推理的任务,3.8 Live Extended Thinking能够边推理边说话。它为复杂工作流带来更强的智能水平,同时保持对话的连贯流畅——通过‘让我查一下……’等早期语音提示自然地回应用户,并以实时进度叙述引导用户了解多步骤后台任务的推进过程。”

  另外,谷歌还与赛富时、Genspark和Lumeris合作,探索新模型的应用场景。

  赛富时旗下Agentforce产品副总裁Bob Van Osten表示:“通过将实时多模态能力与智能体AI相结合,我们正在探索新的方式,从首次接触到问题解决,打造更丰富、更直观的客户体验。”

排行

精选