2026-09-16 · 来源:{'name': 'SiliconANGLE', 'url': 'https://siliconangle.com/2026/09/15/googles-new-speech-model-gemini-3-8-live-supports-real-time-reasoning/'}

Google最新语音模型Gemini 3.8 Live与Live Extended Thinking,以近实时推理和"边说边想"的同步处理,直击语音AI智能体的延迟痛点。
Google LLC发布了两款全新语音模型——Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking,并将其定位为公司迄今最先进的语音处理模型。此次发布直指对话式人工智能中最顽固的障碍之一:延迟。正是延迟,让语音AI智能体在实时对话中难以做到反应灵敏、自然流畅。
最核心的能力是近实时推理。Google称这两款模型能够实现言语与思考的同步处理——推理在语音生成的同时展开,而非延续语音助手一贯的"先听、再想、后说"串行流程。Gemini 3.8 Live Extended Thinking版本则代表面向更深度推理的第二种模式,将思考型模型路线延伸至Google的语音产品线,并纳入旗舰Live品牌之下。
长期以来,延迟一直是语音AI智能体的头号约束。用户以零点几秒为单位评判语音界面:一问一答之间的停顿会瞬间击碎对话的沉浸感,这是文本聊天中的延迟永远无法相比的。而将语音识别、推理模型和语音合成串联起来的流水线,会在每个环节层层叠加延迟。边说边推理的模型从根源上直击这一瓶颈,这也正是Google将此次发布定位为解决语音智能体延迟问题之举的原因。
对于正在评估将语音智能体用于面向客户工作负载的企业而言,决定性的问题已转向可用性、定价,以及生产规模下实测的延迟改善幅度。尽管如此,此次发布仍清晰传递了方向信号:Google正在把实时推理——而非单纯的语音质量——树立为下一代语音AI智能体的关键标尺,而Gemini 3.8 Live及其Extended Thinking兄弟产品,正是带着这一主张走向市场。
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅