谷歌推出Gemini 3.8 Live与Extended Thinking,称其为迄今最先进实时对话模型
2026-09-16 · hyzy118.com
谷歌推出Gemini 3.8 Live与Extended Thinking,称其为迄今最先进实时对话模型 当地时间9月15日,谷歌宣布推出Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking。谷歌称,这是迄今最先进的实时对话模型,在智能和并行推理方面均有显著提升。 其中,Gemini 3.8 Live面向规模部署
谷歌推出Gemini 3.8 Live与Extended Thinking,称其为迄今最先进实时对话模型
当地时间9月15日,谷歌宣布推出Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking。谷歌称,这是迄今最先进的实时对话模型,在智能和并行推理方面均有显著提升。
其中,Gemini 3.8 Live面向规模部署与成本优化,兼顾对话智能、流畅交流和视觉理解;Gemini 3.8 Live Extended Thinking则瞄准高复杂度任务,具备更强的智能和多步推理能力。
在多项基准测试中,Gemini 3.8 Live Extended Thinking以82.6%位列Artificial Analysis语音对语音质量指数第一名。
其在τ-Voice智能体任务完成率为68.6%,在Sierra的τ-Voice-banking基准测试达35.1%;推理能力方面,Big Bench Audio得分为97.7%,同时保持有竞争力的定价。
Gemini 3.8 Live可近实时处理视觉输入,在对话中自动 检测 并切换97种支持的语言,并可在后台执行工具与API调用,同时保持对话流畅不中断。
开发者可通过Gemini Live API,在声网、Fishjam、LiveKit、Pipecat、Vercel、Vision Agents等平台构建高性能语音驱动界面。谷歌还与Salesforce、Genspark、Lumeris等企业开展合作。
谷歌对AI生成的音频嵌入SynthID隐形水印,可直接检测AI生成内容,帮助防止虚假信息传播。Gemini 3.8 Live已开始推送,开发者可在Gemini API和Google AI Studio使用。
市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。
财经频道更多独家策划、专家专栏,免费查阅>>