大模型之家讯 9月17日,Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两个模型,官方称其为谷歌迄今最先进的实时对话模型,定位为可直接上生产的语音 Agent 基础组件。在 Artificial Analysis 的语音质量榜上,Extended Thinking 以 82.6 分拿下总榜第一。
分工上,标准版 Gemini 3.8 Live 主打规模化与成本效率,Extended Thinking 主打高复杂度多步推理任务。其核心突破是将“说话、思考、后台干活”拆开且互不打断:遇到需要多步推理的任务会先用一句话接住用户、再边推理边汇报进度,同时可先应下请求继续聊天,把工具调用和 API 请求放到后台运行,并支持 97 种语言对话中途自动切换。
办事能力方面,Extended Thinking 在 τ-Voice 上得分 68.6%,小幅领先 GPT-Live-1 Astra 的 67.9%;在 Sierra 的 τ-Voice-banking 上为 35.1%,对手为 32.0%;Big Bench Audio 达 97.7%。
原创文章,作者:志斌,如若转载,请注明出处:http://www.damoai.com.cn/archives/18842