
资讯
Google 发布 Gemini 3.8 Live 双模型:语音可后台调用工具
一句话:9 月 16 日 Google 推出 Gemini 3.8 Live 双模型,主打实时全双工语音交互,并可在对话后台调用工具与执行任务,以显著低于竞品的成本对标 OpenAI GPT-Live 1。
背景
- 语音交互从「低延迟对话」走向「对话中并行推理 + 工具执行」;Gemini 3.8 Live 把语音推理与任务执行并入实时链路,与 GPT-Live 1 直接竞争。
核心要点
- 原生全双工语音,可在持续交流中判断回应时机、处理打断。
- 语音推理与工具调用(ToolCall)并行,长任务异步执行不打断对话。
- 以远低于竞品的成本提供实时语音 agent 能力。
- 与 Gemini 3.8 Flash / Cyber 形成「语音 + 推理 + 安全」组合。
为什么重要
- 实时语音 + 后台工具调用,是语音 agent 从「聊天」走向「办事」的关键一步。
- 成本下探将加速语音 agent 在客服、陪伴等场景的规模落地。
关键事实速记
- 发布:2026-09-16
- 形态:双模型(Live)
- 能力:全双工语音 + 后台工具
- 对标:OpenAI GPT-Live 1
📂 原文链接:查看原文 →
← 返回资讯列表
AI8899 · 内容仅供学习参考