← 资讯列表
资讯

Google 发布 Gemini 3.8 Live 双模型:语音可后台调用工具

📅 2026/9/16 08:00:00👁 1 阅读⏱ 约 3 分钟

一句话:9 月 16 日 Google 推出 Gemini 3.8 Live 双模型,主打实时全双工语音交互,并可在对话后台调用工具与执行任务,以显著低于竞品的成本对标 OpenAI GPT-Live 1。

背景

  • 语音交互从「低延迟对话」走向「对话中并行推理 + 工具执行」;Gemini 3.8 Live 把语音推理与任务执行并入实时链路,与 GPT-Live 1 直接竞争。

核心要点

  • 原生全双工语音,可在持续交流中判断回应时机、处理打断。
  • 语音推理与工具调用(ToolCall)并行,长任务异步执行不打断对话。
  • 以远低于竞品的成本提供实时语音 agent 能力。
  • 与 Gemini 3.8 Flash / Cyber 形成「语音 + 推理 + 安全」组合。

为什么重要

  • 实时语音 + 后台工具调用,是语音 agent 从「聊天」走向「办事」的关键一步。
  • 成本下探将加速语音 agent 在客服、陪伴等场景的规模落地。

关键事实速记

  • 发布:2026-09-16
  • 形态:双模型(Live)
  • 能力:全双工语音 + 后台工具
  • 对标:OpenAI GPT-Live 1

📂 原文链接:查看原文 →

← 返回资讯列表 AI8899 · 内容仅供学习参考