专栏 AI 管理编年史 第 278/303 讲 查看课程目录

Google DeepMind 正式发布 Gemini 3.8 Live:Extended Thinking 登顶语音基准、基础版价格仅对手七分之一

15/09/2026 289
4:14
Google DeepMind 正式发布 Gemini 3.8 Live:Extended Thinking 登顶语音基准、基础版价格仅对手七分之一
图/Photo by Annie Spratt on Unsplash

2026 年 9 月 15 日,Google DeepMind 正式发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个 audio-to-audio 实时语音模型,支持 97 种语言自动切换、后台工具调用与视觉输入。Extended Thinking 在 Speech-to-Speech Index 以 82.6 超越 OpenAI 与 xAI;基础版 3.8 Live 每小时语音成本 0.84 美元,约为 GPT-Live-1 Astra 的七分之一。

2026 年 9 月 15 日,Google DeepMind 宣布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 正式上线(GA),model id 分别为 gemini-3.8-live 与 gemini-3.8-live-extended-thinking。两者都是 audio-to-audio 实时语音模型:3.8 Live 定位为低延迟、视觉接地、成本导向的默认语音智能体;Extended Thinking 则能在对话进行中于后台推理,处理高复杂度任务。这是 Live API 首次由 3.8 世代驱动,距离 OpenAI 在 9 月 10 日把 GPT-Live-1 推进 API 仅隔五天。

两个模型的共同能力有三项:

  • 对话中自动检测并切换 97 种语言,无需事先指定。
  • 工具与 API 调用在后台执行,对话不会中断。
  • 近实时处理视觉输入,可边看边说。

基准成绩:Extended Thinking 排名第一

依 Artificial Analysis 等第三方基准,Gemini 3.8 Live Extended Thinking 在 Speech-to-Speech Index 拿下 82.6,超过 OpenAI GPT-Live-1 Astra 的 81.5 与 xAI Grok Voice Think Fast 2.0 的 81.3。在智能体任务 τ-Voice 得分 68.6%,领先 GPT-Live-1 的 67.9% 与 Grok 的 56.5%;τ³-Banking 为 35.1%,高于 GPT-Live-1 的 32.0%。另外,Gemini 3.8 Live 系列在 Big Bench Audio 上达 97.7%。差距不算悬殊,但三家中排名第一的位置目前确实由 Google 拿下。

价格战:基础版成本降到对手的七分之一

真正拉开距离的是定价。以每小时输入音频换算,3.8 Live 为 0.84 美元、Extended Thinking 为 3.50 美元;相较之下 Grok Voice Think Fast 2.0 为 4.80 美元、GPT-Live-1 Astra 为 5.83 美元。换言之,基础版 3.8 Live 的成本约为 GPT-Live-1 Astra 的七分之一;登顶基准的 Extended Thinking 虽然贵一些,仍约为 OpenAI 的六成、也低于 xAI。这意味语音客服、语音助手这类需要长时间通话的场景,成本结构将被重新计算。

渠道:从 API 到 Workspace 同步铺开

开发者即日可在 Gemini API 与 Google AI Studio 使用;普通用户通过 Search Live、Gemini Live app 以及 Google Workspace 的 Docs、Gmail、Keep 接触到新模型;企业版 Gemini Enterprise 进入私人预览,后续纳入 Gemini Enterprise for Customer Experience。与 OpenAI 相比,Google 的优势在于既有的 Workspace 与搜索入口,让语音模型不只是 API,而是直接嵌进日常工具。

对管理者的意义

语音智能体的成本门槛在一周内被大幅压低,且 97 种语言自动切换对泰国这种台、中、泰、英混用的职场特别有用。若你的门店、客服或订房热线正评估语音 AI,这则新闻代表选择变多、价格下探,可以先用 AI Studio 以 3.8 Live 试接一条最常见的客服对话,观察延迟与语言切换是否符合实际场景,再决定是否投入。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 Cowork 并入 Claude:单一入口上线,Claude Docs、Slides 同日登场

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策