事件概述
Google AI for Developers 的 Gemini API 更新日志显示,Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 已于 2026 年 9 月 15 日正式达到 GA(一般可用)。这是最近 7 天内可核对到的官方模型版本更新;本文于 9 月 16 日复核了发布日期和模型标识。
模型与开发者
开发者为 Google,两个模型都是面向 Live API 的音频到音频模型,目标是实时语音应用。普通版模型标识为 gemini-3.8-live,扩展思考版标识为 gemini-3.8-live-extended-thinking。
关键能力
Gemini 3.8 Live 被官方定位为大多数低延迟语音智能体和实时对话的默认选择,支持交错推理、默认异步函数调用,以及完整的会话客户端内容更新。Extended Thinking 版本则支持在语音互动期间进行后台推理,适合需要更强多步思考的场景。以上为 Google 更新日志中的能力描述,并非本文独立测评结果。
适用对象与影响
语音客服、实时陪练、会议助手和需要工具调用的语音智能体开发者,可以据此评估是否从预览端点迁移到 GA 端点。迁移时应重新检查会话生命周期、函数调用时延、打断处理和错误重试;低延迟与更强推理之间仍需按业务取舍。
限制与注意事项
官方公告只确认模型已在 Gemini API 的 Live API 路径一般可用,没有在该条目中承诺所有地区、客户端或第三方框架同时开放。Extended Thinking 可能带来额外等待,不能把“支持后台推理”理解成每个请求都会更快。实际调用前请查看 Live API、能力与 Thinking 指南,并以账户控制台显示的可用模型为准。
官方来源
Google Gemini API 更新日志(2026-09-15 条目)
Google Live API 官方指南 |