Gemini 2026 年 10 月动态:3.8 Live、3.8 TTS、Omni 入驻 Vids、Gemini 4 Argon 与 Nano Banana 2.1
9 月 3 日至 10 月 8 日盘点:3.8 Live 与 TTS 正式 GA、Omni 1.1 进入 Google Vids、Lyria 3.5、Gemini 4 Argon 宣布、Nano Banana 2.1 上线,以及 2.5 访问政策更正。
9 月 3 日至 10 月 8 日
自 9 月更新 以来,Google 陆续 GA 多款模型、关停一条 Omni 预览端点,并宣布新的旗舰文本模型——开发者目前仍无法使用。本文覆盖 2026 年 9 月 3 日至 10 月 8 日,重点说明仍影响生产系统的变更与需要跟进的截止日期。
Omni 动态
Omni 1.1 Flash 进入 Google Vids(9 月 23 日)
据 Google Workspace Updates,Omni 1.1 Flash 于 9 月 23 日 进入 Google Vids。相较此前 Vids 内的视频生成,Google 强调:
| 能力 | 说明 |
|---|---|
| 视频扩展 | 质量更高;角色与音频一致性明显提升 |
| 时长 | 可指定精确时长 |
| 分辨率 | 可直接生成 1080p,或将 AI 视频放大至 1080p |
可用范围:Business Starter / Standard / Plus,Enterprise Starter / Standard / Plus,Education Plus,以及持有 Google AI Pro 或 Ultra 的个人 Google 账号。无管理员开关,符合条件的账号直接可用。
预览端点关停(9 月 30 日)
gemini-omni-flash-preview 已按计划在 2026 年 9 月 30 日 下线。所有 Omni Flash API 与生产环境请使用 GA 模型 gemini-omni-1.1-flash。
Omni Pro
截至 10 月 8 日,Google 未公布 Gemini Omni Pro 的 GA 日期。Google AI 订阅方案页面目前仅列出 Gemini App 与 Flow 中的 Omni Flash,未列出 Omni Pro。除此前 Ultra 优先预览的表述外,未见新的官方更新。
Gemini 3.8 Live(9 月 15 日 GA)
Google 于 2026 年 9 月 15 日 将 Gemini 3.8 Live 系列 GA,面向低延迟语音智能体与实时音频交互。
| 模型 ID | 定位 |
|---|---|
gemini-3.8-live | 低延迟语音智能体默认选择;支持 interleaved reasoning;默认异步函数调用;完整会话 client content 更新 |
gemini-3.8-live-extended-thinking | 更高推理能力;实时音频交互中支持后台推理,适合复杂任务 |
开发者 通过 Gemini API 与 Google AI Studio 使用。企业 可申请 Gemini Enterprise 私有预览。消费者 在 Search Live 使用。Extended Thinking 亦在 Gemini Live 以及 Docs、Gmail、Keep 中提供。
gemini-3.8-live 现在是 Live API 语音智能体的默认选择,优先于 gemini-3.1-flash-live-preview。若仍指向 3.1 预览,请规划迁移,并参考我们的 Gemini 3.1 Flash Live API 指南。
Gemini 3.8 TTS(9 月 22 日 API GA)
Gemini 3.8 Flash TTS 系列于 9 月 22 日 API GA,9 月 23 日 官方博客跟进说明。
| 模型 ID | 适用场景 |
|---|---|
gemini-3.8-flash-tts | 创意方向、角色设计、逐行表演控制、方言、长文本多轮稳定 |
gemini-3.8-flash-lite-tts | 高吞吐、低成本;用于替换 gemini-3.1-flash-tts-preview |
新增 Voices 端点 /v1beta/voices:声音设计、声音复刻(需同意验证)、150+ 预置与自定义声音。Gemini 3.8 Flash-Lite TTS 也已在 Google Vids 中提供;Gemini 3.8 Flash TTS 可通过 Gemini API 和 Google AI Studio 使用,Gemini Enterprise 的 API 访问标注为“即将推出”。
Lyria 3.5(9 月 3 日 GA)
lyria-3.5 于 9 月 3 日 GA,支持完整歌曲生成。Google 称音乐连贯性更好、人声更自然,并可精细控制时长与结构。输入:文本与图片。输出:44.1 kHz 立体声。
Gemini 4 Argon(9 月 30 日宣布)
9 月 30 日,Google 宣布新旗舰模型 Gemini 4 Argon。开发者目前无法使用。 现阶段仅通过 Fairwind 计划向受信任的网络安全防御方开放;Google 正在参与美国政府的自愿性发布前模型访问流程。
流程结束后,Google 计划先向 付费 API 客户 与 Google AI Ultra 订阅者开放。未公布 公开可用日期。
引入期定价(引入期内):
| 输入(每百万 token) | 输出(每百万 token) | |
|---|---|---|
| 引入期 | $2 | $10 |
| 缓存输入 | 缓存输入 token 享 95% 折扣 | — |
| 引入期结束后 | $4 | $20 |
在 Google 发布模型 ID 与通用 API 访问之前,不要在生产计划里假设 Argon 可用。Gemini 4 线路背景见 Gemini 4 路线图预览。
Nano Banana 2.1(10 月 6 日 GA)
gemini-nano-banana-2.1 于 10 月 6 日 GA,面向图像生成与对话式编辑。Google 称画质、提示遵循、多轮角色一致性与文字渲染均有改进。
新增宽高比 1:4、4:1、1:8、8:1,输出 1K / 2K / 4K。
gemini-3.1-flash-image 已弃用,将于 2026 年 10 月 29 日 下线,请在此之前完成迁移。
from google import genai
client = genai.Client()
response = client.models.generate_content(
model="gemini-nano-banana-2.1", # 原为 gemini-3.1-flash-image
contents="白底产品图,柔和阴影。",
)
其他 API 变更
| 日期 | 变更 |
|---|---|
| 9 月 1 日 | Agentic video understanding(gemini-3.7-flash、gemini-3.6-flash、gemini-3.5-flash-lite):长视频理解最多减少 88% token |
| 9 月 17 日 | antigravity-preview-09-2026 取代 antigravity-preview-05-2026;5 月预览已于 10 月 5 日 关停 |
| Antigravity 本地工具 | 参数由 snake_case 改为 PascalCase;文件编辑由整文件重写改为行范围替换 |
| Antigravity 远程沙箱 | 若仅读取 output_text / model_output,只需更新 agent 模型字符串 |
Gemini 2.5 状态更正
Google 于 9 月 18 日 更新说明:Gemini 2.5 系列未被弃用,继续提供服务直至另行通知;访问仅限于过去使用过的用户。新项目请使用 gemini-3.5-flash-lite 或 gemini-3.8-flash。
我们在 2026 年 9 月更新 中写过的 10 月 16 日 2.5 下线日期已不适用,该文已按 Google 现行政策修订。
10 月行动清单
- 确认生产环境 Omni 已使用
gemini-omni-1.1-flash(预览端点已关停)。 - 评估语音智能体是否迁移至
gemini-3.8-live(需要更强推理时可考虑 Extended Thinking)。 - 在 2026 年 10 月 29 日 前将
gemini-3.1-flash-image迁移至gemini-nano-banana-2.1。 - 若调用 Antigravity 本地工具,请更新解析逻辑以适配 PascalCase 参数与行范围文件编辑。
- 不要为 Gemini 4 Argon 排期生产依赖,直至 Google 开放通用开发者访问。
相关阅读
- 2026 年 9 月更新(含 2.5 访问限制更正)
- Omni 1.1 Flash 发布公告