Gemini Omni
返回文章列表
7 分钟阅读

Gemini 2026 年 10 月动态:3.8 Live、3.8 TTS、Omni 入驻 Vids、Gemini 4 Argon 与 Nano Banana 2.1

9 月 3 日至 10 月 8 日盘点:3.8 Live 与 TTS 正式 GA、Omni 1.1 进入 Google Vids、Lyria 3.5、Gemini 4 Argon 宣布、Nano Banana 2.1 上线,以及 2.5 访问政策更正。

Gemini OmniGemini Omni FlashGemini 3.8 LiveGemini 3.8 Flash TTSGemini 4 ArgonNano Banana 2.12026中文

9 月 3 日至 10 月 8 日

自 9 月更新 以来,Google 陆续 GA 多款模型、关停一条 Omni 预览端点,并宣布新的旗舰文本模型——开发者目前仍无法使用。本文覆盖 2026 年 9 月 3 日至 10 月 8 日,重点说明仍影响生产系统的变更与需要跟进的截止日期。

Omni 动态

Omni 1.1 Flash 进入 Google Vids(9 月 23 日)

据 Google Workspace Updates,Omni 1.1 Flash 于 9 月 23 日 进入 Google Vids。相较此前 Vids 内的视频生成,Google 强调:

能力说明
视频扩展质量更高;角色与音频一致性明显提升
时长可指定精确时长
分辨率可直接生成 1080p,或将 AI 视频放大至 1080p

可用范围:Business Starter / Standard / Plus,Enterprise Starter / Standard / Plus,Education Plus,以及持有 Google AI Pro 或 Ultra 的个人 Google 账号。无管理员开关,符合条件的账号直接可用。

预览端点关停(9 月 30 日)

gemini-omni-flash-preview 已按计划在 2026 年 9 月 30 日 下线。所有 Omni Flash API 与生产环境请使用 GA 模型 gemini-omni-1.1-flash。

Omni Pro

截至 10 月 8 日,Google 未公布 Gemini Omni Pro 的 GA 日期。Google AI 订阅方案页面目前仅列出 Gemini App 与 Flow 中的 Omni Flash,未列出 Omni Pro。除此前 Ultra 优先预览的表述外,未见新的官方更新。

Gemini 3.8 Live(9 月 15 日 GA)

Google 于 2026 年 9 月 15 日 将 Gemini 3.8 Live 系列 GA,面向低延迟语音智能体与实时音频交互。

模型 ID定位
gemini-3.8-live低延迟语音智能体默认选择;支持 interleaved reasoning;默认异步函数调用;完整会话 client content 更新
gemini-3.8-live-extended-thinking更高推理能力;实时音频交互中支持后台推理,适合复杂任务

开发者 通过 Gemini API 与 Google AI Studio 使用。企业 可申请 Gemini Enterprise 私有预览。消费者 在 Search Live 使用。Extended Thinking 亦在 Gemini Live 以及 Docs、Gmail、Keep 中提供。

gemini-3.8-live 现在是 Live API 语音智能体的默认选择,优先于 gemini-3.1-flash-live-preview。若仍指向 3.1 预览,请规划迁移,并参考我们的 Gemini 3.1 Flash Live API 指南。

Gemini 3.8 TTS(9 月 22 日 API GA)

Gemini 3.8 Flash TTS 系列于 9 月 22 日 API GA,9 月 23 日 官方博客跟进说明。

模型 ID适用场景
gemini-3.8-flash-tts创意方向、角色设计、逐行表演控制、方言、长文本多轮稳定
gemini-3.8-flash-lite-tts高吞吐、低成本;用于替换 gemini-3.1-flash-tts-preview

新增 Voices 端点 /v1beta/voices:声音设计、声音复刻(需同意验证)、150+ 预置与自定义声音。Gemini 3.8 Flash-Lite TTS 也已在 Google Vids 中提供;Gemini 3.8 Flash TTS 可通过 Gemini API 和 Google AI Studio 使用,Gemini Enterprise 的 API 访问标注为“即将推出”。

Lyria 3.5(9 月 3 日 GA)

lyria-3.5 于 9 月 3 日 GA,支持完整歌曲生成。Google 称音乐连贯性更好、人声更自然,并可精细控制时长与结构。输入:文本与图片。输出:44.1 kHz 立体声。

Gemini 4 Argon(9 月 30 日宣布)

9 月 30 日,Google 宣布新旗舰模型 Gemini 4 Argon。开发者目前无法使用。 现阶段仅通过 Fairwind 计划向受信任的网络安全防御方开放;Google 正在参与美国政府的自愿性发布前模型访问流程。

流程结束后,Google 计划先向 付费 API 客户 与 Google AI Ultra 订阅者开放。未公布 公开可用日期。

引入期定价(引入期内):

输入(每百万 token)输出(每百万 token)
引入期$2$10
缓存输入缓存输入 token 享 95% 折扣—
引入期结束后$4$20

在 Google 发布模型 ID 与通用 API 访问之前,不要在生产计划里假设 Argon 可用。Gemini 4 线路背景见 Gemini 4 路线图预览。

Nano Banana 2.1(10 月 6 日 GA)

gemini-nano-banana-2.1 于 10 月 6 日 GA,面向图像生成与对话式编辑。Google 称画质、提示遵循、多轮角色一致性与文字渲染均有改进。

新增宽高比 1:4、4:1、1:8、8:1,输出 1K / 2K / 4K。

gemini-3.1-flash-image 已弃用,将于 2026 年 10 月 29 日 下线,请在此之前完成迁移。

from google import genai

client = genai.Client()

response = client.models.generate_content(
    model="gemini-nano-banana-2.1",  # 原为 gemini-3.1-flash-image
    contents="白底产品图,柔和阴影。",
)

其他 API 变更

日期变更
9 月 1 日Agentic video understanding(gemini-3.7-flash、gemini-3.6-flash、gemini-3.5-flash-lite):长视频理解最多减少 88% token
9 月 17 日antigravity-preview-09-2026 取代 antigravity-preview-05-2026;5 月预览已于 10 月 5 日 关停
Antigravity 本地工具参数由 snake_case 改为 PascalCase;文件编辑由整文件重写改为行范围替换
Antigravity 远程沙箱若仅读取 output_text / model_output,只需更新 agent 模型字符串

Gemini 2.5 状态更正

Google 于 9 月 18 日 更新说明:Gemini 2.5 系列未被弃用,继续提供服务直至另行通知;访问仅限于过去使用过的用户。新项目请使用 gemini-3.5-flash-lite 或 gemini-3.8-flash。

我们在 2026 年 9 月更新 中写过的 10 月 16 日 2.5 下线日期已不适用,该文已按 Google 现行政策修订。

10 月行动清单

  1. 确认生产环境 Omni 已使用 gemini-omni-1.1-flash(预览端点已关停)。
  2. 评估语音智能体是否迁移至 gemini-3.8-live(需要更强推理时可考虑 Extended Thinking)。
  3. 在 2026 年 10 月 29 日 前将 gemini-3.1-flash-image 迁移至 gemini-nano-banana-2.1。
  4. 若调用 Antigravity 本地工具,请更新解析逻辑以适配 PascalCase 参数与行范围文件编辑。
  5. 不要为 Gemini 4 Argon 排期生产依赖,直至 Google 开放通用开发者访问。

相关阅读