Gemini Omni
返回文章列表
7 分钟阅读

Gemini 2026年9月最新动态:3.8 Flash 发布、Omni 1.1 迁移截止与 2.5 退役

2026 年 9 月初盘点:Gemini 3.8 Flash 面向智能体与编码上线,Omni 1.1 Flash GA 且预览端点 9 月 30 日关停,Gemini 2.5 系列 10 月退役,Omni Pro 预览持续铺开。

Gemini OmniGemini Omni FlashGemini 3.8 FlashGemini 3.7 FlashAPIMigration2026中文

夏末的密集发布

8 月以 Gemini 栈两端的两条 Flash 线收尾。Gemini Omni 1.1 Flash 于 8 月 27 日正式 GA,面向视频生成。Gemini 3.7 Flash 于 8 月 13 日上线,面向文本、智能体与编码。9 月 2 日,Google 发布 Gemini 3.8 Flash,六周内第三次 Flash 更新。

本文梳理 8 月下旬至 9 月初的变化,重点列出影响生产系统的截止日。

Gemini 3.8 Flash:新主力模型(9 月 2 日)

Google 于 2026 年 9 月 2 日 发布 Gemini 3.8 Flash。模型 ID:gemini-3.8-flash。定位与 3.7 Flash 相同——软件工程、智能体编排、多步推理——在相同入门价下 benchmark 更高。

相较 3.7 Flash 的提升

领域主要变化
长程编码DeepSWE v1.1 端到端软件任务表现更强
企业智能体金融与法律智能体 benchmark(Vals Finance Agent V2、Harvey Legal Agent Benchmark)更好
通用推理HLE-Verified 54.9%,覆盖 STEM 与专业领域
安全提示注入鲁棒性提升(Gray Swan 指标)

3.8 Flash 在难题上默认消耗更多 token,会执行额外推理步骤并迭代工具调用。对延迟敏感的路径,将 thinking_level 设为 LOW,或继续使用 gemini-3.7-flash(Google 仍支持效率优先工作负载)。

定价(与 3.7 相同)

时段输入(每百万 token)输出(每百万 token)
至 2026 年 12 月 31 日$0.75$3.75
2027 年 1 月 1 日起$1.50$7.50

可用渠道

  • 开发者:Gemini API、Google AI Studio、Android Studio、Google Antigravity
  • 企业:Gemini Enterprise Agent Platform
  • 消费者:Gemini App、搜索 AI 模式、Google Sheets 中的 Gemini(AI Pro 与 Ultra 订阅者)
  • Gemini Spark:面向 Pro 与 Ultra 的 24/7 个人智能体现已切换至 3.8 Flash

Gemini 3.8 Flash Cyber

Google 同步发布 Gemini 3.8 Flash Cyber,用于漏洞发现与自动补丁。访问限于 Fairwind Program 中的可信防御方。这是独立模型 ID,不能替代通用工作负载。

从 3.7 或 3.6 Flash 迁移

  1. 将模型字符串改为 gemini-3.8-flash
  2. 用字符串枚举 thinking_levelLOWMEDIUMHIGH;默认 MEDIUM)替换整数 thinking_budget
  3. 该模型系列不再使用已弃用的 temperaturetop_p 参数。
from google import genai
from google.genai import types

client = genai.Client()

response = client.models.generate_content(
    model="gemini-3.8-flash",
    contents="Refactor this module for async I/O.",
    config=types.GenerateContentConfig(
        thinking_config=types.ThinkingConfig(thinking_level="MEDIUM"),
    ),
)

Gemini 3.7 Flash 回顾(8 月 13 日)

若你错过了 8 月公告,3.7 Flash 在 token 成本优先于峰值推理深度时仍是合理选择。它与 3.8 共享 100 万 token 上下文、多模态输入(文本、图像、音频、视频、PDF)及 12 月 31 日前的入门价。

Google 的发布节奏不寻常:六周内三个 Flash(3.6 → 3.7 → 3.8),而 Gemini 3.5 Pro 仍无 GA 日期。多数新建智能体与编码项目应以 3.8 Flash 为默认起点

Omni 1.1 Flash GA:9 月 30 日前完成迁移

Gemini Omni 1.1 Flash 于 8 月 27 日正式 GA。稳定模型 ID:gemini-omni-1.1-flash。预览端点 gemini-omni-flash-preview 将于 2026 年 9 月 30 日 关停。

距截止日约四周。迁移通常只需改一行模型字符串,但务必在生产使用的每个分辨率下验证响应结构(360p 草稿、720p、1080p 放大、4K 放大)。

端点状态行动
gemini-omni-1.1-flashGA新负载与迁移后的生产环境均使用
gemini-omni-flash-preview已弃用9 月 30 日前完成迁移与回归测试

场景延展、首尾帧控制及完整功能解读见我们的 Omni 1.1 Flash 发布公告

Gemini 2.5 退役:2026 年 10 月 16 日

与 Omni 线独立,Google 将在 Gemini API 与 Vertex AI / Agent Platform 退役 Gemini 2.5 Pro2.5 Flash2.5 Flash-Lite。最早退役日:2026 年 10 月 16 日。Google 可能在关停前一个月阻止新访问。

即将退役的模型建议替换
gemini-2.5-progemini-3.5-flashgemini-3.1-pro-preview
gemini-2.5-flashgemini-3.5-flashgemini-3.8-flash
gemini-2.5-flash-litegemini-3.1-flash-litegemini-3.5-flash-lite

新建 GCP 项目可能在官方日期之前就对 2.5 模型返回 404。Google 建议新工作负载直接使用 3.x 等价模型。

若代码仍使用旧版 Vertex AI SDK,请尽快迁移至 Google GenAI SDK。Agent Platform 2026 年 6 月后的 SDK 版本不支持新 Gemini 功能。

Gemini Omni Pro 预览:仍以 Ultra 为先

截至 9 月初,Gemini Omni Pro 尚无 GA 日期。8 月面向 AI Ultra 订阅者 与部分企业合作伙伴的预览仍在铺开。Pro 相较 Flash 提供最长 30 秒片段、1080p 输出、多角色原生音频及更强的角色一致性。

Pro 目前仅限消费者端。Pro 的 API 端点预计在 Flash GA 稳定后推出,可能在 2026 年底。

Gemini Live:9 月无新模型

Gemini 3.1 Flash Livegemini-3.1-flash-live-preview)仍是 Live API 当前实时语音与视觉智能体模型。本窗口内无新 Live 模型发布。集成模式见我们的 Gemini 3.1 Flash Live API 指南

9 月行动清单

  1. Omni 开发者:切换至 gemini-omni-1.1-flash,9 月 30 日前完成测试。
  2. 智能体/编码开发者:评估 gemini-3.8-flash;若延迟是首要约束,保留 gemini-3.7-flash
  3. 2.5 用户:10 月 16 日前规划迁移至 3.x;若尚未做,将模型 ID 抽象到配置层。
  4. 视频创作者:Omni 1.1 场景延展与 360p 草稿模式已向 Plus、Pro、Ultra 订阅者在 Flow 与 Gemini App 开放。

2026 秋季展望

Google 公开路线图仍指向 Omni Pro 更广铺开、Omni 家族的图像与音频输出模态,以及 Workspace 集成(Docs、Slides、Vids)。Flash 文本线可能在 Q4 继续保持快速发布节奏。

更早背景见 2026 年 8 月更新Omni 1.1 Flash 发布公告2026 年 5 月发布说明