Gemini 2026年9月最新动态:3.8 Flash 发布、Omni 1.1 迁移截止与 2.5 退役
2026 年 9 月初盘点:Gemini 3.8 Flash 面向智能体与编码上线,Omni 1.1 Flash GA 且预览端点 9 月 30 日关停,Gemini 2.5 系列 10 月退役,Omni Pro 预览持续铺开。
夏末的密集发布
8 月以 Gemini 栈两端的两条 Flash 线收尾。Gemini Omni 1.1 Flash 于 8 月 27 日正式 GA,面向视频生成。Gemini 3.7 Flash 于 8 月 13 日上线,面向文本、智能体与编码。9 月 2 日,Google 发布 Gemini 3.8 Flash,六周内第三次 Flash 更新。
本文梳理 8 月下旬至 9 月初的变化,重点列出影响生产系统的截止日。
Gemini 3.8 Flash:新主力模型(9 月 2 日)
Google 于 2026 年 9 月 2 日 发布 Gemini 3.8 Flash。模型 ID:gemini-3.8-flash。定位与 3.7 Flash 相同——软件工程、智能体编排、多步推理——在相同入门价下 benchmark 更高。
相较 3.7 Flash 的提升
| 领域 | 主要变化 |
|---|---|
| 长程编码 | DeepSWE v1.1 端到端软件任务表现更强 |
| 企业智能体 | 金融与法律智能体 benchmark(Vals Finance Agent V2、Harvey Legal Agent Benchmark)更好 |
| 通用推理 | HLE-Verified 54.9%,覆盖 STEM 与专业领域 |
| 安全 | 提示注入鲁棒性提升(Gray Swan 指标) |
3.8 Flash 在难题上默认消耗更多 token,会执行额外推理步骤并迭代工具调用。对延迟敏感的路径,将 thinking_level 设为 LOW,或继续使用 gemini-3.7-flash(Google 仍支持效率优先工作负载)。
定价(与 3.7 相同)
| 时段 | 输入(每百万 token) | 输出(每百万 token) |
|---|---|---|
| 至 2026 年 12 月 31 日 | $0.75 | $3.75 |
| 2027 年 1 月 1 日起 | $1.50 | $7.50 |
可用渠道
- 开发者:Gemini API、Google AI Studio、Android Studio、Google Antigravity
- 企业:Gemini Enterprise Agent Platform
- 消费者:Gemini App、搜索 AI 模式、Google Sheets 中的 Gemini(AI Pro 与 Ultra 订阅者)
- Gemini Spark:面向 Pro 与 Ultra 的 24/7 个人智能体现已切换至 3.8 Flash
Gemini 3.8 Flash Cyber
Google 同步发布 Gemini 3.8 Flash Cyber,用于漏洞发现与自动补丁。访问限于 Fairwind Program 中的可信防御方。这是独立模型 ID,不能替代通用工作负载。
从 3.7 或 3.6 Flash 迁移
- 将模型字符串改为
gemini-3.8-flash。 - 用字符串枚举
thinking_level(LOW、MEDIUM、HIGH;默认MEDIUM)替换整数thinking_budget。 - 该模型系列不再使用已弃用的
temperature与top_p参数。
from google import genai
from google.genai import types
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.8-flash",
contents="Refactor this module for async I/O.",
config=types.GenerateContentConfig(
thinking_config=types.ThinkingConfig(thinking_level="MEDIUM"),
),
)
Gemini 3.7 Flash 回顾(8 月 13 日)
若你错过了 8 月公告,3.7 Flash 在 token 成本优先于峰值推理深度时仍是合理选择。它与 3.8 共享 100 万 token 上下文、多模态输入(文本、图像、音频、视频、PDF)及 12 月 31 日前的入门价。
Google 的发布节奏不寻常:六周内三个 Flash(3.6 → 3.7 → 3.8),而 Gemini 3.5 Pro 仍无 GA 日期。多数新建智能体与编码项目应以 3.8 Flash 为默认起点。
Omni 1.1 Flash GA:9 月 30 日前完成迁移
Gemini Omni 1.1 Flash 于 8 月 27 日正式 GA。稳定模型 ID:gemini-omni-1.1-flash。预览端点 gemini-omni-flash-preview 将于 2026 年 9 月 30 日 关停。
距截止日约四周。迁移通常只需改一行模型字符串,但务必在生产使用的每个分辨率下验证响应结构(360p 草稿、720p、1080p 放大、4K 放大)。
| 端点 | 状态 | 行动 |
|---|---|---|
gemini-omni-1.1-flash | GA | 新负载与迁移后的生产环境均使用 |
gemini-omni-flash-preview | 已弃用 | 9 月 30 日前完成迁移与回归测试 |
场景延展、首尾帧控制及完整功能解读见我们的 Omni 1.1 Flash 发布公告。
Gemini 2.5 退役:2026 年 10 月 16 日
与 Omni 线独立,Google 将在 Gemini API 与 Vertex AI / Agent Platform 退役 Gemini 2.5 Pro、2.5 Flash、2.5 Flash-Lite。最早退役日:2026 年 10 月 16 日。Google 可能在关停前一个月阻止新访问。
| 即将退役的模型 | 建议替换 |
|---|---|
gemini-2.5-pro | gemini-3.5-flash 或 gemini-3.1-pro-preview |
gemini-2.5-flash | gemini-3.5-flash 或 gemini-3.8-flash |
gemini-2.5-flash-lite | gemini-3.1-flash-lite 或 gemini-3.5-flash-lite |
新建 GCP 项目可能在官方日期之前就对 2.5 模型返回 404。Google 建议新工作负载直接使用 3.x 等价模型。
若代码仍使用旧版 Vertex AI SDK,请尽快迁移至 Google GenAI SDK。Agent Platform 2026 年 6 月后的 SDK 版本不支持新 Gemini 功能。
Gemini Omni Pro 预览:仍以 Ultra 为先
截至 9 月初,Gemini Omni Pro 尚无 GA 日期。8 月面向 AI Ultra 订阅者 与部分企业合作伙伴的预览仍在铺开。Pro 相较 Flash 提供最长 30 秒片段、1080p 输出、多角色原生音频及更强的角色一致性。
Pro 目前仅限消费者端。Pro 的 API 端点预计在 Flash GA 稳定后推出,可能在 2026 年底。
Gemini Live:9 月无新模型
Gemini 3.1 Flash Live(gemini-3.1-flash-live-preview)仍是 Live API 当前实时语音与视觉智能体模型。本窗口内无新 Live 模型发布。集成模式见我们的 Gemini 3.1 Flash Live API 指南。
9 月行动清单
- Omni 开发者:切换至
gemini-omni-1.1-flash,9 月 30 日前完成测试。 - 智能体/编码开发者:评估
gemini-3.8-flash;若延迟是首要约束,保留gemini-3.7-flash。 - 2.5 用户:10 月 16 日前规划迁移至 3.x;若尚未做,将模型 ID 抽象到配置层。
- 视频创作者:Omni 1.1 场景延展与 360p 草稿模式已向 Plus、Pro、Ultra 订阅者在 Flow 与 Gemini App 开放。
2026 秋季展望
Google 公开路线图仍指向 Omni Pro 更广铺开、Omni 家族的图像与音频输出模态,以及 Workspace 集成(Docs、Slides、Vids)。Flash 文本线可能在 Q4 继续保持快速发布节奏。