谷歌连发三款Gemini模型 主打智能体场景

导语

2026年7月21日,谷歌一次性发布了三款全新的 Gemini 模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,以及一款面向安全场景、受限开放的 Gemini 3.5 Flash Cyber。这不是一次常规的版本迭代,而是一次明确的转向:谷歌把发布会舞台让给了”更快、更便宜、更适合智能体”的模型,用价格和效率取代参数规模,成为新的竞争语言。

三款新模型各司其职

Gemini 3.6 Flash 是这次发布的主角,它将成为 Gemini 家族新的默认”主力工作模型”,全面取代 3.5 Flash。从发布当天起,3.6 Flash 即在 Google AI Studio、Gemini API、Gemini App、Android Studio、Antigravity 以及 Gemini 企业级智能体平台上线。

性能与价格方面,谷歌给出的数字颇为激进:3.6 Flash 输入价格为每百万 token 1.50 美元,输出价格为每百万 token 7.50 美元——输出价格低于 3.5 Flash 此前的 9.00 美元,同时在 Artificial Analysis Index 上消耗的输出 token 数量减少约 17%。模型保留了 100 万 token 的上下文窗口,知识截止日期推进到 2026 年 3 月。在谷歌公布的基准测试中,3.6 Flash 在代码与”电脑使用”任务上有明显进步,其中 DeepSWE 基准得分从 37% 提升至 49%。

同场发布的 Gemini 3.5 Flash-Lite 则面向对延迟和成本更敏感的场景,而 Gemini 3.5 Flash Cyber 被明确限定在安全领域的使用场景,采取受限准入。

值得注意的”缺席者”

这次发布中缺席的是 Gemini 3.5 Pro——谷歌表示,旗舰层级仍在合作伙伴测试阶段,距离全面开放还有一段距离。谷歌选择先发布更便宜、更快的层级,这折射出整个行业的共识转移:2026 年下半年,大模型竞争的焦点已从”谁的基准分更高”,转向”每完成一个任务的成本是多少、生产环境是否稳定”。

为什么这次发布值得关注

对于开发者和企业采购方来说,3.6 Flash 的发布意味着构建生产级 AI 智能体的门槛进一步降低。智能体工作流对 token 消耗极大——一个复杂任务可能需要数十轮模型调用——输出 token 减少 17% 叠加更低的单价,直接转化为可观的成本节省。而保留百万级上下文,则让模型能够”记住”更长的任务历史,这对多步骤智能体至关重要。

展望:效率竞赛才刚刚开始

谷歌这次的动作与行业趋势高度一致:OpenAI、Anthropic 同期都在压缩推理成本、优化智能体场景的可靠性。可以预见,接下来几个月,头部厂商将在”每美元能做多少事”这条赛道上展开更激烈的较量,而 3.5 Pro 最终发布时的定价与表现,将决定谷歌在这场效率竞赛中的上限。

发表评论