Google DeepMind 周二发布三款 Gemini 新模型,更新重点放在更低成本、更快响应和更稳定的服务能力,面向正在大规模部署 AI 代理的企业客户。外界关注的 Gemini 3.5 Pro 这次仍未一同推出。

3.6 Flash主打降本

Gemini 3.6 Flash 被谷歌定位为通用主力模型。公司称,这一版本在编程、知识类任务和多模态表现上有所提升,同时可将 token 使用量最多降低 17%,因此价格也低于上一代 3.5 Flash。

Gemini 3.5 Flash-Lite 则强调成本优势。按谷歌说法,这是一款更适合价格敏感场景的轻量版本,重点仍是效率和部署速度。

安全模型限量开放

Gemini 3.5 Flash Cyber 是此次更新中的专用版本,主要面向网络安全任务。该模型经过定向微调,用于发现并修复安全漏洞,当前仅通过有限试点向政府机构和受信任合作伙伴开放。

从产品定位看,Flash 系列继续承担低成本、低延迟的生产任务,适合大规模调用;Pro 系列通常负责更复杂的推理和编程任务,因此发布时间更受市场关注。

3.5 Pro继续缺席

这次发布最受关注的空白,是 Gemini 3.5 Pro 仍未上线。谷歌上一次更新 Gemini Pro 还是在 2 月,随后曾在 5 月表示,3.5 Pro 已在内部使用,并计划于次月推出。

不过,彭博此前报道称,谷歌在推进 3.5 Pro 发布时出现内部延迟,原因是模型表现尚未达到内部目标。与此同时,OpenAI 已推出 GPT-5.5,并开始逐步上线 GPT-5.6;Anthropic 也发布了 Claude Opus 4.8、Claude Sonnet 5,并扩大了 Fable 5 的开放范围。

Google DeepMind 产品负责人 Logan Kilpatrick 周二表示,公司目前正与合作伙伴测试 Gemini 3.5 Pro,希望很快落地。他还称,团队已经启动 Gemini 4 迄今规模最大的一次预训练。