谷歌这次上线了三款 Gemini 新模型,更新重点放在调用成本、响应速度和代理型 AI 场景。不过,外界原本更关注的 Gemini 3.5 Pro 仍未发布,产品节奏出现延后。
3.5 Pro继续留在测试阶段
谷歌在今年 5 月的 I/O 2026 大会上曾表示,Gemini 3.5 Pro 将在一个月内推出。但据报道,该模型在内部测试中未达到目标,尤其是在编程任务上的表现不及预期,因此没有按时上线。
彭博此前称,谷歌曾在 6 月底尝试通过更新训练数据修正问题,但结果并不理想。谷歌目前仅表示,Gemini 3.5 Pro 会在“准备好后”发布。
3.6 Flash下调价格并提升效率
这次发布的核心版本是 Gemini 3.6 Flash,定位仍是面向 AI 代理和高频调用场景的轻量模型。与 Gemini 3.5 Flash 相比,该模型输出 token 使用量减少约 17%,输出价格也从每百万 token 9 美元降至 7.5 美元。
公开基准测试显示,Gemini 3.6 Flash 在多项任务上较前代提升明显,包括软件工程、机器学习工程和计算机操作任务。其中,DeepSWE v1.1 得分从 37% 升至 49%,MLE-Bench 从 49.7% 升至 63.9%,OSWorld-Verified 达到 83.0%。
不过,在部分编程和知识工作测试中,OpenAI 与 Anthropic 的同类模型仍然领先。报道还提到,Gemini 3.6 Flash 在简单编程实测中仍出现格式错误和结果不可直接使用的问题。
Flash-Lite与Cyber面向不同场景
Gemini 3.5 Flash-Lite 更强调高吞吐量和低成本,适合文档处理、搜索系统和批量工作流。该模型输出速度可达每秒 350 个 token,输入价格为每百万 token 0.3 美元,输出价格为 2.5 美元。
另一款 Gemini 3.5 Flash Cyber 不会向公众开放。谷歌将其限制给政府机构和经过审核的合作方,用于发现和修复软件漏洞。
Gemini 4已启动预训练
谷歌同时确认,Gemini 4 的预训练已经开始。预训练是模型大规模学习基础数据的阶段,这意味着 Gemini 4 已进入实际研发流程,而不只是停留在规划阶段。
目前,Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 已在 Gemini 应用、Google AI Studio 和 API 中上线。
