Gemini 3.5 Pro继续跳票,谷歌端上三款Flash模型强行交作业
没有给大家带来心心念念的 Gemini 3.5 Pro,谷歌今天一股脑地发了三款 Flash 轻量级模型。

没有意外,谷歌的这一操作遭到了网友毫不留情地吐槽:

令人难绷的是,Gemini 3.6 Flash 的智能水平并未超过 Gemini 3.5 Flash。

在官方博客中,谷歌表示,「面向生产环境构建 AI 智能体的开发者和企业,需要更高的 Token 使用效率、更低的延迟,以及更加稳定可靠的性能。Flash 系列正是围绕效率与质量之间的平衡点打造,帮助智能体工作流实现规模化运行。」因此在 Gemini 3.5 Flash 的基础上,推出了这样三款新模型:
Gemini 3.6 Flash :面向主力生产任务的通用模型,在编程、知识工作和多模态任务上的表现进一步提升。
Gemini 3.5 Flash-Lite :Gemini 3.5 系列中速度最快、成本最低的模型。
CodeMender 中的 Gemini 3.5 Flash Cyber :高水平网络安全应用,需要模型与智能体基础设施进行精细协同。
目前,Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 即日起开放使用。开发者可通过 Google AI Studio 和 Android Studio 调用 Gemini API。Gemini 3.6 Flash 同时已登陆 Google Antigravity。企业用户可通过 Gemini Enterprise Agent Platform 使用。普通用户可通过 Gemini 应用体验,Gemini 3.5 Flash-Lite 也正在逐步接入 Google 搜索。
此外, 谷歌还透露了 Gemini 3.5 Pro 的进度消息,称其正在与合作伙伴开展测试,待准备充分后将尽快面向更多用户开放 。与此同时, 谷歌已经开始推进下一代模型 Gemini 4,并启动了迄今规模最大、目标最具挑战性的预训练任务 。
先不管谷歌「画的大饼」什么时候能吃上,我们先来一一看此次发布的三款模型。
Gemini 3.6 Flash
效率和性能全面超过 Gemini 3.5 Flash
Gemini 3.6 Flash 直接吸收了开发者和客户在使用 Gemini 3.5 Flash 过程中提出的反馈,在编程和知识工作能力上进一步提升,同时显著改善了 Token 使用效率。
例如,在 Artificial Analysis Index 测试中,Gemini 3.6 Flash 的输出 Token 消耗较 Gemini 3.5 Flash 减少 17%。执行多步骤工作流时,它所需的推理步骤和工具调用次数也更少。
效率提升的同时,Gemini 3.6 Flash 的价格也低于 Gemini 3.5 Flash。其输入价格为每 100 万 Token 1.50 美元,输出价格为每 100 万 Token 7.50 美元,可以进一步降低单次智能体任务的总体成本,让智能体的开发和运行更具经济性。
在提高效率的同时,Gemini 3.6 Flash 在多类任务上的表现也超过 Gemini 3.5 Flash:
在 DeepSWE 测试中,Gemini 3.6 Flash 的得分由 37% 提升至 49%,能够以更高精度完成任务,减少非必要的代码修改和重复执行。在衡量机器学习研究能力的 MLE Bench 中,其成绩由 49.7% 提升至 63.9%。
计算机操作能力进一步增强,在 OSWorld-Verified 上的成绩由 78.4% 提升至 83.0%。目前,计算机操作已作为内置客户端工具接入 Gemini API 和 Gemini Enterprise。
在知识工作领域,Gemini 3.6 Flash 同样取得提升,GDPval-AA v2 得分由 1349 提高到 1421。Hebbia、Harvey 等客户发现,该模型尤其擅长文档解析、图表与数据分析、报告撰写等多模态任务。