谷歌连发 Gemini 3.6 Flash、3.5 Flash-Lite 与安全专用模型,并启动 Gemini 4 预训练
摘要
谷歌正式发布 Gemini 3.6 Flash、3.5 Flash Lite 与网络安全专用模型,重点提升智能体任务效率、吞吐与成本控制。同时官方确认 Gemini 4 已启动大规模预训练,但尚未正式发布。
本文目录
谷歌在7月21日正式公布新一轮 Gemini模型更新,一次推出 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和面向网络安全场景的 Gemini 3.5 Flash Cyber。与社交平台流传的“Gemini 4已发布”不同,谷歌官方确认的进展是:Gemini 4已启动大规模预训练,但目前面向开发者和用户上线的核心仍是三款 Gemini 3.x系列模型。

图片来源:Google
这次更新的主线并不是单纯追求更大的参数规模,而是围绕智能体应用最现实的三个瓶颈展开:输出 Token成本、任务延迟以及复杂流程中的可靠性。谷歌希望通过不同定位的模型,让企业和开发者能根据工作负载,在质量、速度、价格与安全性之间做更细致的取舍。
Gemini 3.6 Flash:更少 Token完成更复杂任务
Gemini 3.6 Flash是此次更新中的主力通用模型,重点改善编码、知识工作、多模态理解和智能体任务效率。谷歌表示,与 Gemini 3.5 Flash相比,新模型在 Artificial Analysis Index中的输出 Token使用量降低约17%;在部分软件工程基准中,Token消耗降幅最高可达65%。
更少的输出并不意味着能力缩水。官方公布的测试显示,Gemini 3.6 Flash在代码修改、机器学习研究、计算机操作和知识型工作等任务上都有提升。它还减少了多步骤任务中的推理轮次和工具调用次数,这对需要长时间运行、反复调用外部工具的智能体系统尤其重要。

图片来源:Google
价格方面,Gemini 3.6 Flash的定价为每百万输入 Token 1.5美元、每百万输出 Token 7.5美元。谷歌将它定位为可承担大规模生产流量的“主力模型”,适合代码迁移、文档解析、图表分析、报告撰写以及多智能体协作等场景。
Gemini 3.5 Flash-Lite:面向高吞吐和低延迟
Gemini 3.5 Flash-Lite则进一步向速度和成本倾斜。根据谷歌引用的第三方测试数据,该模型可达到每秒约350个输出 Token,是 Gemini 3.5系列中速度最快的型号。
它的定价为每百万输入 Token 0.3美元、每百万输出 Token 2.5美元,主要面向搜索、文档处理、批量分类、自动摘要和高频智能体调用等大规模场景。开发者还可以通过不同的“思考等级”控制模型在延迟、成本和复杂推理之间的平衡:简单任务使用较低思考等级,复杂的子智能体流程则可以提高思考强度。
值得注意的是,Gemini 3.5 Flash-Lite也内置了计算机操作能力,可用于需要跨网页、应用界面和工具链执行任务的智能体系统。它并不是旗舰能力模型的缩小版,而是针对生产流量专门优化的高性价比型号。
Gemini 3.5 Flash Cyber:只向受信任机构开放
第三款模型 Gemini 3.5 Flash Cyber专门面向网络安全漏洞发现与修复。它建立在 Gemini 3.5 Flash基础上,并针对识别、验证和修补代码安全问题进行了定向训练。
谷歌将该模型与 CodeMender安全智能体结合使用,由多个安全代理并行分析代码,最终生成综合报告。由于网络安全模型具有明显的双重用途风险,Gemini 3.5 Flash Cyber不会像普通 API模型那样全面开放,而是计划通过有限试点,仅向政府机构和受信任合作伙伴提供。
这一部署策略也说明,谷歌正在把高风险专业模型与普通通用模型区分管理。能力更强并不意味着开放范围更广,特别是在漏洞利用、攻击自动化和关键基础设施安全等场景中,访问控制本身已经成为模型安全体系的一部分。
Gemini 4目前处于预训练阶段
本次官方公告中最受关注的一句话,是谷歌确认已经启动“迄今最具雄心的 Gemini 4预训练”。这意味着下一代基础模型已经进入训练阶段,但谷歌并未公布 Gemini 4的正式发布时间、模型规格或开放计划。
因此,将这次更新概括为“Gemini 4一夜三连发”并不准确。真正发布的是 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和 Gemini 3.5 Flash Cyber;Gemini 4仍属于下一代研发项目。对行业而言,这条信息的意义在于,谷歌已经开始推进下一轮基础模型竞争,但短期商业化重点仍然是让 Gemini 3.x在智能体、编码、高吞吐和安全场景中更容易部署。

图片来源:Google
已覆盖 Gemini App、API与企业平台
Gemini 3.6 Flash和 Gemini 3.5 Flash-Lite已通过 Gemini API、Google AI Studio和 Android Studio向开发者提供。Gemini 3.6 Flash还进入 Google Antigravity,企业用户可通过 Gemini Enterprise Agent Platform和 Gemini Enterprise使用;普通用户也可以在 Gemini应用中接触到相关模型,Flash-Lite则正在向 Google Search推出。
从这次发布可以看出,谷歌正把 Gemini产品线拆分得更加明确:3.6 Flash负责高质量通用智能体任务,3.5 Flash-Lite负责低成本高吞吐,3.5 Flash Cyber负责受控的专业安全场景,而 Gemini 4则承担下一代基础能力的长期升级。相比单一旗舰模型,这种分层策略更贴近企业真实部署需求,也可能成为未来大模型厂商竞争的主要方向。
同类栏目导航