谷歌在 Alphabet 财报发布前推出三款 Gemini 新模型,分别瞄准低成本推理、高吞吐任务和网络安全场景。新版本已开始进入 API、开发工具、企业平台和部分面向普通用户的产品,显示谷歌正把 Flash 系列推向更大规模的实际部署。
3.6 Flash压低推理成本
这次更新的核心是 Gemini 3.6 Flash。谷歌称,该模型在编码、多模态处理和知识类任务上的表现较上一代提升,同时输出 token 消耗下降。按文中援引的数据,3.6 Flash 的输出 token 使用量较 3.5 Flash 低 17%,在部分编程测试中降幅更高。
价格方面,Gemini 3.6 Flash 的输入价格为每百万 token 1.50 美元,输出价格为每百万 token 7.50 美元,低于前代水平。对开发者而言,这意味着在相近任务下,模型调用成本有望进一步下降。
3.5 Flash-Lite主打高吞吐

另一款新模型 Gemini 3.5 Flash-Lite 更强调速度。按文中数据,它是 3.5 系列中输出速度最快的版本,输出速率可达每秒 350 个 token,更适合大规模搜索、文档处理和多代理协同等任务。
定价上,3.5 Flash-Lite 的输入价格为每百万 token 0.30 美元,输出价格为每百万 token 2.50 美元。文章称,它在多项测试中的表现明显好于上一代 3.1 Flash-Lite,在部分代理任务评测中甚至超过价格更高的同系列模型。
网络安全模型限制开放范围
第三款模型 Gemini 3.5 Flash Cyber 面向网络安全漏洞检测和修复。它基于 3.5 Flash 调整而来,部署在谷歌的代码安全代理 CodeMender 中,由多个代理协同生成漏洞报告。
这款模型并未全面开放。由于漏洞发现能力具有双重用途,谷歌把访问范围限制在政府机构和受信任合作伙伴,并通过有限试点方式提供。文章认为,这一安排意在让防御方更早发现并修补关键漏洞,同时降低被滥用的风险。
Gemini 4预训练已启动
除本次发布外,谷歌还披露,Gemini 3.5 Pro 正在与合作伙伴测试,准备在条件成熟后扩大可用范围。与此同时,Gemini 4 的预训练已经启动。
在竞争层面,文章提到中国模型厂商和 Anthropic 都在加快推进相关产品。谷歌此次同时推出多款细分模型,也反映出大模型竞争正从单一旗舰比拼,转向成本、速度、场景适配和安全控制的综合较量。