谷歌跳过旗舰版:三款新的 Gemini Flash 模型主打速度、成本和网络安全

新闻摘要
2026年7月21日(太平洋时间),谷歌为其Gemini AI模型家族推出了三款新成员,扩展了其产品线,提供了更快、更具成本效益的选项,而非备受期待的Gemini 3.5 Pro旗舰模型。此次发布反映了行业向优化AI模型以适应大规模代理工作负载的更广泛转变,在这种工作负载中,速度、可靠性和每次查询的成本与原始推理能力同等重要。
发布内容
三款新模型分别是Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber。谷歌将此次发布定位为提高开发者大规模构建AI代理的效率,而不是在标杆性能上取得飞跃。此次公告于2026年7月21日(太平洋时间)发布,技术细节通过谷歌开发者博客发布,并 shortly 后与媒体分享。
Gemini 3.6 Flash:新的主力模型
谷歌将其描述为主力模型,Gemini 3.6 Flash在编码辅助、知识密集型任务以及跨文本、图像和其他数据类型的多模态理解方面带来了改进。谷歌表示,与前代Gemini 3.5 Flash相比,该模型将token使用量减少了高达17%,这转化为运行高流量应用程序的开发者的运营成本降低。
Gemini 3.5 Flash-Lite:专为成本敏感型代理而设计
Gemini 3.5 Flash-Lite squarely 定位为需要以最低成本运行大量轻量级、自主AI代理任务的开发者。谷歌为该模型设定的价格为每百万输入token 0.30美元,每百万输出token 2.50美元,使其成为当前Gemini产品线中最经济实惠的选项。该公司建议此级别非常适合诸如简单分类、检索和高频自动化等任务。
Gemini 3.5 Flash Cyber:专注于安全研究
第三款模型Gemini 3.5 Flash Cyber经过专门微调,用于识别和帮助修复软件漏洞。谷歌表示,其网络安全分析成本仅为大型通用模型的一小部分。目前,该模型的访问权限仅限于涉及政府机构和精选受信任合作伙伴的试点计划,这反映了安全研究用例的敏感性。
为什么没有Gemini 3.5 Pro
尽管普遍预期,谷歌并未与这三款模型一同发布更新的Pro级别旗舰模型。相反,该公司确认已启动其“迄今为止最雄心勃勃的预训练运行”,这被广泛理解为正在为未来的Gemini 4模型奠定基础。行业观察人士认为,这表明谷歌正在优先考虑其Flash级别的渐进式效率改进,同时将其下一代前沿模型投入更长的开发周期。
行业背景
此次公告正值各大AI实验室之间竞争日益激烈之际,它们都在努力提供针对实际、注重成本的部署而优化的模型,而不仅仅是追求顶级的标杆分数。通过强调更低的token消耗、有竞争力的定价以及网络安全分析等专业能力,谷歌似乎正在瞄准那些在生产环境中扩展代理AI系统的企业开发者。分析人士指出,这种方法与其他AI公司采取的类似举措相似,即通过分层模型家族来平衡不同类别应用程序的能力、延迟和成本。
下一步是什么
谷歌尚未提供Gemini 3.5 Pro或Gemini 4发布的具体时间表,尽管确认正在进行大规模预训练运行表明对前沿模型开发持续投资。目前,基于Gemini平台进行开发的开发者将获得三个新选项,谷歌表示这些选项已针对大规模运行AI代理和安全工具的实际需求进行了优化。