GEO资讯

谷歌连发三款轻量模型,Agent运行成本再降

发布于 2026/8/7 71 次阅读
谷歌连发三款轻量模型,Agent运行成本再降

谷歌连发三款轻量模型,Agent运行成本再降

7月21日,谷歌DeepMind一口气发布三款Gemini Flash系列轻量模型:Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。官方给出的发布理由很直接——面向生产环境构建AI智能体的开发者和企业,需要更高的Token使用效率、更低的延迟和更稳定的性能,Flash系列就是围绕"效率与质量的平衡"设计的。整场发布没有带来外界期待的旗舰版Gemini 3.5 Pro,后者仍在内部测试,这成了当天最大的悬念。

三款模型各管一摊

Gemini 3.6 Flash是本次的主力模型,定位通用生产任务。按官方数据,它在Artificial Analysis Index上的输出Token消耗比3.5 Flash低17%,完成多步任务所需的推理步骤和工具调用次数也更少。基准成绩方面,DeepSWE(软件工程智能体)测试得分49%,明显高于3.5 Flash的37%;MLE Bench(机器学习研究)63.9%,高于49.7%;OSWorld-Verified(电脑操作)83%,高于78.4%;知识工作基准GDPval-AA v2得分1421,高于3.5 Flash的1349。定价为输入每百万Token 1.5美元、输出7.5美元,低于3.5 Flash。早期客户包括法律AI公司Harvey和金融研究平台Hebbia,前者反馈在资本市场与企业并购领域的文档起草和审查任务上,平均完成速度提高了12%。谷歌还强调,3.6 Flash配备了涵盖化学、生物、放射性与核风险及网络攻击的前沿安全防护,并经过专项训练抵御越狱攻击,同时减少对正常请求的误拒。

Gemini 3.5 Flash-Lite是三款里最快最便宜的:每百万Token输入0.3美元、输出2.5美元,输出速度约每秒350个Token,主打高吞吐的数据处理类工作流,官方称它正在逐步接入Google搜索。Gemini 3.5 Flash Cyber则是一条专门路线——在3.5 Flash基础上针对网络安全漏洞的发现与修复做微调,配合谷歌的代码安全智能体CodeMender使用,在CyberGym基准上达到前沿水平。考虑到安全工具的双重用途风险,谷歌把它的开放范围限定在政府和受信合作伙伴,采取限量试点,让一线防御者优先用它发现和修补关键漏洞。

接入渠道已经铺开

发布当天,三款模型的接入路径就基本明确了。开发者可以通过Google AI Studio和Android Studio调用Gemini API,3.6 Flash同时登陆谷歌的Antigravity开发环境;企业用户通过Gemini Enterprise Agent Platform使用,普通用户可以在Gemini应用中体验,3.5 Flash-Lite则正在逐步接入Google搜索。覆盖了开发者、企业和终端用户三个层级,说明谷歌这次不是发几款模型了事,而是要把Flash系列直接铺进搜索、应用和智能体工作流。对已经基于Gemini API构建应用的团队,3.6 Flash可以平滑升级,官方称其内置了电脑操作(computer use)能力,智能体可以直接调用浏览器级别的操作。

效率叙事下的行业信号

这次发布有几个值得行业注意的信号。一是"成本叙事"取代了"参数竞赛"。三款模型全部强调单位任务成本下降,说明头部厂商默认了这样一个现实:智能体要规模化跑起来,Token账单必须降下来。二是Flash-Lite直接进Google搜索,意味着搜索引擎的AI生成环节也在追求更低成本和更高吞吐,这会影响AI概览类产品的覆盖范围,进而影响AI引用内容的流量去向。三是旗舰Pro缺席:彭博社此前报道,谷歌因内部性能指标未达标而推迟了3.5 Pro的发布;谷歌同时透露已启动迄今规模最大的Gemini 4预训练。与对手对比,OpenAI已发布GPT-5.5并开始推出GPT-5.6,Anthropic接连推出Opus 4.8、Sonnet 5和Opus 5,头部厂商的发布节奏差异,恰恰说明模型迭代正在从"按时发布"转向"达标才发"。

对企业而言,模型轻量化带来的直接红利是Agent类应用的试错成本下降。对GEO行业来说,Flash系列进搜索、进智能体工作流,提示了一个趋势:AI答案的生成成本越低,企业被AI提及的频次就会越高,品牌信息在AI回答中的准确度与可验证性,会越来越像一项需要专门经营的基础资产。

本文事实来自谷歌官方博客及腾讯云开发者社区、腾讯新闻7月22日相关报道,基准数据均以官方口径为准。

信息来源

  • 谷歌官方博客:《Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber》,2026年7月21日,blog.google
  • 腾讯云开发者社区:《谷歌推出三款新版Gemini Flash模型,并发布代码安全智能体CodeMender》,2026年7月,cloud.tencent.com
  • 腾讯新闻:《谷歌发布三款新Gemini模型,Pro旗舰版仍缺席》,2026年7月22日,new.qq.com