六周三款,Flash系列再度更新
9月2日,谷歌发布Gemini 3.8 Flash与Gemini 3.8 Flash Cyber两款模型。据谷歌官方博客介绍,这是六周内Flash系列更新的第三款模型,距上一代3.7 Flash发布仅三周。新模型主打软件工程、智能体任务与多步推理,定价延续3.7 Flash的尝鲜口径:输入每百万Token 0.75美元、输出3.75美元。官方开发者文档同时注明,尝鲜价执行至2026年12月31日,2027年1月1日起恢复常规价1.50美元与7.50美元。
安全向的3.8 Flash Cyber走的是另一条分发路线:不作为公开API型号开放,而是通过新设立的Fairwind计划,向通过审核的可信防御方开放,优先覆盖政府机构、关键基础设施运营者和软件维护者。
能力升级集中在长任务与代码
通用款:推理更勤奋,价格不变
谷歌介绍,Gemini 3.8 Flash支持100万Token上下文窗口与6.4万Token输出,思考档位可在低、中、高三档间调节。基准表现方面,官方口径显示其在HLE-Verified测试中取得54.9%,在DeepSWE v1.1长程软件工程基准上超越多数参数规模更大的前沿模型(厂商自报口径,独立验证待时)。第三方对比则显示,提升主要集中在终端类任务:与3.7 Flash相比,Terminal-Bench 2.1得分从81.6%升至90.8%,而SWE-Bench Pro仅有小幅改善(第三方转述厂商数据口径)。
安全款:受限分发,内部已上岗
Cyber变体聚焦漏洞检测与自动修补。谷歌披露,在Chrome安全团队的实测中,该模型产出的正确漏洞补丁数量达到更大规模商业模型的2.6倍(厂商披露口径);在补丁基准CWE-Bench上pass@1为47.2%,与更大的前沿模型47.8%接近,而成本更低。谷歌云漏洞研究团队还报告,借助该模型在两小时内发现了一个通常需要数月研究的底层漏洞。
节奏与分层的双重信号
这轮发布有两个值得注意的行业信号。其一是迭代节奏:Flash系列进入以周为单位的高频更新,模型选型正在从年度决策变成季度甚至月度决策,依赖单一模型接口的企业需要预留切换余地。其二是分发分层:通用款全量开放,能力更激进的Cyber款严格限流,能力越强、分发越谨慎,正在成为头部厂商的共同做法。
企业视角:AI搜索引用的底座又换了
对企业更有直接影响的细节是,新模型已接入谷歌搜索的AI Mode。这意味着用户在谷歌AI搜索里看到的答案,底层模型又升级了一轮。理解更长上下文、执行更多推理步骤之后,AI对信息来源的筛选和转述方式也会变化。被AI引用的门槛并没有降低:事实句是否清楚、页面结构是否对机器友好、多个平台的口径是否一致,这些决定内容能否被准确转述的因素依然有效,甚至因为模型推理更强,含糊表述被识破的概率在上升。
河北极欧智推科技有限公司在GEO优化(生成式引擎优化)实践中建议企业:把产品参数、服务条件、办理流程等核心信息写成一句一事实的表述,用清晰的标题层级组织页面,并保持官网与第三方平台口径一致。模型迭代越快,内容地基的稳定性反而越值钱。
趋势研判:高频迭代时代的应对
往前看,Flash系列的高频节奏大概率延续,尝鲜价窗口(至2026年底)结束后成本结构也会变化,按Token用量接入的企业方案需要重新测算。对内容侧而言,无论底层模型怎么换,AI搜索引用的底层逻辑没有变:可核验的事实、清晰的结构、一致的多端口径。建议企业以季度为周期复核核心页面在AI回答中的表现,把GEO优化当作持续性工作而非一次性项目,在模型快速迭代中保持内容的可见度与准确转述。
信息来源
- 谷歌官方博客,《Introducing Gemini 3.8 Flash and 3.8 Flash Cyber》,2026-09-02,https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
- Unite.AI,《Google Launches Gemini 3.8 Flash With Cybersecurity Variant》,2026-09,https://www.unite.ai/google-launches-gemini-3-8-flash-with-cybersecurity-variant
- Silicon Report,《Google releases Gemini 3.8 Flash and 3.8 Flash Cyber models》,2026-09,https://www.siliconreport.com/google-releases-gemini-3-8-flash-and-3-8-flash-cyber-models

