GEO资讯

谷歌发布Gemini 3.7 Flash,编程更强价格减半

发布于 2026/8/13 52 次阅读
谷歌发布Gemini 3.7 Flash,编程更强价格减半

谷歌发布 Gemini 3.7 Flash,编程更强价格减半

当地时间 8 月 13 日,谷歌宣布推出 Gemini 3.7 Flash,定位"最智能的工作型模型",主打编程、智能体(Agent)和复杂工作流。这是谷歌近期推出的第四款 Flash 系列模型,距离上一代 3.6 Flash 发布仅三周,迭代节奏明显加快。

一、这次升级了什么

据谷歌官方博客发布的信息,3.7 Flash 的改进集中在软件工程、知识工作和网页开发三类场景。在编程上,模型在 FrontierCode 1.1 Main 测试得分从 3.6 Flash 的 34.4% 提升到 43.6%,在 DeepSWE v1.1(真实软件工程任务)上从 49.0% 提升到 65.3%;在网页开发能力评估 WebDev Arena 中,Elo 评分从 1538 升到 1588。对知识密集型行业,如金融、法律、生物科学,模型处理复杂文档的能力也有明显增强,官方公布的 GDP.pdf 基准测试得分从 22.0% 提升到 34.0%。

值得注意的还有一点:官方用 AutomationBench 评估了模型完成真实业务流程的能力,得分从 17.0% 提升到 30.4%。这意味着 3.7 Flash 不只是"会聊天、会写代码",而是更接近"能干活"的工作模型,能够执行多步骤任务并调用工具。

二、价格直接砍半

此次发布把价格作为重要卖点。到今年年底前,Gemini 3.7 Flash 的引导价格为每百万输入 Token 0.75 美元、每百万输出 Token 3.75 美元,均为 Gemini 3.6 Flash 原价的一半。据 DeepMind 官方页面说明,2027 年 1 月 1 日起价格将恢复为 1.50 美元和 7.50 美元。与此同时,新模型已经接入 Gemini Spark(面向 AI Pro 和 Ultra 订阅用户)以及 Gemini API、Antigravity、AI Studio 等开发平台。

对做 AI 应用的企业来说,这轮降价的直接含义是:同等算力需求下的 API 调用成本显著下降,尤其是输出 Token 较多的场景(比如长文档生成、代码生成、多轮智能体任务),成本压力会小很多。

三、密集迭代说明了什么

谷歌官方表示,3.7 Flash 是"直接回应开发者反馈和算法创新"的产物。7 月 21 日,谷歌曾一次性推出 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三个版本,均瞄准智能体和开发者工作流;不到一个月,Flash 家族再次更新。这种节奏在行业内并不多见,背后是模型能力迭代加速和竞争加剧的双重推动。

对企业的启示有两个层面。一是模型选择变多了,同一类任务可能有多个档位、多种价格的模型可用,选型时需要按场景评估而不是"追最新";二是头部厂商把"低价高能"作为竞争手段,企业 AI 应用的算力成本长期看是下行趋势,这为中小企业的 AI 落地留出了空间。谷歌这次在 Flash 系列上快速迭代、压低价格,与旗舰模型发布节奏的不确定性形成对照,市场也在观察这种策略能否持续转化为开发者生态的领先。

四、给企业的三个提醒

  • 先算成本账再迁移:新模型性能提升明显,但引导价有时效,正式定价可能翻倍,长期方案要按恢复价测算。
  • 按场景选档位:轻量任务用 Flash 档,重推理任务再考虑旗舰档,避免为用不上的能力付钱。
  • 保持跟进但不过度依赖:模型每季度都在变,企业内容和技术方案要注意兼容性,别把架构绑死在单一模型上。

生成式 AI 的成本曲线正在快速下移,这对所有准备把 AI 用进业务流程的企业都是利好。需要提醒的是,模型能力提升和价格下降并不自动等于业务效果好——同样的模型,用在内容生产、客服、数据分析等不同场景,投入产出差异很大。建议企业先拿真实业务场景做小范围测试,验证质量和稳定性后再规模化使用,把省下来的成本转化为实际的业务改进,而不是单纯追求调用量的增加。关键是跟上变化的同时,把预算花在真正能带来业务结果的地方。

信息来源

  • Google 官方博客《Introducing Gemini 3.7 Flash》,2026-08-13,访问链接
  • DeepMind 官方博客《Introducing Gemini 3.7 Flash》,2026-08-13,访问链接
  • 新浪财经(转网易科技)《谷歌密集上新 Gemini Flash:编程能力提升、价格腰斩》,2026-08-14,访问链接