GEO资讯

DeepSeek宣布涨价,Agent成本拐点将至

发布于 2026/8/7 93 次阅读
DeepSeek宣布涨价,Agent成本拐点将至

DeepSeek宣布涨价,Agent成本拐点将至

8月6日,DeepSeek在开发者平台发布公告:计划近期整体上调API服务定价,预计涨幅较大,具体方案以正式通知为准。这是这家以低价策略搅动全球大模型市场的公司,首次就"涨价"公开表态。消息发布时,正值其V4-Flash正式版上线、调用量快速攀升。

先理清这轮价格调整的时间线

7月31日,DeepSeek-V4-Flash正式版(模型号DeepSeek-V4-Flash-0731)上线公测。官方说明显示,它的模型结构、尺寸与预览版一致,总参数2840亿、激活参数130亿、100万Token上下文,这次升级只重新做了后训练,但Agent能力大幅增强,并加入推测解码模块,在Terminal Bench、CyberGym等智能体与代码基准上较预览版明显提升。

调用量随后快速放大。海外开发者平台OpenCode披露,8月1日当天,V4-Flash在其平台单日处理Token总量达8万亿,其中5万亿来自免费试用额度,3万亿来自付费调用。OpenRouter在8月上旬的榜单也显示,V4-Flash预览版登顶过去一周全球模型调用量榜首,正式版同样进入前列。

在此背景下,8月6日的涨价公告被业内解读为一个转折点。目前V4-Flash输入(缓存未命中)1元/百万Token、输出2元/百万Token,V4-Pro输入3元、输出6元;6月底引入的峰谷计费(工作日9时至12时、14时至18时为平时价两倍)仍在执行,本次"整体上调"指向的是全口径定价。

涨价背后:Agent正在改写成本结构

官方公告没有解释原因,但行业背景是清晰的:智能体应用越来越多,单项任务消耗的Token量远高于传统聊天场景。一个需要多次工具调用、多轮推理的Agent任务,成本是普通对话的数十倍。模型厂商要在"低价抢量"和"推理资源可持续"之间重新找平衡。

对企业来说,这不是DeepSeek一家的事。当价格锚点的厂商开始涨价,其他模型厂商的定价策略也会随之调整。依赖低价API跑量的产品——尤其是Agent类、长任务类应用——成本测算需要重做。

另一个值得注意的细节是,据中国经济网报道,V4-Flash正式版是目前DeepSeek唯一支持Responses API并可接入Codex的V4模型,说明它在开发者工具链里的位置已经不只是"便宜",而是逐步成为编程与智能体工作流的默认入口之一。这样的角色越重要,它的价格变化对下游应用的传导就越直接。

几点务实的应对

  • 提高缓存命中率:DeepSeek缓存命中输入仅0.02至0.025元/百万Token,把高频提示词、固定上下文做成复用结构,能显著摊薄成本。
  • 利用峰谷价差:非实时任务尽量调度到低谷时段,规避两倍价格窗口。
  • 保留多模型备选:同一任务在DeepSeek、国产开源模型与海外模型之间做比价和效果对照,避免单一依赖。
  • 把Token成本纳入产品设计:对按量计费的产品,先算清单任务成本再定价,别等账单出来再补救。

从更大的视角看,这轮涨价公告也提示了一个趋势:AI能力正在从"按订阅付费"走向"按消耗计费",企业的AI预算模型和ROI测算方式都需要跟着调整。对做AI获客布局的企业,把预算同时投在模型调用与品牌可见性建设上,比单纯堆算力更抗波动。

可以做一个粗略的测算:一个典型的智能体任务若消耗约50万Token(含多轮推理与工具调用),按V4-Flash输出价计算约合1元出头;如果跑量到日均百万次任务,单日推理成本就在百万元量级。这解释了为什么官方涨价公告一出,业内普遍认为"低价补贴阶段"正在收尾。对企业而言,与其纠结单次调用涨了几分钱,不如把成本结构看成一个整体:提示词复用、缓存设计、任务分级(简单任务用轻量模型、复杂任务才上旗舰)带来的节省,通常远大于价格本身的波动。

信息来源