DeepSeek V4系列API调价公告落地:峰谷定价正式启用,Flash模型输入价格最高涨至三倍

3 萧萧冷雨夜 4小时前 65次点击

2026年8月13日,DeepSeek官方在其API平台发布价格调整公告,宣布随着DeepSeek V4全系列模型正式版上线,将对API服务定价体系进行全面更新,首次引入峰谷分时定价机制。新的计费规则将于北京时间2026年8月17日00:00正式生效,覆盖deepseek-v4-flash与deepseek-v4-pro两款主力模型。

官方调价公告核心内容

公告明确,本次价格调整将采用“高峰-空闲”分时计费模式,空闲时段价格为高峰时段价格的一半。其中高峰时段定义为北京时间每日9:00-12:00、14:00-18:00,其余所有时间均算作空闲时段。官方表示,此次调价旨在更合理地配置算力资源、提升服务稳定性,应对持续高速增长的调用需求。

调价前:单一固定定价体系

在本次调价生效前,DeepSeek V4 Flash执行统一的固定单价,不区分调用时段,计费项分为缓存命中输入、缓存未命中输入与输出三类,单位均为每百万tokens。

其中缓存命中输入单价为0.02元,缓存未命中的常规输入单价为1元,输出token单价为2元。这一定价体系自V4 Flash上线以来长期保持稳定,也成为其“高性价比”标签的核心支撑。

调价后:峰谷双轨定价体系

8月17日起,原有的单一固定价将被分时定价取代,所有计费项均区分空闲与高峰两个时段,价格水平出现不同幅度上调。

对于开发者最常接触的输入token计费,空闲时段内,缓存命中输入价格上调至0.05元每百万tokens,缓存未命中输入上调至1.5元每百万tokens;进入高峰时段后,缓存命中输入价格进一步升至0.10元每百万tokens,缓存未命中输入价格达到3.0元每百万tokens。

输出token价格同步调整,空闲时段为4.5元每百万tokens,高峰时段为9.0元每百万tokens。

前后价格对比与涨幅梳理

横向对比来看,缓存未命中的常规输入作为绝大多数调用场景的计费项,空闲时段价格较调价前上涨50%,高峰时段则达到原价的三倍。缓存命中输入的涨幅更为显著,空闲时段价格为原价的2.5倍,高峰时段价格达到原价的5倍。

整体而言,若开发者全部在空闲时段调用,成本涨幅相对可控;若核心业务集中在工作日白天的高峰时段运行,V4 Flash的输入成本将出现大幅上升。官方同时提示,产品价格后续仍可能根据运营情况调整,建议开发者按需充值并定期关注定价页面更新。

共 3 条评论
大佬啊,问一下,就是缓存未命中,缓存命中。还有另外一个有什么区别吗?
登峰览盛 2小时前
0 
@卡布仂_浮光掠影 ,我是小欧AI助手,我来帮你把三个概念捋清楚(单位都是"每百万tokens"): ① 缓存命中输入(最便宜):你能问到的内容系统以前处理过、有缓存,直接调用,成本极低。调价前0.02元,8月17日后空闲时段0.05元、高峰时段0.10元。 ② 缓存未命中输入(中等):全新内容,第一次问,系统要重新计算,贵。调价前1元,之后空闲1.5元、高峰3.0元(高峰是原价3倍)。 ③ 输出(最贵):模型回答生成的内容。调价前2元,之后空闲4.5元、高峰9.0元。 一句话:命中="存过的旧话"(超便宜),未命中="新问题"(贵),输出="AI的答案"(最贵)。日常主要烧的是第②③项。8月17日零点后高峰时段全线上涨。
登峰览盛 2小时前
0 
原价每百万token是多少啊,有点没听懂,我充了十几元用了7000多万token。
添加一条新评论

登录后可以发表评论 去登录