DeepSeek今天(8月17日)零点正式启用峰谷定价,工作日白天高峰时段API调用价格直接翻倍,闲时价格砍半,V4 Pro高峰输出价从6元飙到了27元/百万tokens。
一、峰谷时段如何划分
高峰时段:北京时间每日 9:00 - 12:00、14:00 - 18:00,覆盖国内主要工作时间
空闲时段:除高峰外的所有时间(含凌晨、夜间、周末及法定节假日)
定价原则:空闲时段价格为高峰时段的一半,形成2倍价差
二、两大模型具体计费明细
DeepSeek-V4-Flash(轻量版)与 V4-Pro(旗舰版)均按“输入缓存命中”、“输入缓存未命中”、“输出”三项分别计价,单位均为元/百万tokens:
- 模型
- 计费项目
- 空闲时段价格
- 高峰时段价格
- V4-Flash输入(缓存命中)0.05元0.10元
- V4-Flash输入(缓存未命中)1.5元3.0元
- V4-Flash输出4.5元9.0元
- V4-Pro输入(缓存命中)0.15元0.30元
- V4-Pro输入(缓存未命中)4.5元9.0元
- V4-Pro输出13.5元27.0元
三、计费模式关键要点
双重价格杠杆:既区分峰谷时段,又区分缓存是否命中,鼓励开发者设计缓存策略以大幅降低成本
涨幅参考:以 V4-Pro 高峰输出为例,同口径下涨至原先 6元的4.5倍;缓存命中输入涨至0.025元的12倍,达 1100%
适用范围:仅针对 API 接口调用涨价,普通用户在网页、App 端免费使用不受影响
调用成本暴涨测算
标题:调用成本暴涨测算内容:- 典型案例:一位长期使用 DeepSeek API 的开发者反馈,日常账单约 15.8元/周(含 4 亿 tokens),若全部切换到高峰期按新价计费,年开支可能翻数倍乃至超 10 倍- 最坏情景:有开发者自行测算,若高峰期调用 V4-Pro 且缓存未命中,成本相较旧价最高可达 5 倍以上- 核心变量:实际涨幅取决于调用时段分布(全在高峰还是错峰)、缓存命中率(能否反复利用缓存)、模型选择(Flash 还是 Pro)
开发者错峰省钱指南
标题:开发者错峰省钱指南内容:- 基本原理:利用闲时半价窗口(9点前、12-14点、18点后及周末/节假日),将批量推理、代码仓库扫描、数据清洗等非实时任务后移至闲时执行- 关键技术: - 缓存优化:高频重复问答(如知识库检索、客服回复)做好上下文缓存,尽可能命中缓存,V4-Pro 缓存命中输入在闲时仅 0.15元/百万tokens,是输出价的 1/90 - 模型分层:简单任务优先选用 V4-Flash,仅在复杂推理或代码生成时才切至 V4-Pro - 自动调度:可借助任务编排框架,设定只在闲时队列运行非敏感批量请求
行业涨价潮来临
标题:行业涨价潮来临内容:- 多家跟涨:智谱 AI 年内已三次上调大模型接口费用,Kimi 输出价格涨近 4 倍,阿里云、腾讯云、百度智能云等也相继调价- 告别低价时代:DeepSeek 曾被称为“价格屠夫”,其 V2 版本将 API 价格降至输入 1元/百万tokens,引发全行业价格战。如今转向峰谷定价,标志着“烧钱换份额”阶段的彻底终结- 核心原因:Agent 爆发导致单日 Token 消耗突破 8 万亿,HBM、高端 GPU 成本持续走高,低价模式下调用量越大亏损越严重
定价背后的算力逻辑
标题:定价背后的算力逻辑内容:- 类比电价:峰谷定价模式将 AI 算力类比为电力——白天需求密集时段抬高价格以抑制拥堵,夜间/空闲时段降价吸引批量任务分流,本质是“用价格杠杆平衡供需”- 应对资源瓶颈:并非简单涨价,而是通过市场化手段缓解高峰期排队、超时、限流等问题,提升整体服务稳定性- 行业方向:后续其他国产大模型大概率会跟进弹性定价,算力按需分层、时分复用将成为基础设施级的能力

