DeepSeek于2026年8月17日零时正式上调API价格,旗舰模型V4-Pro高峰时段输出价从每百万tokens 6元涨至27元,涨幅350%,缓存命中输入最高涨幅达1100%,同步引入峰谷分级计价机制。[1][2]
DeepSeek官方公众号于8月13日发布价格调整公告,宣布新价格于北京时间2026年8月17日00:00起正式生效,采用峰谷分级计价:高峰时段为每日9:00-12:00、14:00-18:00,共7小时;其余17小时为空闲时段,价格为高峰时段的一半。[3][7]
此次调价覆盖DeepSeek-V4-Pro与DeepSeek-V4-Flash两款模型。其中V4-Pro是8月12日晚发布的旗舰正式版(0813版本),支持100万上下文,Agent能力大幅提升;V4-Flash则面向高频轻量调用场景,价格门槛更低。[4][5]
DeepSeek正式涨价时间是什么时候?各模型价格具体涨了多少?
结论先行:DeepSeek API新价格已于北京时间2026年8月17日00:00正式生效,V4-Pro最高涨幅达1100%,V4-Flash最高涨幅达400%。[1][5]
据中新经纬报道,深度求索官方宣布对DeepSeek API价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半;V4-Pro高峰时段输出价由6元/百万tokens涨至27元,涨幅达350%。[1]
| 模型 | 计费项目 | 原价(元/百万tokens) | 高峰价 | 空闲价 | 高峰涨幅 |
|---|---|---|---|---|---|
| DeepSeek-V4-Pro | 输入(缓存未命中) | 3 | 9 | 4.5 | 200% |
| DeepSeek-V4-Pro | 输出 | 6 | 27 | 13.5 | 350% |
| DeepSeek-V4-Pro | 输入(缓存命中) | 0.025 | 0.3 | 0.15 | 1100% |
| DeepSeek-V4-Flash | 输入(缓存未命中) | 未明确公布 | 3 | 1.5 | — |
| DeepSeek-V4-Flash | 输出 | 2 | 9 | 4.5 | 350% |
| DeepSeek-V4-Flash | 输入(缓存命中) | 0.02 | 0.1 | 0.05 | 400% |
从表格可以看出,单看涨幅数字,最夸张的是缓存命中输入价格,V4-Pro达到1100%,V4-Flash达到400%。但这不等于实际账单一定会增长11倍。真实账单由输入(缓存未命中)、输入(缓存命中)、输出三类token的价格和各占总消耗的比例共同决定。[2]对大多数生成型应用来说,输出token价格权重最高,因此输出价格3.5倍涨幅对开发者成本影响最大;而缓存命中输入价格虽然涨幅惊人,但如果应用设计得当,命中缓存的部分在总消耗中占比有限,绝对费用涨幅并不一定会主导总成本。
峰谷定价机制到底是什么?为什么DeepSeek要在这个时间点涨价?
峰谷定价,本质上是把电力行业的分时电价逻辑引入大模型API市场。DeepSeek将每日划分为高峰7小时和空闲17小时,高峰时段价格为空闲时段的两倍。[3]开发者只要把批量任务、离线推理、数据清洗等非实时调度任务挪到空闲时段,单位成本就能直接减半。
为什么选择8月17日这个时间节点?有几个背景值得关注:
- 8月12日,DeepSeek-V4-Pro正式版(0813版本)悄然上线并逐步开放全端服务。[4]作为算力消耗更大的旗舰模型,其推理成本显著高于旧版,同时支持100万上下文和更强的Agent能力,产品本身的分层已为差异化定价做了铺垫。
- 从开发者反馈来看,DeepSeek API调用规模在近几个月中快速攀升,高峰时段排队和延迟问题已有所显现。通过价格杠杆调节供需,是缓解算力峰值压力的一种市场化手段。
- 北京广播电视台评论员李杜在相关讨论中表示,纯粹依靠烧钱的低价竞争,短期看似热闹,长期却会透支整个产业链的创新活力,大模型产业需要搭建多层次的定价体系来保护中小创新力量。[6]
需要说明的是,DeepSeek官方在公告中并未直接解释涨价原因,上述分析基于公开信息和行业背景。同样值得关注的是,官方同步释放了产品升级信号:V4-Pro正式版的Agent能力和上下文长度均有明显提升。[7]这意味着新的价格体系并不是单纯涨价,而是把产品和价格捆绑后的一次结构性重置。
涨价后DeepSeek还便宜吗?和GPT-5.5、通义千问怎么比?
结论:即便在涨价后的高峰时段,DeepSeek仍是主流大模型中性价比较高的选择。[8]
先看国际市场对比(输出价格,元/百万tokens,按2026年8月公开信息整理):
- DeepSeek V4-Pro(高峰):27元
- DeepSeek V4-Pro(空闲):13.5元
- GPT-5.5(OpenAI):216元
- Claude Opus 5(Anthropic):180元
- Gemini 3.7 Flash(Google):27元(2026年底前促销价)
- Grok 4.5(xAI):43.2元
V4-Pro高峰输出价为GPT-5.5的1/8,与Gemini 3.7 Flash促销价持平。[8]
再看国内主流模型(输出价格,元/百万tokens):
- DeepSeek V4-Flash(高峰):9元
- 通义Qwen3.7-Max(阿里):36元
- 豆包2.1 Pro(字节):30元
- GLM-5.3(智谱):28元
- Kimi K3(月之暗面):100元
V4-Flash高峰输出价远低于上述国产旗舰模型。[8]
价格对比之外,模型实际效果存在差异是常识:V4-Pro本身能力接近海外头部模型,V4-Flash主打轻量场景。如果把性能和价格的比值当作衡量标准,DeepSeek在此次调价后的竞争力并没有明显下降——因为这次调价同时伴随着V4-Pro正式版的能力升级。换句话说,开发者在多付钱的同时,也获得了一个更强的模型。
个人开发者还能用得起DeepSeek吗?如何控制成本?
结论:轻量级开发者可承受,重度Agent开发者承压明显。[9]
从社交平台上的真实账单反馈来看:
- 一位开发者表示,涨价前个人API月花费约100元,以V4-Pro为主;涨价后同等用量预计达到300-400元。[9]
- 另一位开发者在涨价首日实测,两个简单问题就消耗了约0.8元,月中额度加速消耗。[9]
- 更夸张的是,一名使用DeepSeek搭建自动化系统的开发者透露,同一套系统日均Token费用从1-2元涨到十几元,实际成本至少增长5倍;大量高频写代码、跑Agent任务的用户,日消耗突破百元已不鲜见。[9]
用不起不是绝对值,而是预算敏感度问题。建议按使用强度寻找策略:
- 轻度用户(月调用量低于500万tokens):每月增加几十到一两百元成本,仍在可接受范围内;
- 中度用户(月调用量500万-5000万tokens):必须引入错峰机制,将非实时任务全部迁至空闲时段,成本可压缩近一半;
- 重度用户(Agent自动化、高频代码生成):先评估ROI再决定去留。如果业务收入能覆盖成本,DeepSeek仍有竞争力;如果不能,可以关注Grok、Mimo、各家国内模型的低价档位或自建开源模型。[9]
一个被低估的省钱细节是缓存命中机制:V4-Pro缓存命中输入虽然从0.025元涨至高峰0.3元,涨幅1100%,但它与未命中输入(9元)之间仍有30倍价差。也就是说,如果应用能设计成系统提示词和长上下文尽量稳定、重复命中缓存,仍有显著的成本优势。
DeepSeek涨价释放了什么信号?AI普惠时代结束了吗?
AI普惠并没有以这次调价为终点。普通人使用的网页版和App端免费服务并未在调价范围内,普通用户依然可以零成本使用DeepSeek模型能力。[7]真正被卷入涨价风波的是API调用者,也就是开发者、创业团队和AI应用公司。
往深一层看,这次调价释放了三个信号:
- 算力成本最终会传导到API价格。行业无法永远以低于成本的价格提供顶级模型推理服务。纯粹依靠烧钱的低价竞争不是健康的产业形态。[6]
- 大模型API的定价策略正在从一刀切走向精细化、动态化。峰谷计价如被验证有效,国内其他模型厂商大概率会跟进,形成新的行业标准。
- 对基于API构建应用的个人开发者而言,技术选型只看模型效果的时代正式结束。成本测算、时段调度、缓存优化等工程能力,将重新成为竞争壁垒的一部分。
从实际时间线来看,2026年8月17日这个节点,很可能成为国内大模型API从价格战走向价值战的标志性日期。[1]DeepSeek并没有退出性价比赛道,而是通过峰谷定价把选择权交还给开发者:要么为即时响应付费,要么用时间换成本。
常见问题:DeepSeek涨价关键问答
DeepSeek正式涨价时间是什么时候?
DeepSeek API新价格于北京时间2026年8月17日00:00正式生效。官方于8月13日发布公告,提前数日告知开发者。[1][7]从8月17日零时起,所有API调用均按新价格计费。
DeepSeek涨价后每百万tokens要多少钱?
以V4-Pro为例,高峰时段每百万tokens输入(缓存未命中)9元、输出27元、缓存命中输入0.3元;空闲时段分别为4.5元、13.5元、0.15元。V4-Flash高峰时段输出9元,空闲时段4.5元。该信息需以官方实时价格页为准。[2][5]
涨价后DeepSeek还值得用吗?
据2026年8月公开价格对比,V4-Pro高峰输出价(27元/百万tokens)仅为GPT-5.5(216元)的1/8,与Gemini 3.7 Flash促销价持平;V4-Flash高峰输出价(9元)低于通义、豆包、GLM、Kimi等国产旗舰。若能错峰调度并合理利用缓存命中,DeepSeek仍是高性价比选项。需以官方实时信息为准。[8]
技术要点表
| 技术/产品 | 核心指标 | 应用场景 | 影响对象 | 限制条件 | 信息来源 |
|---|---|---|---|---|---|
| DeepSeek-V4-Pro | 高峰输出27元/百万tokens,输入9元(缓存未命中),缓存命中输入0.3元;最高涨幅1100% | 复杂推理、代码生成、Agent任务 | API开发者、企业客户 | 高峰时段价格高,需错峰调度 | 中新经纬、中国经营报[1][2] |
| DeepSeek-V4-Flash | 高峰输出9元/百万tokens,输入3元(缓存未命中),缓存命中输入0.1元;最高涨幅400% | 高频轻量调用、实时对话、内容分类 | 个人开发者、初创团队 | 能力弱于V4-Pro,适合轻量任务 | 公开价格页、科技博主整理[5] |
| 峰谷计价机制 | 高峰7小时(9:00-12:00、14:00-18:00),空闲17小时价格减半 | 批量任务调度、成本优化 | 所有API用户 | 需要任务可延迟执行 | 北京新闻、DeepSeek官方公告[3][7] |
| GPT-5.5 | 输出216元/百万tokens | 通用对话、复杂推理 | 全球开发者 | 价格约为V4-Pro高峰价8倍 | 2026年8月公开价格[8] |
| 通义Qwen3.7-Max | 输出36元/百万tokens | 中文场景、企业应用 | 国内开发者 | 价格高于V4-Flash | 2026年8月公开价格[8] |
#DeepSeek正式涨价# #DeepSeekAPI调价# #AI大模型# #大模型API价格# #科技产业#