金河落九天
26-06-30 06:06

调研解读|DeepSeek V4高峰期定价翻倍,推理加速框架DSpark提升推理效率
高峰时段API定价翻倍,有助提升Token价格信心
今晚,DeepSeek官宣正式版V4将于7月中旬正式上线,并宣布API服务引入峰谷定价策略,其中高峰价格为平时价格两倍(12元/百万tokens),而平时价格与先行V4 API定价一致。此前DeepSeek被部分媒体成为“价格屠夫”,原V4 API定价也引发了市场对Token通缩担心,而新的高峰期定价在国产模型中并不算低,将有助于提升投资者对未来token价格的信心。
Token定价未来将保持理性
去年以来,全球模型的API定价都呈现分化趋势:竞争力突出的旗舰模型定价不断攀升,而入门级模型的token定价一直维持在较低水平。我们认为,随着今年以来算力设备价格走向通胀,以及国内外投模型公司均对盈利或减亏有着较明确的诉求,算力资源也持续处于紧张状态,未来token的价格出现内卷式降价的可能性较低,未来token定价将相对理性。
推理优化影响Token输出效率
DeepSeek团队和北大团队联合推出的DSpark框架通过引入推测性解码模块,提高了token生产效率,较优化前可以提升60-85%,体现推理框架优化对Token效率和成本的影响。我们认为,Token工厂类型的企业,具备推理优化能力可获得较为明显的竞争优势。
近期算力服务板块表现有一定分化,关注龙头企业协创、宏景、东阳光,以及具备较为明显预期差的token工厂企业【润建股份】、【亚康股份】,以及积极关注【赛意信息】、【蜂助手】、【盛视科技】等公司业务布局与进展。
Deepseek涨价速评
模型需求继续爆发、国产模型商业化斜率仍在快速爬升
怎么涨?
V4 正式版7月中旬上线,V4–Pro和V4-Flash引入峰谷定价,API从全天统一价格➡️分时段计费
1️⃣高峰时段(北京时间每日9:00-12:00 和 14:00-18:00),合计7小时,覆盖全天的29%。
2️⃣其余17小时为平时价格。
涨多少?(单位均为元/百万token。)
1️⃣高峰价格🟰基础价格✖️2,价格为GPT-4o 的1/3,依旧具备竞争力
2️⃣基础定价不变:
【V4-Pro】输入(缓存命中)/输入(缓存未命中)/输出为0.025/3/6
【V4-Flash】输入(缓存命中)/输入(缓存未命中)/输出为0.02/1/2
如何解读本次涨价?
模型需求继续爆发,日间工作时段API并发激增、算力负载过高,涨价是模型进一步精细化运营与商业化加速的信号,也说明模型继续回归价值定价曲线,我们继续看好需求时代下国产模型商业化爆发潜力,国产模型的ARR斜率仍将持续快速爬升
后续关注什么?
模型的缓存命中能力与缓存命中价格将会成为开发者使用模型衡量的关键因素,同时优化缓存策略、合理安排任务调度成为控制成本的重要手段,亦将成为模型分层的信号,继续看好国产大模型成长空间与份额突破

发布于 北京