#你会为省钱半夜用AI吗#8月17日0点,DeepSeek全新峰谷定价方案正式生效。
国内AI接口首 次全 面推行分时计费,直接改写开发者成 本逻辑,用户直呼成 本压力陡增。
简单来说就是,白天调用贵一倍,半夜调用便宜一半,跟家里的“峰谷电费”一个逻辑。
⏰ 先记好高低峰划分
高峰区间为9:00-12:00、14:00-18:00,其余全天时段全部为空闲低价时段。
本次调价覆盖DeepSeek-V4-Flash、DeepSeek-V4-Pro两大主力商用模型。
两款均搭载百万字超长上下文,Agent、推理能力在国内第①梯队,也是企业、开发者最常用的接口。
💰 新旧价格对比,涨幅一目了然
1️⃣ DeepSeek-V4-Flash
空闲:缓存输入0.05元/百万tokens、未命中1.5元、输出4.5元;
高峰:全部翻倍,缓存0.1元、未命中3元、输出9元。
2️⃣ DeepSeek-V4-Pro
空闲:缓存0.15元/百万tokens、未命中4.5元、输出13.5元;
高峰:缓存0.3元、未命中9元、输出27元。
其中缓存输入项高峰涨幅高达11倍,是本次涨价最 夸张的类目。
举个真实测算例子📊
企业每日高峰消耗1亿输出token,调价前单日成 本600元,高峰调用直接涨到2700元,这差价谁顶得住啊😱。
🤔 为什么要推出峰谷定价?
业内分析核心是算力供需失衡:白天工作时段大量企业集中调用,GPU 算力资源挤兑;夜间算力闲置浪费。
分时涨价本质是用价格杠杆分流流量,平衡服务器负载。
✅ 那咱们怎么省钱?3招搞定!
第 一招:错峰跑量🕐
把不着急的任务,比如批量数据处理、日志摘要、日报周报等,统统挪到12:00-14:00或18:00之后跑。成 本直接砍半。
第二招:缓存用足💾
长背景、模板、系统提示这些重复内容,走缓存命中,输入成 本低到几乎可以忽略。
第三招:高峰用便宜模型⚡️
复杂推理才用V4-Pro,简单任务用V4-Flash顶上去,高峰输出9元vsPro的27元,差三倍。
此次调价是国产大模型 API 价格体系的重要转折点,后续大概率会有更多厂商跟进峰谷计费。
下一个被“峰谷”的,会是谁呢?🤔
🌟一个人摸索很慢,和一群人用AI把本事变成收入。
