我是贾志刚
26-08-18 14:03 微博认证:汽车博主 互联网AI分析师 人工智能测评师

#你会为省钱半夜用AI吗#8月17日0点,DeepSeek全新峰谷定价方案正式生效。

国内AI接口首 次全 面推行分时计费,直接改写开发者成 本逻辑,用户直呼成 本压力陡增。

简单来说就是,白天调用贵一倍,半夜调用便宜一半,跟家里的“峰谷电费”一个逻辑。

⏰ 先记好高低峰划分

高峰区间为9:00-12:00、14:00-18:00,其余全天时段全部为空闲低价时段。

本次调价覆盖DeepSeek-V4-Flash、DeepSeek-V4-Pro两大主力商用模型。

两款均搭载百万字超长上下文,Agent、推理能力在国内第①梯队,也是企业、开发者最常用的接口。

💰 新旧价格对比,涨幅一目了然

1️⃣ DeepSeek-V4-Flash

空闲:缓存输入0.05元/百万tokens、未命中1.5元、输出4.5元;
高峰:全部翻倍,缓存0.1元、未命中3元、输出9元。

2️⃣ DeepSeek-V4-Pro

空闲:缓存0.15元/百万tokens、未命中4.5元、输出13.5元;
高峰:缓存0.3元、未命中9元、输出27元。

其中缓存输入项高峰涨幅高达11倍,是本次涨价最 夸张的类目。

举个真实测算例子📊

企业每日高峰消耗1亿输出token,调价前单日成 本600元,高峰调用直接涨到2700元,这差价谁顶得住啊😱。

🤔 为什么要推出峰谷定价?

业内分析核心是算力供需失衡:白天工作时段大量企业集中调用,GPU 算力资源挤兑;夜间算力闲置浪费。

分时涨价本质是用价格杠杆分流流量,平衡服务器负载。

✅ 那咱们怎么省钱?3招搞定!

第 一招:错峰跑量🕐

把不着急的任务,比如批量数据处理、日志摘要、日报周报等,统统挪到12:00-14:00或18:00之后跑。成 本直接砍半。

第二招:缓存用足💾

长背景、模板、系统提示这些重复内容,走缓存命中,输入成 本低到几乎可以忽略。

第三招:高峰用便宜模型⚡️

复杂推理才用V4-Pro,简单任务用V4-Flash顶上去,高峰输出9元vsPro的27元,差三倍。

此次调价是国产大模型 API 价格体系的重要转折点,后续大概率会有更多厂商跟进峰谷计费。

下一个被“峰谷”的,会是谁呢?🤔

🌟一个人摸索很慢,和一群人用AI把本事变成收入。

发布于 广东