昭冬序
26-06-02 22:40 微博认证:读物博主 超话主持人(我的白莲人设不能掉超话)

#DeepSeek降价#在2026年全球AI算力成本普遍上涨、多家厂商纷纷涨价或尝试收费的大背景下,DeepSeek 宣布将其旗舰模型 API 价格永久下调 75%,创下了全球大模型价格新低,而腾讯云也在今日跟进宣布最高降幅达 97.5%,彻底将大模型推理成本打到了“地板价”。
一、 核心降价事实与腾讯云跟进
永久降价 75%:2026年5月22日,DeepSeek 官方宣布,原定于5月底结束的 V4-Pro 模型 API 限时 2.5 折优惠,正式转为永久降价,价格锁定为原价的四分之一(降幅 75%)。
具体定价:
输入(缓存命中):0.025元/百万Tokens(即 100万 token 仅需 2.5 分钱)。
输入(缓存未命中):3元/百万Tokens。
输出:6元/百万Tokens。
腾讯云跟进:2026年6月2日,腾讯云宣布自 6月3日零时起,下调其智能体开发平台上的 DeepSeek-V4 系列模型价格,最高降幅达 97.5%。此次调整后,腾讯云渠道的调用价格与 DeepSeek 官方定价完全持平,彻底消除了中间渠道的溢价,意味着云厂商之间的竞争将从“拼价格”转向“拼生态与服务稳定性”。
二、 逆市降价的“底气”从何而来?
在全球 HBM(高带宽内存)价格半年暴涨超 500%、算力紧缺的行业“涨价潮”中,DeepSeek 敢于大幅降价并非单纯靠资本烧钱,而是源于底层技术的突破性降本:
架构创新:V4 系列采用自研的混合注意力机制(CSA+HCA)和混合专家模型(MoE),在处理百万级长上下文时,算力消耗仅为上代产品的 27%,KV Cache(键值缓存)占用降至 10%,大幅降低了单 token 推理成本。
极致缓存优化:模型支持超长上下文缓存,在代码编写、长文档分析等高命中率场景中,绝大多数 token 可按极低的“缓存命中”价格结算,实测整体推理成本较原价下降约 83%。
国产算力深度适配:摆脱了对海外昂贵 GPU 的依赖,全面适配华为昇腾等国产算力集群。国产算力的规模化应用与能效优化,从供应链底层压低了硬件与基建成本。
三、 行业格局重塑:一降一收的路线分化
DeepSeek 的降价在行业内引发了强烈震动,也加速了国产大模型商业模式的“K型分化”:
DeepSeek(技术普惠路线):主攻 B 端开发者与中小企业,通过极致低价打破 AI 应用门槛,以“价格战”换取开发者生态和 Agent 时代的入口。其 V4-Flash 模型曾在 OpenRouter 平台周调用量突破 3.43 万亿 token,登顶全球。
小米 MiMo 跟进:在 DeepSeek 降价仅 5 天后,小米也宣布 MiMo-V2.5 系列 API 永久降价,最高降幅达 99%,输入缓存命中价格同样压至 0.025 元/百万Tokens,并同步取消了按上下文窗口长度分段的计费规则。
豆包(C端体验路线):字节跳动旗下豆包同期宣布推出三档付费订阅(68元/200元/500元每月),主要针对高清生图、长文档精读等高算力场景。豆包回应 DeepSeek 降价时表示“乐见行业内卷”,强调双方赛道不冲突:DeepSeek 侧重底层 API 接口,而豆包深耕 C 端日常体验与多模态生成。 http://t.cn/AXXqYz5f

发布于 河北