老K的科技内参
26-09-11 02:24 微博认证:数码博主

DeepSeek在9月10日发布V4.1 Flash模型,参数量达到552B,采用全新Causal-Encoder-Decoder架构,输入侧激活8B、输出侧激活16B。这次更新原生支持视觉理解,KV Cache对HBM和SSD的需求分别降至上一代的1/4和1/8。网页与APP端原有模式合并为智能模式,能自动检测查询复杂度并调度算力。Pro版将在9月14日下线,相关请求全部路由至V4.1 Flash。API价格空闲时段输入降至0.02元每百万tokens,降幅达60%。这次迭代让AI应用成本更低,使用门槛也降低了不少。 #DeepSeek新变化#

发布于 江苏