#DeepSeekV4.1Flash发布#DeepSeek新出的V4.1 Flash看点挺有意思,别看它是系列里尺寸最小的模型,实力却直接追上甚至超越上一代旗舰V4 Pro,还自带原生多模态视觉能力,看图、识图都能搞定。#微博视频号续航计划#
这次最大亮点是全新非对称MoE架构,激活参数量很小,直接把算力开销打下来。KV Cache缓存大幅缩减,HBM显存需求降到原来1/4,SSD占用只有1/8,跑Agent智能体任务的时候成本低很多,速度还更快。
测试榜单上,代码、数学、自动化智能体等多项基准成绩亮眼,对标Kimi、GLM、GPT等主流模型不落下风。官方直接宣布,之后V4 Pro会逐步下线,流量全部切到V4.1 Flash,相当于小模型上位接班旗舰。
定价也跟着下调,还搞峰谷分时计价,闲时价格直接减半,开发者用API调用会省钱不少。同时官方也会推进开源适配,方便社区本地部署。
当然也不是完美无缺,虽然综合跑分很强,但在一些超复杂长文本推理场景,和顶尖大模型依旧存在差距。 http://t.cn/AX0ghiIY
发布于 上海
