#DeepSeekV4Flash有多强# DeepSeek V4-Flash正式版7月31日上线,架构参数完全没变,只重新做了后训练,结果Agent能力直接起飞——几个核心数据太炸了:
· DeepSWE编程能力从7.3飙到54.4,暴涨645%
· Terminal Bench 2.1从61.8涨到82.7,逼近Claude Opus 4.8
· 性价比太狠:输入1元/百万Token,缓存命中低至0.02元,有开发者实测高强度用1小时花费不到1块钱,同样的活儿Claude Opus要25美元
· 上线不到一周登顶OpenRouter全球调用量榜首,单日处理8万亿Token
参数不变,只靠后训练就能让性能暴涨,这件事本身比跑分更值得关注。“后训练”正在成为大模型能力提升的新引擎,不一定非要堆参数。
V4-Pro旗舰版据说8月初上线,如果Pro也有这种幅度的提升……你们觉得呢?
#DeepSeek##AI大模型##微博AI创作季#
发布于 广东
