不吃苦莲子
26-06-27 16:07 微博认证:电竞博主

#deepseek发布dspark#
很多人只盯着大模型参数内卷,却忽略了实际使用的算力损耗问题。
DeepSeek联合北大新推出的DSpark推理加速框架,简单说就是给AI装上提速引擎。一改传统逐字运算模式,提前预判生成内容再批量核验,不改变回答质量,却大幅降低GPU无效算力消耗。

实测同等硬件条件下,用户对话响应速度提升六成以上,高并发场景吞吐效率最高翻四倍,而且适配通义千问等多款主流开源模型,通用性很强。
这项技术最大意义,是不靠堆砌显卡堆硬件,用算法优化压低运行成本。后续普通企业搭建AI服务,门槛和花费都会明显下降,国产大模型落地商用又往前迈了一步。 http://t.cn/AXSQLuVs

发布于 河南