大模型推理最高提速85%!DeepSeek发表重磅论文 提出两项互补机制 http://t.cn/AXSu643B
6月27日,DeepSeek团队联合北京大学发布关于DSpark的论文。目前DSpark 已完成真实用户流量落地验证。在同等系统总吞吐规模下,V4-Flash 单用户生成速度提升 60%-85%,V4-Pro 提升 57%-78%。
DeepSeek 在完成大额融资后并未单纯追求参数扩容,而是关注落地效率,击中产业真实痛点。在生成式AI从实验室走向商业化的周期里,“更快、更省算力”正在取代单纯的模型跑分,成为厂商竞争力的关键指标。
发布于 四川
