#DeepSeek新模型限时内测# 这次更新重点在解决效率和成本的权衡问题。原生多模态意味着信息不再需要在不同模块间转换损耗,这是速度提升的根源。但速度快意味着单位时间消耗更多算力,用户感觉“烧钱快”是必然结果——你得到了时间,付出的是金钱。最值得注意的是Flash在逼近Pro能力这件事。如果中间层模型能完成旗舰80%的任务,大部分商业场景根本不需要最贵的方案。这会重塑AI服务的价格结构。500+ tokens/s的生成速度已经超过多数人的阅读速度,瓶颈从模型转移到了人。这时候比拼的不再是谁更快,而是谁能在高速输出时保持准确。测试三天就下线说明团队还在摸索这个平衡点。
发布于 北京
