七九三一
26-08-18 00:56 微博认证:Timer时一工作室主编

看起来DeepSeek大幅涨价一个重要原因是,需要集中算力练模型。

今天官方群里,一向不怎么说话的小助手出来说了几句,其中就有这么一句:
DeepSeek 将集中研发精力奉上更强的模型,敬请期待!

考虑到OpenCodeGo那边今天跟着涨完价以后,DeepSeek此月用水量下降了接近90%,换句话说,这些算力都能腾出来给训练用。

国内算力确实不大够,特别是用于训练的Blackwell系列卡,国内目前不仅缺而且贵,八卡机价格都能炒到1200万到1500万,而海外的原价大概是400万左右。
不管是Deepseek还是Kimi还是GLM,都需要大量的卡用作下一代模型的训练,以及这一代模型的后训练。

反正是好事,虽然短期来说,梁胜评价下调至肥鲸鱼。
但还是得在下一代模型的竞争上,多占据一点先机。

归根结底还是一句话,余承东、何庭波,卡呢?

发布于 北京