deep seek 涨价了,而且涨幅巨大。GLM5.3也不再免费提供了,需要按月订阅。这是正常的,高智商的模型需要更大的模型规模,需要消耗更多的算力和内存,因此,这种高智商的模型本身就应该卖的贵一些。
从社会经济的角度来看,顶级大模型相当于一个智商120到130的人,这种智商的人在社会中就是考上985和211的那种,他们要么是程序员,要么是工程师、设计师,本来就拥有高于社会平均的薪资水平。
使用这类顶级智商大模型就意味着大量雇佣了高智商的工程师、设计师、程序员,他打开了人才供给的空间,但是这并不意味使用人才就变得便宜了。大模型解决是人才缺乏的问题,而不是解决人才成本问题。人才必须有合理的报酬,才能有人才的供给。
那既然如此,拥有相同智商的大模型,其使用成本自然是不低的,这个世界上不可能存在又便宜又好用的东西。所以,不要抱怨大模型贵,而是他本身就应该值这么多钱。而且以当前的算力成本,一个用户一个月5000到30000的付费支出,模型厂商不一定是赚了暴利。
很多人喜欢用小模型跑在消费级显卡上,认为可以节省算力成本。从理论上讲,部分非常狭窄的领域来看,小模型确实可以部分替代商用云计算大模型,但是消费级显卡上部署的模型,要么面临智商偏低,需要大量的人工纠错,要么面临知识库非常有限,泛化能力非常差。
这个世界上不存在既便宜又智商高的大模型!大模型时代,解决的是智商可及问题,而不是智商随手可得问题——人人都可以聘请一堆智商超高的agent帮你干活,这是平等,但是不要指望这些高智商的agent是便宜的,就像一个人永远不可能花一个保安的钱,聘请一个985的大学生替你做编程一样,这是公平。
发布于 广东
