我有一个感悟,5.6sol max这样的顶尖大模型确实很好,但很喜欢多想,速度也很慢。肥波5太贵,总有各种各样的问题。很多时候我们其实需要的是#智谱发布glm5.3flash#这样的大模型。
之前看到一个截图是这么说的:
gpt5.6最让我受不了的就是: 我让它做一盘番茄炒蛋,它往里还加了东坡肉。 我说有必要加东坡肉吗?它说你说得对,然后把东坡肉去掉。 我说好,你提PR吧。再一看,它PR写着「番茄炒蛋(无东坡肉)」并且注 释里会写一大堆为什么本道菜不需要加东坡肉。
这些顶尖大模型虽然好,但普遍存在贵、慢、想太多、给自己加戏的问题,更适合头脑风暴、许愿式编程、前沿领域突破的时候用。像5.6 Sol Max这种模型,它的优势在不确定性很高的任务里。自己都没想明白要什么,这个时候用5.6sol max就很好。
但我们更多的时候需要的是一个在约束下快速干活的模型。譬如干苦力活的时候,譬如在严格约束下干活的时候,这时候我们更需要一个快速的,过了可用线的,价格便宜的多模态大模型,譬如之前的DeepSeek V4 flash识图版,譬如今天的GLM5.3 flash。
以前大家默认模型越强越好,因为大模型还在不断跨越“不会做 → 会做”的能力门槛,但到了今天很多非旗舰模型已经过了这条线了。
5.6sol max这种旗舰模型负责“做什么、怎么做”,GLM 5.3Flash这种模型负责“做”。速度快,价格便宜,不会像5.6sol max那样想太多。#how i ai##AI创造营#
发布于 上海
