k3和 Qwen3.8用起来都有种感觉——不自信,默认角色就是低维行动,偏向于执行者而非思考者/决策者/建构者
有种种缺少全局观的意思,更喜欢“远远的”点评一下,而是站在高维思考——给出系统的,高度结构化的,能抓住意图和重心的全局分析
得花很大的力气才能“撬开它们的脑子”
但推理能力是中性的,为何只想特定的东西?好奇怪
相当于,在一个展开的高维语义空间,即便有着探索全局的能力,也只是“主动”选一些局部进行“评估”(可能就是这么设计和训练的),除非你强压着它进行分析和思考,k3大概率不是没能力思考(还未测试,暂时不好说)
这跟 DeepSeek 完全不一样,DeepSeek 豪迈的很,站位就是全局思考舍我其谁,但它的分辨率显然不行,并没有能力做的全局探索
不过它能用较低的分辨率看懂整个语义场的结构
fable5就是那种天然 hold住整个语义场的感觉,游刃有余,无论是整体还是局部,信手拈来
sol 略差,但能罗里吧嗦的把高维语义空间讲清楚,要干活也是可以的
Qwen3.8最看不懂,好像搞不定整个语义场,但又说不清能探索哪些局部,面对它很有一种无力感
只有在 coding 方面,如果把规划做的足够详细,它好像也能轻松完成
按说,推理能力也是极强的才对
搞不懂,都是采用没多久,各种😵💫
能干活就行吧[裂开]
发布于 广东
