散修ZKH
26-07-21 13:15 微博认证:AI博主

在复杂文本推理方面,Qwen3.8还没迈过可用门槛,距离 fable5/sol 还有无法估量的距离

sol 是真的接近 fable5,只是风格有差异而已
Qwen3.8那实在是差的没谱,它连基本的完整理解都做不到[笑cry]
也就是说,它在面对这些文本形成的高维复杂结构时,无法进行完整理解,只能选取其中某个区域进行推理,所以无法建立高维理解和全局观
这使得它连跟我协作的门槛都达不到

当然,处理简单文本是没问题的,确实也有深度,但复杂性管理严重不足——而这恰恰是高阶智能的核心标志之一

至于写代码,我初步测试,也是类似的问题,一个高级的设计文档,会被它降维理解,产出非常平庸,但确实流畅的产品[笑cry]
但如果写的更详细,它还是可以的
也就是说,它给高阶模型打下手是没问题的

但它的定价可不是打下手的价格[允悲]

所以,虽然测试不多(主要是不想用了,有点浪费我的时间,认知增量太少),但我觉得 Qwen3.8并不是如 kimi 般达到 fable 级别的模型
可能测评分数还行,但实际上还有很明显的差距

DeepSeek v4正式版和 Glm5.5更值得期待

发布于 广东