MinMax的M3也追上来了,好事!AI中国团,一花独放不是春,Kimi K-2.6、GLM-5.1、Qwen3.7-Max、DeepSeek-V4-Pro等都不错。和最新的Opus-4.8差距明显,和最优秀的前沿模型未来相当长一段时间可能始终存在差距,需要持续追赶。不过最快到今年年底的时候主要国产模型大致可以给到用户一个4.7级别的可用水平(如果算力充沛的话),也就是大部分常规任务结合Agent、harness工程可以靠得实,对绝大部分用户来说眼前基本就够了。但是算力方面的掣肘还要持续一段时间。充裕的算力能让模型在max等模式下表现出更高水准,同一个任务如果给予更高的算力能有进一步的表现,同等算力消耗情况下硬件水平高的话可以有更快的交付,而国产模型的max算力消耗显然和前沿模型的max差得不是一点点,长程复杂任务等模型的深度智能水准本身有差距是原因之一,算力方面比较吃亏(甚至降算力导致降智)也是实情,一个绕不过去的原因。模型更大、精度更高、激活量更大、算力更多,表现就会更好,也是常识。
发布于 天津
