本来还在等 Grok 4.7,结果马斯克又跳票了。现在给出的说法是,4.7 被 RL 调得有点太狠,连话都快说不利索了。
这个我其实很有同感。Grok 4.6 用下来,最大的问题就是回答越来越短,很多时候观点刚展开一点就结束了。另一边像 Opus 5、Fedo 这类模型又容易走到另一个极端,一件很简单的事能给你讲半天。
现在看LLM的“话多话少”本身也是一个很难调的东西。太啰嗦当然烦,但说话太少,同样不行。
发布于 加拿大
本来还在等 Grok 4.7,结果马斯克又跳票了。现在给出的说法是,4.7 被 RL 调得有点太狠,连话都快说不利索了。
这个我其实很有同感。Grok 4.6 用下来,最大的问题就是回答越来越短,很多时候观点刚展开一点就结束了。另一边像 Opus 5、Fedo 这类模型又容易走到另一个极端,一件很简单的事能给你讲半天。
现在看LLM的“话多话少”本身也是一个很难调的东西。太啰嗦当然烦,但说话太少,同样不行。