皇家山的维特根斯坦
26-09-12 05:27

本来还在等 Grok 4.7,结果马斯克又跳票了。现在给出的说法是,4.7 被 RL 调得有点太狠,连话都快说不利索了。

这个我其实很有同感。Grok 4.6 用下来,最大的问题就是回答越来越短,很多时候观点刚展开一点就结束了。另一边像 Opus 5、Fedo 这类模型又容易走到另一个极端,一件很简单的事能给你讲半天。

现在看LLM的“话多话少”本身也是一个很难调的东西。太啰嗦当然烦,但说话太少,同样不行。

发布于 加拿大