张岱樾
26-09-22 07:41 微博认证:AI博主

#SpaceXAI发布Grok4.7模型#
马斯克今晚交卷了。Grok 4.7正式发布,定位很直接:面向编程和知识工作的最强模型,速度是同类两倍,价格只有一半。

价格表先摆出来。输入每百万token两美元,输出六美元,与Grok 4.6完全持平。对比GPT-5.6 Sol的4美元/20美元、Fable 5.1的10美元/50美元,Grok 4.7直接把单价压到了竞品的五分之一。缓存命中只要0.5美元。

性能提升集中在长任务。Terminal-Bench 4.0从20.3%飙升到38.0%,接近翻倍。DeepSWE v1.1拿到71.0%,超过GPT-5.6 Sol的72.7%就差一个身位,把Fable 5.1 Max的70.0%反超了。CursorBench 4.0得分46.3%,比4.6涨了6个百分点。AA-Briefcase多小时专业工作测评1657 Elo,比4.6高出111分。马斯克在X上就转了一个词:“更强”。

但有两个细节值得注意。第一,它换了更大的基座模型,强化学习训练更侧重数小时才能完成的复杂任务,自我检查和长上下文管理都做了针对性优化。第二,token消耗明显增加。Artificial Analysis数据显示,跑完同样的智能指数测试,Grok 4.7输出81k token,是Grok 4.6的两倍多。

一句话总结:Grok 4.7走的是“把单价打下来、把长任务做扎实”的路子。价格没变,但能干的活更多了。#微博AI创作季#

发布于 广东