SpaceXAI于9月21日正式发布新一代旗舰模型Grok 4.7,主打编程与知识工作场景,官方称其推理速度达到同类可比模型的两倍,而价格仅为后者一半。
一、核心亮点与产品定位
速度与价格双优势:Grok 4.7的推理速度是可比同类模型的两倍,API定价为每百万输入Token 2美元、输出Token 6美元,仅为同类竞品的一半左右。
聚焦垂直场景:官方将其定位为“用于编码和知识工作的最强大模型”,针对长时间复杂任务处理、大上下文承载与输出自检能力做了重点优化。
参数规模跃升:Grok 4.7参数量达2.1万亿,较上一代Grok 4.6的1.5万亿增长40%。
二、能力升级与基准成绩
工程能力表现亮眼:在CursorBench 4.0软件工程基准上得分71.0%,在DeepSWE v1.1等多项专业测试中领先多数同级竞品。
长任务与自检机制:模型在困难任务上能坚持更久,并会仔细检查自身输出结果,减少错误率。
安全对齐重构:官方称Grok 4.7拥有迄今校准最佳的安全防护,在拒绝应答与越狱抵抗能力上达到SpaceXAI模型历史最佳水平。
三、发布历程与市场影响
跳票与打磨:该模型原定9月12日发布,因强化学习阶段对回答长度惩罚过重、导致模型过早放弃难题而多次延期,最终于9月21日正式亮相。
全渠道即时开放:发布即通过Cursor、Grok Build、API、第三方调用框架及各大云平台同步开放,无限量、无排队。
行业竞争风向标:大模型赛道竞争正从单纯比拼参数转向速度、成本与垂直能力的综合较量,Grok 4.7以“性价比”切入市场,有望推动新一轮价格与服务竞争。