9月份,是一个神仙打架、周周洗牌的修罗场。
全球头部 AI 实验室密集发布新一代旗舰,国内厂商同步提速迭代。
在这场每周都有「重磅」的混战中,有一家模型厂没有选择跟着节奏「小步快跑」——
它攒了一个大的,然后一把摊在桌上。
这家公司就是阶跃星辰。9 月 20 日,他们发布了新一代旗舰基座模型 Step 5 Preview。
它在告诉整个行业:我回来了。
在 Artificial Analysis Intelligence Index(AA 智能指数)中,Step 5 Preview 取得了 44 分。
拉一张横向对照表:Claude Fable 5.1 领跑全球(53 分),GPT-6 Astra 紧追其后(52.8)。
Step 5 Preview 的 44 分,把阶跃送进了全球开源模型前三。
而且这个位置的「性价比」很扎眼:每百万 token 输入 1 美元、输出 2.7 美元,跑完一道 AA 智能指数任务平均只要 0.71 美元。
在 AA 官方的「智能指数 vs 单任务成本」图上,Step 5 Preview 创造了新的帕累托前沿——
同样的智能水平,没有比它更便宜的;同样的价格,没有比它更聪明的。
这个成绩的含金量,在今年 9 月变得更高了。
AA 智能指数在月初刚升级到 v4.2:两项新评测加入、GPQA Diamond 被淘汰(太容易了)、私有测试集权重翻倍到 40%。
靠背题刷分的时代过去了,模型必须在从未见过的任务上展现真正的推理力。
而 Step 5 Preview 还有一个不容忽视的标签:开源。
在当前 AA 榜单前列,绝大多数是闭源模型。Kimi K3 以开源权重身份杀入全球前五已被视为里程碑,Step 5 Preview 是又一个挤进核心竞争区的开源选手。
这意味着中国开源模型的能力天花板,仍在加速上移。
