Anthropic 昨晚发了 Claude Sonnet 5.5,一个很有意思的信号出现了:中端模型开始反杀旗舰。
Terminal-Bench 4.0 上,Sonnet 5.5 开到 Max 档位拿了 70.6%,曲线尾端直接越过了自家大哥 Opus 5.5。要知道,它的 API 价格只有 Opus 的一半,每百万 token 输入 2 美元、输出 10 美元。更夸张的是,用默认的 Medium 档就能远超上一代 Sonnet 5 的最好成绩,单任务成本大约只有十分之一。
这说明一件事:AI 模型的竞争逻辑正在变化。过去大家拼的是谁的天花板更高,现在拼的是谁能用更少的资源做到同样好。Epic Games 拿它处理数万行游戏架构代码,跑几个小时依旧快;Base44 在 118 个真实应用构建里,平均迭代次数从 Opus 5 的 7.7 次降到了 3.6 次;Balyasny 在 2441 个金融任务上实测,每个回答的 token 用量从 49.7 万骤降到 12.1 万。
速度提升 30%,token 消耗更少,价格不变,性能逼近甚至局部反超旗舰。这个组合拳打下来,对开发者的实际意义可能比发一个新旗舰更大。毕竟绝大多数生产场景要的是稳定、快速、便宜地把活干完,极限智力只在少数场景才有用。
Sonnet 5.5 已经在所有平台上线,Haiku 5.5 也会在未来几周跟上。中端吃掉旗舰的市场份额,这个趋势恐怕会越来越明显。
#ClaudeSonnet5.5发布#
发布于 山东
