#ClaudeSonnet5.5发布#二当家把自家队长按在地上摩擦。Anthropic 刚发的 Sonnet 5.5,价格只有 Opus 5.5 的一半,却在程序员最看重的智能体编码跑分上反超了。Terminal-Bench 4.0 拿了 70.6%,比 Opus 5.5 的 66.4% 还高。
它快也更省。生成速度比上代 Sonnet 5 快 30% 以上,单位任务 token 能少掉约三成。能便宜还打硬仗,关键是它能在不超成本上限的前提下,同时派好几个子智能体并行干活。
这代还有个头一回。Sonnet 系列过去发布时安全配置比顶级模型低一截,这次网络安全能力和 Opus 5 拉平,发布就配上同级护栏,已经在 Claude Code 里能用了。Anthropic 对它够不够强,态度挺明确。
但 Sonnet 不是全面盖过 Opus。需要持续判断的复杂活儿,Opus 5.5 还是明显更强;真实办公综合评测俩人几乎打平,1844 对 1846。Sonnet 主打边界清晰、能快速迭代的日常任务。
我看这代最该盯的,是便宜那档也开始能干重活。天天跑 coding agent 的人,这笔账算下来是真能省。
发布于 河北
