#全球最强模型Fable5.1发布#Anthropic这次把Claude Fable 5.1和Mythos 5.1一起放出来,确实有点来势汹汹。科研测试从前代的水平直接翻倍,编程能力也往上窜,Mythos 5.1在Terminal-Bench 4.0拿到60.9%,看得出来重点就放在复杂任务和实际工作上。尤其是Agent能力,能自己验证、发现问题再纠错,这对经常让AI连续跑几个小时的人太重要了,少一点中途跑偏,体验可能就是质的变化。
我觉得这次最容易让开发者心动的,还是缓存读取价格直接砍掉75%。基础输入输出价格没变,缓存从每百万Token 1美元降到0.25美元,长上下文和重复调用多的项目,账单压力能明显小不少。典型工作负载成本大约降25%,高度Agent化的任务最高还能省到45%,这就不只是发布会上的漂亮数字了。做代码仓库分析、科研资料整理、长期项目协作时,每次调用都要算钱,便宜下来才更敢放手让模型多跑几轮。
企业安全方案也算补上了关键一块。数据可以放在自己的云基础设施里,人工审核权也交还给客户,金融、医疗这些对数据流转特别敏感的行业,终于有了更灵活的选择。前代产品因为强制保留30天数据引发顾虑,确实会让不少企业在采购时犹豫。性能提高、调用变便宜,再加上数据控制权更清楚,这次Fable 5.1和Mythos 5.1明显在认真解决产品落地时最现实的几道坎。 http://t.cn/AX0GmNYV
发布于 四川
