每天玩AI
26-09-08 08:04 微博认证:AI博主

Artificial Analysis 9月7日更新综合智能指数,榜单出现多处值得关注的排位变动,同时评测体系完成迭代:

核心分数变化

1. DeepSeek V4 Pro 以2分优势击败 Qwen 3.8‑27B(xhigh),二者此前同为42分,更新后36 vs 34。

2. Qwen 3.8 Flash‑Next 对比 Qwen 3.8‑27B(xhigh)领先优势扩大至8分,差距较此前翻倍。

3. Qwen 3.8 Flash‑Next 42分反超 Gemini 3.8 Flash(41分),上一版评测是Gemini领先1分。

4. Flash‑Next(42分)实现越级,领先自家旗舰MoE Qwen 3.8‑2.4T A95B(40分)2分。

5. 27B稠密模型推理档位差距显著收窄:Low到xHigh档位的分数差由原先8分(34‑42)压缩至仅5分(29‑34)。

本次评测不止更新Terminal‑Bench 4.0,还用面向Zapier企业工作流的AutomationBench‑AA替换了旧的τ3‑Banking基准,更侧重真实企业自动化任务能力。

综合榜单表现来看,Qwen 3.8 Flash‑Next已经成为当下本地部署阵营的明星模型。

发布于 马来西亚