小米今天凌晨正式发布并开源了全新一代全模态大模型 MiMo-V2.6 系列,其中旗舰版 Pro 以 46 分的成绩登顶全球开源大模型榜首,成为当前公认的最强开源模型。

  一、发布与成绩:开源第一,逼近闭源顶级

  双版本登场:MiMo-V2.6 包含 Pro 与 Flash 两款原生全模态模型,可同时处理文本、图像、视频和音频,并标配 100 万 Token 上下文窗口。

  登顶开源榜:Pro 版在 Artificial Analysis 综合智能指数 v4.3.2 中取得 46 分,超过 Kimi K3(44 分)和 GLM-5.3(45 分),成为当前 AA 指数上排名最高的开源权重模型,较前代 V2.5-Pro 的 26 分大幅跃升 20 分。

  与闭源差距:官方同时说明,该模型与 Claude Fable 5.1 和 GPT-6 Astra(均为 53 分)等顶级闭源模型相比仍有差距,但已是开源阵营的绝对领跑者。

  二、训练揭秘:6 天直播烧钱,RL 算力规模化

  全程公开直播:小米罕见地将训练过程实时公开,Token 消耗、训练指标、实际开销全部可溯源,训练每小时成本约 3 万美元。

  成本与规模:Pro 与 Flash 训练历时不到 6 天,成本分别约 262 万美元与 85 万美元,各完成 30 步,累计约 75 万条轨迹;单步训练 Token 达 3.5 至 3.7B。

  能力提升显著:训练任务平均通过率分别相对提升 25% 和 12%;长程软件工程评测 DeepSWE v1.1 上,Pro 从 48.8 升至 65.7,Flash 从 58.4 升至 72.6。

  三、价格与生态:性能升价不变,性价比拉满

  沿用 V2.5 定价:Flash 为每百万词元输入 1 元、输出 2 元;Pro 为 3 元和 6 元,并提供 99% 缓存折扣;同等智能水平下价格仅为海外模型的 1/20 至 1/60。

  全面开源:同步开放 Pro/Flash 模型权重、技术报告、7k+ 高质量 RL 任务环境、端到端 RL 训练框架及 mini-harnesses 工具集,覆盖软件工程、漏洞复现等四类智能体任务。

  同步上线配套:MiMo Desktop 桌面客户端正式版与 Pro 的 UltraSpeed 超高速模式(最高 20 倍推理速度)同步上线,支持 Windows 与 Mac。