#Grok 4.6的三大训练细节#
1️⃣更长的补充训练:让模型在已有知识上反复“复盘思考”,把基础打透,不盲目学新东西。
2️⃣更优的学习素材:用Grok 4.5自己生成的推理轨迹当教材,实现“自我对弈式”进化。
3️⃣更强的强化学习:在编程、Web开发、CAD等复杂任务上大规模强化训练,专啃硬骨头。
产生的效果👇
效率碾压:完成复杂任务只需53轮交互+5亿Token,竞品平均要103轮+20亿Token。
自主性飙升:APEX-Agents测试得分从47.1%→57.5%,多步骤任务更稳了。
不砸钱也能提性能,Grok 4.6提供了新的解题思路!#AI创造营##科技先锋官#
发布于 山西
