Zeratulag-
26-08-18 20:39 微博认证:游戏博主

越看大模型的发展,越像在看一个人成长:

预训练像童年,大量读书背书,构建对世界的基本认知;
SFT像初中做选择和简答题,开始学习什么是“好的答案”;
RL像高中做大题,光知道答案不够,还要在反馈中找到更好的解题路径;
MoE像大学分专业,开始有所侧重,在训练中逐渐形成自己的专长;
Agent像进入职场,套上 Harness 成为牛马,从会做题演化到会做事,学会拆任务、用工具、看结果;
Multi-Agent像带团队,个人的能力终有上限,最终要靠分工和协作突破。

AI前沿技术一路往前走,竟然越来越像人生。

发布于 北京