这次上海出差,不仅考察了消费行业少有的时代增长机会,而且是非常优秀的生意模式。
还和米哈游、中金的ai首席讨教了不少AI大模型的发展趋势、前景、底层逻辑,ai主要拼资金(买卡训练),人(但是人员可以流通),算法(但大部分都是论文公开),数据(尤其是收敛过的而且有反馈的数据,这个后训练有些涉及,但主要是rl强化学习)。
美国sota前沿模型卡的用途来看,60%以上用来做实验(这对我很意外,也就是要实验很多论文的不同算法,居然占比这么大,但往后很多可以ai读论文,ai做实验,也就是拿ai来实验ai),20%-30%用来训练,剩下推理。
国内模型可以更大比例用来训练,而不是实验,简单来说,你如果是跟跑的,你可以模仿,而且这种方法最快[允悲],这就是为啥6个月可以赶上,但只要模型没到天花板,始终稳定6个月左右[允悲]。挺好,这种情况下,国内模型如果确定了目标方向,同时开卷考试,人员还能流动,买卡的决策,以及公司文化和融资能力就很关键。
让我对国内模型各领风骚几个月(甚至不到)有些底层理解。
保持耐心、理性,不意味着你不能有好奇心。好奇心的强弱是一种生命底层可贵的能量。
stay foolish, stay hungry。
发布于 上海
