这个结论如果成立,对自动驾驶模型是个天大的好消息
我用更多的数据量去训练一个小模型,它的能力居然可以跟一个低数据量训练的大模型差不多,而小模型的推理成本更便宜,反应速度更快,实际上是更有优势的
按照新势力各家的自研芯片来看,自动驾驶模型跑在 5~7B 上应该没有什么太大的问题
那么保持这个规模不变,维持足够高的 token 吞吐率,但是大幅度增加模型训练学习到的数据量,性能提升跟主要参数量差不多,那就很赚了
发布于 广东
