新浪网·
汽车
本地生活
旅游
数码
娱乐
影视
七月具身July
26-01-03 21:36
微博认证:北京七月在线科技有限公司 创始人
《PLD——自我改进的VLA:先通过离策略RL学习一个轻量级的残差动作策略,然后让该残差策略收集专家数据,最后蒸馏到VLA中》
http://t.cn/AXbLJAlZ
发布于 湖南