围绕机器人策略如何进一步突破模仿学习的数据边界,中国科学院自动化研究所、中关村学院与中科慧灵团队开展研究,提出面向机器人操作的策略优化框架 World4RL(Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation)。此次研究基于各方在具身智能学习与机器人操作方向的深度合作,进一步探索世界模型与强化学习结合下的机器人策略持续优化路径。#中科慧灵# #具身智能# #人形机器人# http://t.cn/AX0jY8Pn
发布于 北京
