随着人工智能技术和可穿戴设备的快速发展,第一视角视觉理解逐渐成为一个新兴且具有挑战性的研究方向,并日益受到学术界和产业界的广泛关注。第一视角视觉通过佩戴在人体上的摄像头或传感器采集视觉及多模态数据,提供了一种能够模拟人类视觉体验的独特视角。本文对第一视角视觉理解相关研究进行了全面综述,系统分析了第一视角场景的组成,并将相关任务划分为四个主要方向:主体理解、对象理解、环境理解以及混合理解。我们进一步对每个方向下的具体子任务进行了详细梳理,并总结了该领域当前面临的主要挑战与发展趋势。此外,本文还概述了若干高质量的第一视角视觉数据集,为未来研究提供了重要的数据资源参考。通过总结该领域的最新进展,本文展望了第一视角视觉技术在增强现实、虚拟现实以及具身智能等领域的广泛应用,并结合当前研究的发展提出了未来的研究方向。http://t.cn/AXf3lHkE #机器学习[超话]##人工智能[超话]##视觉理解##具身智能#
发布于 北京
