午后狂睡
26-08-23 14:35 微博认证:影评人 微博2022最具影响力互联网科技大V 科技博主

#人形机器人为什么一定要是人形#听完AIVA总裁、产品经理李博在2026世界机器人大会——火山引擎具身智能技术与应用论坛上的分享,我觉得有个问题越来越值得讨论:AI进入物理世界到底应该是什么样的形态?

最早我们提到具身智能,第一反应通常还是人形,两只手、两条腿,能走路、能搬东西、能在人的环境里完成各种任务,但是这两年似乎汽车也成了一个答案。

而且这不是只有李博一个人的判断,李想过去两年也反复强调过同样的观点,不过有意思的是虽然大家都走到了“车也是一种具身智能”这个结论,但推导路径却完全不同。

李想更多是从汽车的进化角度出发:当一辆车逐渐拥有完整的感知、决策和执行能力,它自然会越来越接近机器人。而李博则是从另外一个角度思考:如果AI要从数字世界进入物理世界,它需要一副什么样的身体?他的答案之一,就是汽车。

这其实很好理解。

汽车本身已经有能源、算力、摄像头、雷达、麦克风,以及转向、座椅、空调、灯光等大量执行结构。换句话说,AI需要的眼睛、耳朵和“手脚”,一辆现代智能汽车基本都有了。

如果AI最终的目的是为人服务,那么在现阶段大量高频的日常陪伴和出行场景里,汽车甚至可能比人形机器人更容易成为它的物理载体。

因为人型机器人需要先学很多东西,掌握开门、爬楼、端水、叠衣服、看护等各种实用技能才能有机会走近普通人的生活。而车不需要,人本来就会走进车里,每天通勤、接送家人、旅行、闲逛,普通人每天都可能和同一辆车相处几十分钟甚至几个小时。

更重要的是汽车还是一个相对稳定、传感器密集,又拥有充足能源和执行能力的封闭空间,所以对一个真正希望长期理解人、服务人的AI来说,汽车可能是目前最现实的物理载体之一。

这也就是AIVA观点的核心:“AI定义汽车,先有AI,再有车”。重点并不是往车里塞一个大模型,而是反过来思考:AI要怎么理解人、照顾人、和人交互,然后再决定这辆车应该拥有什么样的感知和执行能力。

拿AIVA的“灵动光眸”举例就相当直观了:如果灯光只是预设动画,它只是一个功能,只能机械地按照预设的东西去表达,但如果灯光的反馈来自AI对真实环境的感知和理解,它就开始成为AI与外部世界交互、表达自身的一种方式。

所以未来所谓的具身智能的形态表达,可能有很多种,人形是一种答案,四足是一种答案,汽车同样也可以是一种答案,真正重要的不是“像不像人”,而是它能不能感知现实、理解人的需求,并且真正为人做事。

从这个角度看,汽车可能不仅仅是一个被AI赋能的交通工具,就像手机曾经成为AI进入普通人日常生活的重要入口那样,汽车也会成为早期AI大规模进入现实生活的重要载体,比其他形态都要早很久。#世界机器人大会##被中国机器人的进化速度震惊到了#

发布于 江苏