【什么是世界模型? 】
相比大语言模型相对成熟的模型架构和技术范式,世界模型仍属于前沿探索领域。阿里的HappyOyster与谷歌的Genie 3同属于世界模拟器流派。区别在于传统文生视频模型采用输入提示词、等待渲染、获得成片的被动流程,而这一流派采用长时间跨度上的世界演化建模方式。通过学习海量长视频数据,以及文本、动作指令、图像参考等多样控制信号,模型能够主动理解空间、物理与因果规律,预测情节和画面的演变,从而把“被动生成内容”转变为“主动模拟世界演化”,为构建可交互的通用世界模拟器提供了关键技术路径
HappyOyster基于原生多模态架构而建,支持多模态理解与音视频联合生成。现在可以实现漫游(Wander)和导演(Direct)两大核心能力,实时构建可互动、可演绎、可探索的AI数字世界。同时,用户生成的数字世界,不仅能被完整保存,还能开放给其他用户进行二次创作。
阿里的#HappyOyster#(快乐生蚝)是ATH创新事业部团队研发,与此前爆火的#HappyHorse#也是出自这团队,再次说明了阿里的AI团队的深度,大公司有钱有资源可以多条并行线去探索不同路线,这次阿里的成果反应在了股价上,最近一周涨了10%。
发布于 广东
