天方夜谭I丝路 25-06-06 11:42
微博认证:财经博主

6 月 6 日消息,北京智源人工智能研究院今日发布“悟界”系列大模型,包括全球首个原生多模态世界模型“悟界・Emu3”、全球首个脑科学多模态通用基础模型“悟界・见微 Brainμ”。智源研究院还发布了悟界・具身智能大模型,包括全球首个支持 MCP 的跨本体大小脑协作框架悟界・RoboOS 2.0、具身大脑大模型悟界・RoboBrain 2.0 和全原子微观生命模型悟界・OpenComplex2 也一并发布。

去年 10 月,智源研究院发布了原生多模态世界模型 Emu3。据IT之家此前报道,该模型只基于下一个 token 预测,无需扩散模型或组合方法,即可完成文本、图像、视频三种模态数据的理解和生成。官方宣称实现图像、文本、视频大一统。Emu3 支持多模态输入、多模态输出的端到端映射,验证了自回归框架在多模态领域的普适性与先进性,为跨模态交互提供了强大的技术基座。

发布于 浙江