PrimalVerse(元昊动力)是一家专注于第五代多模态4D世界模型基模研发的AInative公司,由清华背景的顶尖世界模型团队创立。公司以原生4D世界表征为核心,构建覆盖动态世界重建、生成、仿真与智能体训练的统一模型体系,并率先在具身智能、游戏影视、自动驾驶、医疗手术等场景中推进应用,致力于打造物理AI时代的通用世界模型基座。投资界(ID:pedaily2012)7月23日消息,近日, 4D世界模型公司「PrimalVerse」(元昊动力)宣布完成数亿元种子轮融资,由联想之星、银杏谷资本、啟赋资本、卓源亚洲等知名财务投资机构联合参与,手术机器人领域头部产业方精锋医疗战略投资。据悉,本轮融资将主要用于 4D 世界模型基模研发及团队扩充,并持续推进其在具身智能、游戏影视、自动驾驶、医疗手术等垂直场景中的应用验证。
大语言模型让 AI 学会了预测下一个词,视频模型让 AI 开始预测下一帧画面。但随着 AI 深入机器人、自动驾驶等真实物理世界的场景,模型需要进一步回答:一次行动之后,世界将发生什么?回看基础模型的发展,第一代以 GPT 等语言大模型为代表,主要解决语言理解、推理与对话(文本 Token );第二代融合了图像 Token 和文本 Token ,以 Nano Banana 、 GPT Image2.0 为代表,实现图文理解与图像生成;第三代以 Sora 、Seedance 等为代表,引入了视频 Token ,开始处理时间动态与动作连续性。前三代模型主要建模语言与二维视觉内容,尚未真正进入三维物理世界。而第四代带有 3D token 的原生多模态大模型将开始表示几何结构和物理属性;下一阶段,基础模型需要进一步把空间、时间、物理规律与动作交互纳入统一表征。
基于这一判断,PrimalVerse 团队提出:第五代多模态大模型,将是以原生 4D World Token 为核心的世界模型基模( 4D = 3D +时间)。4D World Token 可以理解为模型理解物理世界的 “新语言” :它不只记录某一帧画面,还需要持续表示场景中的物体是什么、位于哪里、如何运动、具备何种材质和物理属性,以及在动作作用下将如何变化。当语言、图像、视频、3D/4D 世界状态能够在同一模型中联合训练,AI 学习的将不再只是世界的视觉表象,而是世界本身的结构、规律与动作后果。模型也将从 “生成一段视频” ,进一步走向 “运行和推演一个世界” 。
PrimalVerse 创始人表示:“ 4D 不是世界模型的一项附加能力,而是物理世界本身的基本表达。世界模型的第一性问题,是能否准确刻画世界从一个状态走向下一个状态,而这需要同时理解空间、时间、物理属性与交互关系。我们相信,判断模型是否真正理解物理世界,最终应当与4D表征对齐;只有先构建出原生4D世界模型,才能为不同技术路径提供统一、可信的物理世界基准。”
PrimalVerse 希望直接从底层构建原生 4D 世界状态,在统一模型中同时学习空间、时间、物理与交互,并将几何、材质、运动、接触和物理属性纳入状态变化过程,定义真正面向物理AI的4D世界模型范式。
PrimalVerse 核心团队来来自清华、北大、上海交大等顶尖高校,长期深耕 4D 世界模型关键技术,已经在 4D 世界模型的各个核心环节形成国际领先成果。
据悉,未来PrimalVerse将从垂直场景中的训练、仿真和内容生产需求切入,逐步构建跨场景、跨行业迁移的通用4D世界模型,成为物理AI理解、训练和推演世界的基础模型入口。
文章来源:投资界
原文地址:https://news.pedaily.cn/202607/566755.shtml
如有异议,请联系(editor@zero2ipo.com.cn)投资界处理。





