投资界 10小时前
「PrimalVerse」(元昊动力)完成数亿元种子轮融资,清华背景团队打造4D世界模型基模
index.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

PrimalVerse(元昊动力)是一家专注于第五代多模态 4D 世界模型基模研发的 AInative 公司,由清华背景的顶尖世界模型团队创立。公司以原生 4D 世界表征为核心,构建覆盖动态世界重建、生成、仿真与智能体训练的统一模型体系,并率先在具身智能、游戏影视、自动驾驶、医疗手术等场景中推进应用,致力于打造物理 AI 时代的通用世界模型基座。投资界(ID:pedaily2012)7 月 23 日消息,近日,  4D 世界模型公司「PrimalVerse」(元昊动力)宣布完成数亿元种子轮融资,由联想之星、银杏谷资本、啟赋资本、卓源亚洲等知名财务投资机构联合参与,手术机器人领域头部产业方精锋医疗战略投资。据悉,本轮融资将主要用于   4D   世界模型基模研发及团队扩充,并持续推进其在具身智能、游戏影视、自动驾驶、医疗手术等垂直场景中的应用验证。

大语言模型让 AI 学会了预测下一个词,视频模型让 AI 开始预测下一帧画面。但随着 AI 深入机器人、自动驾驶等真实物理世界的场景,模型需要进一步回答:一次行动之后,世界将发生什么?回看基础模型的发展,第一代以   GPT 等语言大模型为代表,主要解决语言理解、推理与对话(文本 Token );第二代融合了图像 Token 和文本 Token ,以 Nano Banana 、 GPT Image2.0   为代表,实现图文理解与图像生成;第三代以   Sora 、Seedance 等为代表,引入了视频 Token ,开始处理时间动态与动作连续性。前三代模型主要建模语言与二维视觉内容,尚未真正进入三维物理世界。而第四代带有   3D   token   的原生多模态大模型将开始表示几何结构和物理属性;下一阶段,基础模型需要进一步把空间、时间、物理规律与动作交互纳入统一表征。

基于这一判断,PrimalVerse 团队提出:第五代多模态大模型,将是以原生 4D World Token 为核心的世界模型基模( 4D = 3D + 时间)。4D World Token 可以理解为模型理解物理世界的 " 新语言 " :它不只记录某一帧画面,还需要持续表示场景中的物体是什么、位于哪里、如何运动、具备何种材质和物理属性,以及在动作作用下将如何变化。当语言、图像、视频、3D/4D 世界状态能够在同一模型中联合训练,AI 学习的将不再只是世界的视觉表象,而是世界本身的结构、规律与动作后果。模型也将从 " 生成一段视频 " ,进一步走向 " 运行和推演一个世界 " 。 

PrimalVerse 创始人表示:"   4D 不是世界模型的一项附加能力,而是物理世界本身的基本表达。世界模型的第一性问题,是能否准确刻画世界从一个状态走向下一个状态,而这需要同时理解空间、时间、物理属性与交互关系。我们相信,判断模型是否真正理解物理世界,最终应当与 4D 表征对齐;只有先构建出原生 4D 世界模型,才能为不同技术路径提供统一、可信的物理世界基准。"

PrimalVerse 希望直接从底层构建原生 4D 世界状态,在统一模型中同时学习空间、时间、物理与交互,并将几何、材质、运动、接触和物理属性纳入状态变化过程,定义真正面向物理 AI 的 4D 世界模型范式。

PrimalVerse 核心团队来来自清华、北大、上海交大等顶尖高校,长期深耕   4D 世界模型关键技术,已经在 4D 世界模型的各个核心环节形成国际领先成果。

据悉,未来 PrimalVerse 将从垂直场景中的训练、仿真和内容生产需求切入,逐步构建跨场景、跨行业迁移的通用 4D 世界模型,成为物理 AI 理解、训练和推演世界的基础模型入口。

文章来源:投资界

原文地址:https://news.pedaily.cn/202607/566755.shtml

【本文根据公开消息发布,不构成任何投资建议。市场有风险,投资需谨慎。】

如有异议,请联系(editor@zero2ipo.com.cn)投资界处理。

评论
大家都在看