WRC2026聚焦物理AI,智象未来发布原生全模态世界模型HiDream-O1-World
8月19日,2026世界机器人大会(WRC)在北京举行。作为大会的重要环节,由跨维智能主办、《财经》杂志协办的"物理AI引领者论坛"同期召开,吸引了众多具身智能领域的顶尖专家和企业代表。论坛以"物理A...
8月19日,2026世界机器人大会(WRC)在北京举行。作为大会的重要环节,由跨维智能主办、《财经》杂志协办的"物理AI引领者论坛"同期召开,吸引了众多具身智能领域的顶尖专家和企业代表。论坛以"物理AI进行时"为主题,围绕通用物理智能的技术演进与产业路径展开深入讨论。
在论坛上,智象未来(HiDream.ai)创始人兼CEO梅涛发表了题为《原生全模态世界模型:从"模拟世界"到"交互世界"》的主旨演讲。他指出,过去几年AI大模型的发展经历了从大语言模型到多模态模型,再到具身智能的演进过程。当前,这三条技术路线正在加速融合,2026年被认为是"世界模型的元年"。
梅涛博士强调,高IQ并不等同于全能。尽管最新大模型的IQ水平已接近140,但要在真实物理世界中长期稳定地完成任务,还需要构建能够表达世界状态、推演物理规律和因果关系,并具备持续交互能力的世界模型。
基于这一判断,智象未来近期发布了原生全模态交互式世界模型HiDream-O1-World。该模型支持文本、图像及交互式操控等多模态输入,具备漫游、编辑、交互三项核心能力,同时支持多种主体与风格化场景构建。从技术层面看,HiDream-O1-World的最大突破在于长时程的时空一致性与物理一致性,使模型能够在复杂交互中保持较高的物理合理性。
在应用层面,HiDream-O1-World正在打开全新的产业空间。在AI互动影游领域,用户可以成为叙事的主动参与者;在具身智能仿真方面,模型可搭建高保真虚拟训练底座;在3D场景生成领域,创作者能高效生成结构完整的3D空间,大幅缩短创意到成品的迭代路径。
梅涛博士进一步阐述了具身智能的能力底座,将关键关系概括为"数据—认知—行动—反馈"的闭环飞轮。其中,数据构建认知,世界模型负责理解世界状态、推演物理规律,智能体基于预测结果进行决策和规划,具身本体完成真实执行,而真实环境反馈又回流成为新的训练数据。这个闭环飞轮的核心正是世界模型,它相当于具身智能的"认知中枢"。
为了支撑这一闭环飞轮,智象未来积累了近千万小时的视频数据,包括互联网先验数据、仿真的物理试错数据以及真实交互数据。这些数据来源构成了世界模型的底层基础,使其能够在长时序交互中保持场景结构的一致性,并对物体运动和物理关系进行准确推演。
随着大语言模型、多模态模型与具身智能的加速融合,世界模型正在成为Physical AI从数字空间迈向真实物理世界的重要技术底座。梅涛表示,智象未来正围绕世界模型构建覆盖图像、视频以及交互式世界模型的产品矩阵,推动AI技术在真实场景中的规模化落地应用。