WRC 2026|智象未来发布原生全模态世界模型HiDream-O1-World,从模拟世界走向交互世界

2026/08/24 13:04阅读量 2

在世界机器人大会WRC 2026期间的“物理AI引领者论坛”上,智象未来创始人兼CEO梅涛发表演讲,提出“高IQ不等于全能”,真正的世界模型需融合理解、预测与交互。公司发布基于自研UiT架构的原生全模态交互式世界模型HiDream-O1-World,已在WBench的Navi分榜登顶,并阐述了数据、世界模型、智能体与具身本体构成的闭环飞轮。

事件概述

8月19日,WRC 2026期间,“物理AI引领者论坛暨2026《财经》中国AI 100榜单启动仪式”在北京举行,论坛主题为“物理AI进行时”。智象未来(HiDream.ai)创始人兼CEO梅涛发表主旨演讲,围绕原生全模态世界模型展开,提出AI正从“理解世界”走向“改变世界”。

核心信息

高IQ不等于全能

梅涛提到,今年年初顶级大模型IQ约130,最新模型已接近140,但“高IQ不代表全能”。大语言模型擅长理解、知识压缩与推理,多模态模型擅长生成与预测,具身交互模型擅长与物理世界交互;真正的世界模型需要同时具备对世界状态的完整表达、对物理规律与因果关系的推演,以及对世界的重构能力。文本、多模态、具身三条独立路线正加速融合,2026年被视作“世界模型元年”。

从DiT到UiT:原生全模态架构突破

智象未来基于自研UiT(Unified Transformer)架构,发布原生全模态交互式世界模型HiDream-O1-World,首次参评即在权威榜单WBench的Navi分榜登顶。该模型支持文本、图像和交互式操控输入,具备漫游、编辑、交互三项核心能力,可还原真实空间,也能生成二次元、3A游戏渲染等风格化世界。其核心突破是长时程时空一致性与物理一致性:模型在长时序交互中能记住已探索场景结构,并在复杂交互中保持物理合理性。

应用方面,HiDream-O1-World可用于AI互动影游、具身智能高保真虚拟训练底座和3D场景生成,缩短创意到成品的迭代路径。智象未来计划以此为基础,完善覆盖图像模型、视频模型和交互式世界模型的模型矩阵。

数据-模型-智能体-具身:连接物理世界的闭环

梅涛将具身智能能力底座概括为“数据、世界模型、智能体和具身本体”的连接:数据构建认知,世界模型理解状态并推演物理规律,智能体基于预测做决策,具身本体执行动作,真实环境反馈再成为新训练数据,形成“数据—认知—行动—反馈”的闭环飞轮。世界模型是飞轮中的认知中枢。

底层数据包括互联网先验数据、仿真物理试错数据、真实交互反馈数据三类。智象未来已积累近千万小时视频数据。梅涛还以与诺亦腾机器人的合作为例:用原生全模态大模型对真实人体动作数据进行增强,可生成不同背景、场景和肤色下保持物理一致性的视频,降低真实数据采集成本,让机器人先在仿真中学习、再到真实环境执行。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。