WRC 2026|智象未来发布 HiDream-O1-World,原生全模态世界模型从模拟走向交互

2026/08/24 11:28阅读量 2

在世界机器人大会(WRC 2026)期间举办的物理AI论坛上,智象未来(HiDream.ai)创始人兼CEO梅涛发表演讲,并发布基于自研UiT架构的原生全模态交互式世界模型HiDream-O1-World,该模型首次参评即登顶WBench Navi分榜。梅涛认为,大模型IQ虽已接近140但不能等同于全能,真正的世界模型需要整合理解、生成与交互能力,并作为“数据—认知—行动—反馈”闭环的认知中枢,推动具身智能落地。

事件概述

8月19日,世界机器人大会(WRC 2026)期间,“物理AI引领者论坛暨2026《财经》中国AI 100榜单启动仪式”在北京举行。智象未来(HiDream.ai)创始人兼CEO梅涛发表题为《原生全模态世界模型:从“模拟世界”到“交互世界”》的演讲,提出大模型正在从多模态走向原生全模态、从模拟世界走向交互世界,并发布原生全模态交互式世界模型HiDream-O1-World。

核心观点

  • 梅涛援引数据称,顶级大模型的IQ水平已从年初约130提升至接近140,但他强调“高IQ不等于全能”:擅长考试并不意味着能在真实物理世界中长期、稳定、可靠地完成任务,这正是Physical AI的价值所在。
  • 大语言模型擅长理解、知识压缩与推理,多模态模型擅长生成与预测,具身交互模型擅长与环境交互;真正的世界模型需要同时具备对世界状态的完整表达、对物理规律和因果关系的推演,以及对世界的重构能力。
  • 文本、多模态与具身三条技术路线正加速融合,2026年被许多人称为“世界模型元年”。

模型与架构

HiDream-O1-World基于自研UiT(Unified Transformer)架构,支持文本、图像和交互式操控等多模态输入,具备漫游、编辑、交互三项核心能力,可构建高还原真实空间,也能生成二次元卡通、3A游戏渲染等风格化世界。该模型首次参评即在权威榜单WBench中登顶Navi分榜。

其关键技术突破在于长时程的时空一致性与物理一致性:模型能在长时序交互中记住已探索的场景结构,并在复杂交互中保持较高物理合理性。应用方向上,HiDream-O1-World面向AI互动影游、具身智能高保真虚拟训练、3D场景生成等场景,可缩短从创意到成品的迭代路径。

数据—模型—智能体—具身闭环

梅涛认为,世界模型与具身智能的发展需要把数据、世界模型、智能体和具身本体连接起来:数据构建认知,世界模型负责理解世界状态并推演物理规律,智能体基于预测进行决策和规划,具身本体完成真实执行,环境反馈再回流为新的训练数据,形成“数据—认知—行动—反馈”的闭环飞轮。

数据底座包含互联网先验数据、仿真物理试错数据、真实交互数据三类。智象未来目前已积累近千万小时时长的视频数据。以与诺亦腾机器人的合作为例,利用原生全模态大模型对真实采集的人体动作数据进行增强,可以生成同一动作在不同背景、场景和肤色下均符合物理约束的视频,从而降低真实数据采集成本,让机器人先在仿真环境中学习,再到真实环境中操练。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。