影眸发布WorldGen:3D生成迈入可交互场景级时代
2026/09/03 18:18阅读量 2
3D头部玩家影眸Hyper3D正式发布世界生成模型WorldGen,实现从单资产生成向完整、可编辑3D场景生成的跨越。该模型基于SIGGRAPH最佳论文技术CAST构建,能将单张图片在2-3分钟内转化为具备物理属性和空间关系的独立资产集合。WorldGen已打通游戏开发、具身智能仿真及影视制作等生产管线,标志着3D AI正式进入场景级应用阶段。
事件概述
3D生成领域头部企业影眸Hyper3D正式发布世界生成模型 WorldGen。该模型突破了传统3D生成仅能输出孤立资产的局限,实现了从“造物”到“造世界”的升级,能够根据单张输入图片,快速生成包含多个独立、可交互且具备物理属性的3D场景。
核心技术与流程
WorldGen的技术基座源自影眸此前凭借自研技术 CAST 获得的国际图形学顶会 SIGGRAPH 2025 最佳论文(同期获奖商业公司仅有谷歌和Meta)。针对场景生成中常见的遮挡补全、物理一致性错误级联等问题,团队经过近一年的工程化优化,解决了多模块串联导致的误差累积问题。
其核心生成流程如下:
- 对象拆解与深度估计:将输入图像解析为对象清单及相对深度信息。
- 独立几何生成:对每个物体单独生成完整3D几何,利用遮挡感知机制补全不可见区域。
- 空间重组:估算旋转、平移和尺度,将物体放回统一空间,保持与原图构图一致。
- 物理校正:建立物体关系图(接触、支撑等),结合SDF进行物理纠错,防止穿透或悬空。
最终输出支持 SimReady模式,为每件资产补充碰撞体并估计质量、摩擦系数等仿真参数,整体生成耗时约2-3分钟。
行业应用落地
WorldGen定位为“可进入真实生产环境”的场景级工具,主要解决以下行业的痛点:
- 具身智能:替代高昂且危险的真实数据采集,以及耗时的人工仿真搭建。影眸已与地瓜机器人、谋先飞合作,形成从场景生成、MotrixSim引擎仿真到策略验证的闭环;同时作为NVIDIA Inception成员,推动整个场景接入Isaac Sim生态。
- 游戏开发:前置关卡设计环节。策划可直接检查动线,设计师可移动或替换道具,生成的独立资产可直接导入Blender、Unity、Unreal Engine等引擎进行二次创作。影眸已与Unity中国达成合作。
- 影视制作:作为可控的3D基底,结合视频生成模型(如Seedance 2.5)提升画面质量。导演可通过调整3D场景中的物体位置(如移动苹果)来精确控制镜头调度,再交由视频模型渲染,实现风格化输出。
- XR与空间计算:将普通照片转化为可进入、浏览和调整的沉浸式空间,适用于室内设计、教育展示等场景。
战略意义
WorldGen改变了AI 3D的基础交付单位,从“单个生成好的物体”变为“初步搭建完成的场景”。虽然距离最终成品仍有差距,但它为专业创作者提供了可编辑、可复用的起点,填补了3D生成落地过程中的“场景级缺口”,推动3D生成技术真正融入主流生产管线。
