商汤大装置助力智象未来实现视频生成业务向国产算力无感迁移

2026/08/28 12:09阅读量 2

商汤大装置与智象未来合作,成功将HiDream系列视频生成模型迁移至国产算力环境,实现了从适配验证到规模商用的闭环。通过LightX2V多卡并行优化、异构硬件抽象及FDE专家服务,在保持生成效果一致性的同时,使多卡加速比达到93%,并支持10余种芯片的零成本迁移。该实践为多模态大模型的国产化部署提供了可复用的技术样板。

事件概述

针对国产算力从“适配验证”迈向“真实生产”的行业痛点,商汤大装置(SenseCore)与AI企业智象未来(HiDream.ai)以视频生成业务为切入点,完成了全栈技术适配。双方通过底层算力替代、推理框架优化及工程专家服务,跑通了国产算力支撑视频生成规模化应用的完整链路,解决了参数规模大、推理链路长带来的落地挑战。

核心技术与性能突破

1. 极致性能优化:加速比达93%

  • 训练-推理联合优化:基于LightX2V框架,采用步数蒸馏和CFG(Classifier-Free Guidance)蒸馏方案,在维持视频质量的前提下显著提升推理速度。
  • 多层次并行策略:引入CFG双分支并行、Ulysses序列并行及TP(Tensor Parallelism)并行,对计算任务进行拆解与协同调度,提升多卡资源利用率。
  • 成果:在国产芯片运行DiT(Diffusion Transformer)模型场景下,多卡并行视频生成加速比达到93%,有效释放国产算力性能。

2. 生成效果一致性保障

  • 特征对齐:针对多卡推理中可能出现的人物表情等细微差异,团队通过重新注入Face特征等方式,强化多卡通信过程中的特征一致性,使多卡生成效果向单卡效果对齐。
  • 细节修复:排查并解决长视频尾帧手指等细节模糊问题,通过补齐和优化推理过程,改善长视频生成的细节表现。

3. 异构芯片零成本迁移能力

  • 统一硬件抽象体系:构建包含异构硬件初始化、统一设备抽象层、Registry调度工厂及硬件算子插件的抽象层,屏蔽底层硬件差异。
  • 广泛兼容性:实现“一次开发,多平台适配”,目前已支持10余种异构国产芯片上的模型零成本迁移。
  • 工具链兼容:完成ComfyUI等主流AI开发工具的生态适配,用户无需改变原有工作流即可在国产算力平台进行应用开发与部署。

服务模式与业务落地

  • FDE专家服务模式:商汤大装置提供Forward Deployed Engineer(前置部署工程师)服务,专业工程团队深入智象未来业务现场,覆盖模型迁移、算子优化、效果调优及工具链适配全流程,降低AI企业的额外人力与时间成本。
  • 规模化应用验证:目前,智象未来的图像模型已完成国产算力适配验证,并支撑其线上流量及短视频创作的规模化运行。此次合作验证了“底层异构算力+统一抽象体系+性能效果优化+FDE服务”的可复用路径,推动国产算力从“能用”向“好用”演进。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。