实测全球上线的 vivago R1:从赛博短片到资产沉淀,AI视频进入完整作品交付阶段

2026/09/08 21:40阅读量 2

智象未来(HiDream.ai)发布的全球首个无限时长内容创作智能体 vivago R1(国内版「够搭」)已正式上线。该工具采用对话式创作路线,用户可通过自然语言完成从故事、脚本到成片的全流程生成,并具备稳定的视觉一致性控制能力。实测显示,其在长视频连贯性、商业广告制作及网络热梗理解上表现优异,并通过“资产库”功能实现创作素材的沉淀与复用,标志着AI视频从单镜头生成向完整作品生产流程的转变。

事件概述

智象未来(HiDream.ai)在2026世界人工智能大会(WAIC)期间发布的全球首个无限时长内容创作智能体 vivago R1(国内版本名为「够搭」)现已正式全球上线。该产品定位为对话式创作 Agent,旨在解决普通人制作完整视频作品的门槛问题,推动AI视频从生成单个惊艳镜头向稳定、可交付的完整内容生产流程演进。

核心信息与实测表现

1. 对话式创作与全流程自动化
不同于需要用户自行搭建工作流的节点式工具,vivago R1 采用对话式交互。用户只需输入自然语言创意,Agent 即可自动匹配导演角色(如 Cinematic Story Director 或 Story Ad Director),完成从故事构思、脚本撰写、分镜设计到角色设定、镜头生成及最终成片输出的全流程。

  • 协作机制:系统通过 Chat(聊天窗口)承接意图并调用素材,同时利用画布(Canvas)结构化呈现脚本、分镜和视频资产,方便用户查看进展和比较结果。
  • 长视频稳定性:R1 是首个可稳定生成 3 至 5 分钟视频的 Agent。在测试中,其能够保持跨场景的视觉风格统一(如冷蓝色赛博世界与暖金调真经力量的对比),并在多镜头间维持角色形象(如赛博僧袍悟空)的高辨识度,解决了以往AI视频容易出现的风格跳变和逻辑断裂问题。

2. 复杂语义理解与商业应用潜力

  • 网络热梗还原:在面对包含谐音梗和情感暗示的复杂指令时,R1 能结合 Websearch 检索梗的来源,并生成具有情感转折和原创角色的视频,展现了较强的语义理解和编排能力。
  • 商业广告制作:在社媒广告测试中,仅需提供人物照片、产品包装和 Logo,R1 即可生成保持人物形象和产品连续性的高质量广告视频,显示出降低品牌制作成本、缩短修改周期的商业价值。

3. 数字资产库与 SkillHub
除了直接生成内容,R1 推出了 SkillHub 预设功能模块,降低用户理解AI能力的成本。更重要的是,它引入了资产库积累功能

  • 区别于普通收藏,资产库沉淀的是用户在产品内生成、筛选并认可的内容(如特定穿搭风格、动漫形象、场景素材)。
  • 这些资产可在后续创作中直接调用,使单次创作成为下一次创作的素材基础,形成可持续的数字资产闭环。

技术背景与行业意义

技术架构
vivago R1 背后是智象未来自主研发的 HiDream-O1 系列大模型。该模型采用原生全模态 UiT(Unified Transformer)架构,将图像像素、文本 Token、视频体素等原始信号映射至统一 Token 空间,减少了传统模型中 VAE 压缩导致的细节损失,从而提升了生成质量和对多模态信息的理解能力。

行业定位
当前AI视频领域存在两条路线:一是将模型和参数交给专业用户自行调试;二是像 R1 一样,将专业创作者的经验融入 Agent 编排,提供低门槛、高稳定性的交付体验。R1 的出现表明,AI视频的核心竞争力正从单纯的模型能力展示,转向能否将创意稳定组织为完整作品的能力。目前,该产品已支持 CLI 命令行交互,面向开发者和专业团队开放更高阶的使用方式。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。