智象未来发布vivago R1:AI视频创作迈入5分钟“单反级”交付时代

2026/09/10 18:43阅读量 2

2026年9月8日,智象未来(HiDream.ai)旗下内容创作智能体vivago R1全球上线,国内版本「够搭」同步升级。该模型支持一次性稳定输出5分钟高质量视频并无限延长,标志着AI视频从片段生成向完整作品交付的范式跃迁。通过“基础模型+智能体”双轮驱动及CHATS™评估标准,R1显著提升了长视频的角色一致性、叙事连贯性及制作确定性。

事件概述

2026年9月8日,智象未来(HiDream.ai)正式面向全球用户开放其内容创作智能体 vivago R1,国内版本 「够搭」 全新升级。作为全球首个无限时长内容创作智能体,R1 实现了从“生成片段”到“完全交付作品”的技术跨越,旨在让普通创作者也能独立完成专业团队级的品质大片,标志着 AI 视频创作进入“单反级交付时代”。

核心技术与能力突破

1. 时长与稳定性飞跃

  • 无限时长生成:相较于行业主流的 15-30 秒片段式生成,R1 能够一次性稳定输出 5 分钟 的高质量视频,并支持无限次多轮延长。
  • 高成功率:依托自研 HD-AgentOS 的全流程调度与治理能力,R1 的内容有效可用成功率提升至 85%,显著降低了传统 AI 视频生成的“抽卡”概率和返工成本。
  • 质感优化:优化了跨镜头角色一致性和场景过渡自然度,弱化了常见的“塑料感”和“瞬移感”,实现了更自然的运镜衔接与音画对齐。

2. Chat-First(对话优先)创作模式

  • 自然语言交互:摒弃复杂的节点式或画布式工作流,用户仅需通过自然语言描述需求,即可自动生成视频并在对话中持续调整迭代。
  • Agent 编排逻辑
    • 主 Agent:拆解创意目标。
    • 子 Agent:协同完成脚本、分镜、角色、场景与音效。
    • SkillHub:将抽象 AI 能力转译为具体场景(如产品广告、故事短片),自动匹配并编排所需技能组合,将用户意图转化为可执行任务序列。

3. 原生全模态基础架构

  • 双轮驱动战略:结合“基础模型 + 智能体系统”。
    • 基础模型:提供多模态理解与生成能力,将文本、图片、视频、参考资产等纳入同一任务语境,确保 Agent 理解“任务全貌”。
    • 智能体系统:负责将模型能力组织为可持续推进的创作流程,确保复杂叙事中角色形象、声音特征和风格的前后一致。
  • 资产库功能:沉淀用户生成、筛选并认可的内容,使其成为后续创作的素材基础,实现从“一次性输出”到“项目制持续创作”的转变。

行业标准:CHATS™ 评估框架

智象未来提出了一套面向视频 Agent 的交付标准 CHATS™,用于衡量产品的真正作品交付能力:

  • C (Consistency) 一致性:角色、场景、风格在多镜头中保持稳定。
  • H (Human Intent) 意图理解:准确理解用户创意,并能在多轮对话中持续推进。
  • A (Audio & Visual) 视听完整度:不仅生成画面,也能组织声音、节奏与整体视听体验。
  • T (Timeline & Tale) 时间线与叙事:让故事在多个镜头、多个段落中持续成立。
  • S (Stability) 稳定交付:降低反复生成和返工成本,提高内容可用率。

市场表现与应用案例

  • 用户规模:vivago.ai 于 2024 年 5 月上线,两年内全球用户突破 7000 万。今年 5 月曾登顶 Product Hunt 日榜第一。
  • 实战案例
    • 影视改编:创作者利用 R1 生成近 5 分钟的《西游记》题材作品,展现了经典文本的视觉转译能力。
    • 真人质感:生成励志短片,细腻还原人物肌肉震颤、汗水光泽及环境颗粒感,提升情绪真实度。
    • 商业广告:成功制作红色折叠手机广告,精准呈现产品多视图、人物造型及生活场景,适配商业品牌内容需求。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。