生数科技发布 Vidu Q4 Preview:主打高表现力与低创作成本
2026/10/08 17:04阅读量 4
生数科技推出新一代视频生成模型 Vidu Q4 Preview,定位为“高表现力旗舰模型”,重点提升人物演技、镜头张力及复杂特效能力。该版本支持最多15张参考图、3段音频输入及2K/4K超清输出,起价低至0.09元/秒。实测显示其在微表情反应、多机位运镜及物理交互特效方面表现显著,但仍处于预览优化阶段。
事件概述
生数科技(Shengshu Technology)正式开放 Vidu Q4 Preview 的访问权限。作为新一代视频生成模型的预览版本,Vidu Q4 被官方定义为“高表现力旗舰模型”,旨在通过更低的成本提供具备电影级演技、镜头张力和复杂特效的视频生成能力。
核心功能与参数
- 参考生视频能力升级:支持最多 15 张参考图、3 段参考音频,并可选配 2K 或 4K 超清输出。
- 成本控制:面向创作者推出预览版,生成成本低至 0.09 元/秒,允许用户进行低成本的多轮试错和风格探索。
- 访问方式:用户可通过 Vidu 官网体验,目前新用户注册可获得 500 积分奖励。
实测表现分析
根据早期测试反馈,Vidu Q4 Preview 在以下三个维度表现出显著进步:
-
人物演技与微表情:
- 模型能够捕捉角色从听到信息到产生情绪反应的细微过程(如眼神变化、停顿),而不仅仅是静态表情。
- 在克制型表演中状态稳定,但在剧烈情绪转折(如从笑到哭)的节奏自然度上仍有优化空间,符合 Preview 版本的迭代特征。
-
镜头语言与叙事逻辑:
- 运镜不再仅为运动而运动,而是服务于叙事。例如在模拟《奥德赛》逃生场景中,镜头能清晰展现巨物对光照的影响及危险解除后的场景转换。
- 支持复杂的组合运镜(跟拍、环绕、升降),主体稳定性较强,但在画面风格控制和部分细节幻觉问题上仍需改进。
-
复杂特效与环境交互:
- 特效不再是平面贴图,而是能与环境产生物理交互。例如在潮汐巨浪、爆炸和冰裂谷场景中,水流条纹、火光照明、烟雾遮挡视线等细节均得到体现。
- 动作戏中,模型能依据提示词呈现连贯招式,且较少依赖频繁切特写来掩盖位置逻辑错误。
值得关注
Vidu Q4 Preview 的核心价值在于降低了高质量视频创作的门槛。通过“参考生”技术的精细化迭代,创作者可以像导演一样,利用低成本优势进行多次试镜(生成不同表情、机位、特效版本),从而筛选出最佳镜头。这种模式改变了传统影视制作中高昂的试错成本结构,标志着 AI 视频生成从“单次生成”向“可控迭代”的工作流转变。
