生数科技旗下的 Vidu 平台发布了全新的 Vidu S1 实时交互视频模型,开创了视频生成的全新方向——从离线成片走向可对话、可响应、可持续在线的实时交互。
核心能力
Vidu S1 的核心能力包括:
- 语音实时控制:用户可以通过语音指令实时控制视频生成内容
- 无限长实时生成:支持持续生成,不受固定时长限制
- 540P (960×540) + 25FPS 实时交互:最高可支持 42FPS
- 自定义初始图像与音色:用户可以指定起始画面和声音风格
消费级显卡可运行
最令人意外的是,Vidu S1 的实时交互能力在 消费级显卡 上就能跑起来。这意味着不再是只有大公司才能玩转实时视频生成,个人开发者和小型工作室也能参与其中。
行业意义
Vidu S1 的出现标志着视频生成 AI 进入了一个新阶段:
- 从「生成一段视频」到「实时对话式创作」的范式转变
- 交互式视频生成将催生新的应用场景,如实时视频聊天、互动式内容创作等
- 消费级硬件门槛的降低将加速技术普及
来源:AITNT News