机器之心highconfig v23
生数科技发布实时交互视频生成模型 Vidu S1
摘要与判断
生数科技正式发布实时交互视频生成模型 Vidu S1,实现语音实时控制、无限时长连续生成及最高 42FPS 的实时交互,并支持在消费级显卡上运行。该模型采用自回归扩散技术路线,用户仅需单张图片即可创建数字人,并能通过语音指令实时打断或控制角色动作。目前 Vidu S1 已开放测试与 API,同时开源了多项推理优化技术。这一突破将视频生成从离线成片推向实时交互阶段,有望大幅降低 AI 陪伴与互动直播等场景的落地门槛。
Topics
引用和原文
Trace
- Raw Item
- raw_ee74d40eb63b415b
- Processed Item
- processed_b10bce80a1dd4d6f
- Source
- manual_wechat_mp
- Cluster
- 未归簇
- LLM Logs
- llm_6db2a135f76742f2
- Coze Loop
- 202bdc31dff11e73fd93e6da12c9ab37