机器之心highconfig v23

生数科技发布实时交互视频生成模型 Vidu S1

摘要与判断

生数科技正式发布实时交互视频生成模型 Vidu S1,实现语音实时控制、无限时长连续生成及最高 42FPS 的实时交互,并支持在消费级显卡上运行。该模型采用自回归扩散技术路线,用户仅需单张图片即可创建数字人,并能通过语音指令实时打断或控制角色动作。目前 Vidu S1 已开放测试与 API,同时开源了多项推理优化技术。这一突破将视频生成从离线成片推向实时交互阶段,有望大幅降低 AI 陪伴与互动直播等场景的落地门槛。

Topics

引用和原文

Trace

Raw Item
raw_ee74d40eb63b415b
Processed Item
processed_b10bce80a1dd4d6f
Source
manual_wechat_mp
Cluster
未归簇
LLM Logs
llm_6db2a135f76742f2
Coze Loop
202bdc31dff11e73fd93e6da12c9ab37