返回簇列表
多源确认簇行为开启Mongo 实时数据

浙江大学团队提出Beyond Pixels:视频DiT隐变量直接生成动态4D场景

浙江大学等机构研究人员提出Beyond Pixels框架,直接将视频DiT最终去噪隐变量转换为动态4D场景,跳过RGB解码与独立重建;框架仅用约1K条重建视频训练,同一检查点可接入三种Wan模型。该方法为视频生成模型连接4D重建提供统一接口,并可继承运动、外观和轨迹控制能力,但依赖共享VAE规范,现有指标也不等同于度量级4D精度。

成员
1
换头
0
最近活动
08/19 17:09:30
CONTENT GOVERNANCE

内容治理

在线

下线会立即隐藏 Defomo 内容,并联动撤回 Elys 全部 Feed、详情和分享入口;恢复不会补推历史 Feed。 本操作覆盖整个事件簇及未来新成员。

MEMBERS

簇内帖子

按进入簇的先后排序 · duplicate 不隐藏
#1
当前簇头 · 第 1 任独立事件二手报道

浙江大学团队提出Beyond Pixels:视频DiT隐变量直接生成动态4D场景

浙江大学等机构研究人员提出Beyond Pixels框架,直接将视频DiT最终去噪隐变量转换为动态4D场景,跳过RGB解码与独立重建;框架仅用约1K条重建视频训练,同一检查点可接入三种Wan模型。该方法为视频生成模型连接4D重建提供统一接口,并可继承运动、外观和轨迹控制能力,但依赖共享VAE规范,现有指标也不等同于度量级4D精度。

新智元来源权威 2 级(1 级最高)发布于 08/19 16:28:14原帖 内容详情
去重判断LLM 复核 · 独立事件

簇级候选:5 个已有簇, 共 5 条代表

在 CozeLoop 查看判断
最终结果已修正为“独立事件”,以当前持久化状态为准。