#1
当前簇头 · 第 1 任独立事件二手报道
浙江大学团队提出Beyond Pixels:视频DiT隐变量直接生成动态4D场景
浙江大学等机构研究人员提出Beyond Pixels框架,直接将视频DiT最终去噪隐变量转换为动态4D场景,跳过RGB解码与独立重建;框架仅用约1K条重建视频训练,同一检查点可接入三种Wan模型。该方法为视频生成模型连接4D重建提供统一接口,并可继承运动、外观和轨迹控制能力,但依赖共享VAE规范,现有指标也不等同于度量级4D精度。
去重判断LLM 复核 · 独立事件
在 CozeLoop 查看判断 簇级候选:5 个已有簇, 共 5 条代表。
最终结果已修正为“独立事件”,以当前持久化状态为准。