青稞Talk STream3R & 4RC: 面向几何与运动理解的流式前馈 3D/4D 重建 三维/四维重建技术正经历一场范式革命:从高昂的全局优化向高效的前馈式(Feed-forward)架构全面转型。 如何在长序列处理中实现极致的内存效率? 如何在统一框架下同时实现几何与运动的高精度建模? 5月19日晚8点,青稞Talk 126期,南洋理工大学(NTU)MMLab 博士生罗奕航,将直播分
青稞Talk 从 VGGT 到 PAGE-4D:动态世界中的 3D 感知统一框架 动态三维建模的统一框架旨在在时间维度上同时建模场景的几何结构与运动变化,实现对动态世界的完整理解与重建。 整体框架通常包括两个核心模块: 首先是感知与表示模块,从多视角图像或视频中提取空间与时间特征,并构建统一的动态场景表示,如隐式场、3D Gaussian 或体渲染表示; 其次是几何与运动建模模块
精选文章 MIT&Harvard新作 | PAGE-4D:让3D模型"看懂"动态世界的统一框架 视觉几何基础变换器(VGGT)在静态场景中表现优异,但在动态场景下面临固有矛盾:相机姿态估计需抑制动态区域,而几何重建则需建模动态信息。如何在统一框架下协调这一任务冲突? 来自MIT和Harvard的研究团队提出了PAGE-4D(Disentangled Pose and Geometry Esti
青稞Talk Free4D:无需微调的 4D 场景生成新框架 Free4D,是由华中科技大学、MMLab@NTU以及湾大的研究者最新提出的一种无需调整的新型框架,可用于从单个图像生成 4D 场景。 Paper:Free4D: Tuning-free 4D Scene Generation with Spatial-Temporal Consistency Ab