青稞Talk 青稞Talk预告!NTU MMLab 博士后许牧天:面向时空具身仿真的运动学 4D 世界建模 Kinema4D 在具身智能领域,模拟机器人轨迹至关重要。近期,研究者开始利用视频生成模型来进行模拟,但仍存在关键缺陷: (1) 维度缺失:局限于 2D空间,缺乏交互所需的 4D 时空约束; (2) 精度不足:依赖语言指令、隐式动作理解、或静态环境先验,使得模型需要去"猜测"潜在的机器人动作,难以提供精确控制和动态引
青稞Talk 从 VGGT 到 PAGE-4D:动态世界中的 3D 感知统一框架 动态三维建模的统一框架旨在在时间维度上同时建模场景的几何结构与运动变化,实现对动态世界的完整理解与重建。 整体框架通常包括两个核心模块: 首先是感知与表示模块,从多视角图像或视频中提取空间与时间特征,并构建统一的动态场景表示,如隐式场、3D Gaussian 或体渲染表示; 其次是几何与运动建模模块
青稞Talk MindCube:空间智能的实现路径,探究 VLMs 构建稳健空间心理模型的能力 李飞飞&谢赛宁空间智能新作!“认知地图+语言推理+RL优化”是逼近人类空间认知能力的有效路径 7月19日上午10点,青稞Talk 第64期,纽约大学访问学生尹柏乔和西北大学博士生王启能,将直播分享他们与李飞飞&谢赛宁等人合作的,在空间智能领域上的最新成果:MindCube,探讨空间智能可能的新路径。