icon

Multi-modal Situated Reasoning in 3D Scenes

msr3d.github.io
A large-scale multi-modal situated reasoning dataset, scalably collected leveraging 3D scene graphs and vision-language models (VLMs) across a diverse range of real-world 3D scenes.
关键词:3D Scene Understanding, Situated Reasoning
立即前往 返回首页