GAP-MLLM: Geometry-Aligned Pre-training for Activating 3D Spatial Perception in Multimodal Large Language Models
Jiaxin Zhang ⋅ Junjun Jiang ⋅ Haijie LI ⋅ Youyu Chen ⋅ Kui Jiang ⋅ Dave Zhenyu Chen
Successful Page Load