VIVAS: Vitalizing Visual Perception in VLM Pre-training via Vision-language Unified Autoregressive Supervision
Zhehan Kan ⋅ Yubo Zhu ⋅ Xinghua Jiang ⋅ Zhixiang Wei ⋅ Shifeng Liu ⋅ Wei Tong ⋅ Sheng Zhong ⋅ Qingmin Liao ⋅ Wenming Yang ⋅ Xin Li ⋅ Yinsong Liu ⋅ Deqiang Jiang ⋅ Xing Sun
Successful Page Load