S-VAM: Shortcut Video-Action Model by Self-Distilling Geometric and Semantic Foresight
Haodong Yan ⋅ Zhide Zhong ⋅ Jiaguan Zhu ⋅ Junjie He ⋅ Weilin Yuan ⋅ Wenxuan Song ⋅ Xin Gong ⋅ Yingjie CAI ⋅ Guanyi Zhao ⋅ Xu Yan ⋅ Liu Bingbing ⋅ Yingcong Chen ⋅ Haoang Li
Successful Page Load