@misc{indiciae22c3cff666fb, title = {HAT-4D: Lifting Monocular Video for 4D Multi-Object Interactions via Human-Agent Collaboration}, author = {Jiaxin Li and Yuxiang Wu and Zhenkai Zhang and Xinrui Shi and Haoyuan Wang and Yichen Zhao and Su Linxiang and Chenyang Yu and Mingyu Zhang and Yifan Ding and Boran Wen and Li Zhang and Ruiyang Liu and Yong-Lu Li}, year = {2026}, url = {https://arxiv.org/abs/2606.28215}, note = {Source identifier: 2606.28215} }