@misc{indiciae5db41e940b0d, title = {CrossEdit: Cross-Modal Training Enables Rich Audio-Visual Editing}, author = {William Chen and Prem Seetharaman and Ke Chen and Oriol Nieto and Kevin Duarte and Siddharth Srinivasan Iyer and Mamshad Nayeem Rizve and Zhiwen Cao and Shinji Watanabe and Yuanjun Xiong and Jianming Zhang and Zeyu Jin and Justin Salamon}, year = {2026}, url = {https://arxiv.org/abs/2610.10264}, note = {Source identifier: 2610.10264} }