TY - RPRT TI - Multi-Agent Self-Improving Reinforcement Learning for Video Reasoning AU - Mingwen Zhang AU - Jisheng Dang AU - Minqiang Yang AU - Bimei Wang AU - Bin Hu AU - Tat-Seng Chua PY - 2026 UR - https://arxiv.org/abs/2608.28675 ID - 2608.28675 ER -