TY - RPRT TI - EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents AU - Mianqiu Huang AU - Taofeng Xue AU - Chong Peng AU - Jinrui Ding AU - Jie Yang AU - Sicheng Fan AU - Jiale Hong AU - Yufei Gao AU - Xiaocheng Zhang AU - Linsen Guo AU - Xin Yang AU - Dengchang Zhao AU - Yuchen Xie AU - Peng Pei AU - Xunliang Xie AU - Xipeng Qiu PY - 2026 UR - https://arxiv.org/abs/2607.09773 ID - 2607.09773 ER -