TY - RPRT TI - WM-R1: Training GUI Agents to Reason and leverage World Models with Reinforcement Learning AU - Yu Han AU - Tianwen Qian PY - 2026 UR - https://arxiv.org/abs/2608.27508 ID - 2608.27508 ER -