TY - RPRT TI - RL-VLA$^3$: A Flexible and Asynchronous Reinforcement Learning Framework for VLA Training AU - Haoran Sun AU - Yongjian Guo AU - Zhong Guan AU - Shuai Di AU - Xiaodong Bai AU - Jing Long AU - Tianyun Zhao AU - Mingxi Luo AU - Hongke Zhao AU - Likang Wu AU - Xiaotie Deng AU - Xu Chu AU - Xi Xiao AU - Sheng Wen AU - Yicheng Gong AU - Junwu Xiong PY - 2026 UR - https://arxiv.org/abs/2602.05765 ID - 2602.05765 ER -